Bairo GonzalezLeandro · Martinez

世界动态 · 人工智能 · 2025年8月5日

开放AI模型:gpt-oss、DeepSeek带来的改变

2025年,DeepSeek开放了R1,OpenAI推出了自2019年以来首个开放权重的gpt-oss。为什么开放模型对小规模的人很重要。

bairogonzalez.com 团队,根据 Bairo 的经历撰写 · 发布于

开放模型,或称开放权重模型,是可以下载、在自己的电脑上运行并加以调整的人工智能,而不只是通过互联网使用。2025年,两次发布让这个话题备受关注:1月,中国公司深度求索(DeepSeek)以 MIT 许可证发布了推理模型 DeepSeek-R1;8月5日,OpenAI 以 Apache 2.0 许可证推出了两种规格的 gpt-oss,这是该公司自2019年的 GPT-2 以来首次发布开放权重。

发生了什么

DeepSeek-R1 以允许商业使用、修改和衍生作品的许可证发布。与它一同推出的还有更小的"蒸馏"版本,规模可以装进配置朴素得多的机器。这次发布引起了全世界的关注,因为一个开放模型接近了当时最好的封闭模型。

8月,OpenAI 推出了 gpt-oss,有两个版本:gpt-oss-120b 和 gpt-oss-20b。据《麻省理工科技评论》(MIT Technology Review)报道:

  • 较小的版本可以在一台16 GB内存的电脑上运行;
  • 在多项测试中,其性能接近 OpenAI 自己的小型模型;
  • Apache 2.0 许可证允许商业使用,研究人员认为它比其他美国模型的许可证更开放;
  • 该公司也把这次发布定位为对 DeepSeek、通义千问(Qwen)和 Kimi 等中国开放模型崛起的回应。

该杂志突出了一个许多人关心的用途:需要把数据留在内部的医院、律师事务所和政府,可以在本地运行和调整模型。

斯坦福的《2025年人工智能指数报告》测量了这一效应:一年之内,在部分测试中,开放模型与封闭模型的性能差距从8%缩小到1.7%。

为何重要

对于不是巨头的人来说,开放模型改变了三件事:

  • 隐私。病历、诉讼材料或会计账目等敏感数据,可以在不离开公司机器的情况下处理。
  • 成本。对于边界清晰的任务,一个小型开放模型的花费,可能只是通过互联网使用大模型的一小部分。
  • 专门化。开放模型可以针对一个细分领域进行调整,掌握那门行当的词汇和规则。

也有需要注意的地方。开放模型照样会出错,安全成为运行者自己的责任,每一种许可证都有各自的条件。开放权重并不等于开放训练数据。

拜罗的看法

在拜罗·莱昂德罗·冈萨雷斯·马丁内斯(Bairo Leandro Gonzalez Martinez)看来,开放模型是把人工智能交还给人们最具体的方式之一。在他的理解中,如果人工智能是人类的延伸,它就不能只依赖于出租它的人,它需要能够住在使用者身边。

他讲述,CLAIN 诞生于一笔账:人工智能要消耗 token,token 要花钱,而最需要的人往往最付不起。在他看来,小型开放模型是答案的一部分,因为它们让人可以拥有廉价的专家,每一个都为一种具体的痛而训练。这正是他创立的代理编排器 CLAIN 的设计:许多细分领域人工智能协同工作,最后由一个人做决定。2026年10月1日宣布的"142天142个细分领域人工智能"是一个公开目标。

拜罗也提醒人们注意责任的一面。在他的理解中,开放模型扩大了可及性,也正因如此,更需要审慎对待从中产出的内容是否真实。

与生态系统的交汇

  • 在医疗领域,Xperienc Global Labs 处理需要保密的数据。其构想是在用户面板中保存私密记录,并采用由专业人员核实的临床助手。
  • 在法律领域,仍在开发中的 SOSPROCESSOS 处理诉讼信息,在这种用途中,在受控环境中运行模型至关重要。
  • 在文件保护方面,qrqbits 提出用多层后量子密码保护文件、图片、音频和文本。

每一个都是独立实体,各有自己的注册。在每种情况下使用哪个模型,是一个技术选择,取决于评估。

资料来源

延伸阅读