世界动态 · 人工智能 · 2025年8月5日
开放AI模型:gpt-oss、DeepSeek带来的改变
2025年,DeepSeek开放了R1,OpenAI推出了自2019年以来首个开放权重的gpt-oss。为什么开放模型对小规模的人很重要。
bairogonzalez.com 团队,根据 Bairo 的经历撰写 · 发布于
开放模型,或称开放权重模型,是可以下载、在自己的电脑上运行并加以调整的人工智能,而不只是通过互联网使用。2025年,两次发布让这个话题备受关注:1月,中国公司深度求索(DeepSeek)以 MIT 许可证发布了推理模型 DeepSeek-R1;8月5日,OpenAI 以 Apache 2.0 许可证推出了两种规格的 gpt-oss,这是该公司自2019年的 GPT-2 以来首次发布开放权重。
发生了什么
DeepSeek-R1 以允许商业使用、修改和衍生作品的许可证发布。与它一同推出的还有更小的"蒸馏"版本,规模可以装进配置朴素得多的机器。这次发布引起了全世界的关注,因为一个开放模型接近了当时最好的封闭模型。
8月,OpenAI 推出了 gpt-oss,有两个版本:gpt-oss-120b 和 gpt-oss-20b。据《麻省理工科技评论》(MIT Technology Review)报道:
- 较小的版本可以在一台16 GB内存的电脑上运行;
- 在多项测试中,其性能接近 OpenAI 自己的小型模型;
- Apache 2.0 许可证允许商业使用,研究人员认为它比其他美国模型的许可证更开放;
- 该公司也把这次发布定位为对 DeepSeek、通义千问(Qwen)和 Kimi 等中国开放模型崛起的回应。
该杂志突出了一个许多人关心的用途:需要把数据留在内部的医院、律师事务所和政府,可以在本地运行和调整模型。
斯坦福的《2025年人工智能指数报告》测量了这一效应:一年之内,在部分测试中,开放模型与封闭模型的性能差距从8%缩小到1.7%。
为何重要
对于不是巨头的人来说,开放模型改变了三件事:
- 隐私。病历、诉讼材料或会计账目等敏感数据,可以在不离开公司机器的情况下处理。
- 成本。对于边界清晰的任务,一个小型开放模型的花费,可能只是通过互联网使用大模型的一小部分。
- 专门化。开放模型可以针对一个细分领域进行调整,掌握那门行当的词汇和规则。
也有需要注意的地方。开放模型照样会出错,安全成为运行者自己的责任,每一种许可证都有各自的条件。开放权重并不等于开放训练数据。
拜罗的看法
在拜罗·莱昂德罗·冈萨雷斯·马丁内斯(Bairo Leandro Gonzalez Martinez)看来,开放模型是把人工智能交还给人们最具体的方式之一。在他的理解中,如果人工智能是人类的延伸,它就不能只依赖于出租它的人,它需要能够住在使用者身边。
他讲述,CLAIN 诞生于一笔账:人工智能要消耗 token,token 要花钱,而最需要的人往往最付不起。在他看来,小型开放模型是答案的一部分,因为它们让人可以拥有廉价的专家,每一个都为一种具体的痛而训练。这正是他创立的代理编排器 CLAIN 的设计:许多细分领域人工智能协同工作,最后由一个人做决定。2026年10月1日宣布的"142天142个细分领域人工智能"是一个公开目标。
拜罗也提醒人们注意责任的一面。在他的理解中,开放模型扩大了可及性,也正因如此,更需要审慎对待从中产出的内容是否真实。
与生态系统的交汇
- 在医疗领域,Xperienc Global Labs 处理需要保密的数据。其构想是在用户面板中保存私密记录,并采用由专业人员核实的临床助手。
- 在法律领域,仍在开发中的 SOSPROCESSOS 处理诉讼信息,在这种用途中,在受控环境中运行模型至关重要。
- 在文件保护方面,qrqbits 提出用多层后量子密码保护文件、图片、音频和文本。
每一个都是独立实体,各有自己的注册。在每种情况下使用哪个模型,是一个技术选择,取决于评估。
资料来源
- OpenAI,2025年8月5日:Introducing gpt-oss
- DeepSeek,Hugging Face,2025年1月:DeepSeek-R1
- MIT Technology Review,2025年8月5日:OpenAI has finally released open-weight language models
- Stanford HAI,2025年4月:The 2025 AI Index Report