OpenAI重磅宣布推出两款开源权重语言模型——gpt-oss-120b和gpt-oss-20b,这标志着自2019年GPT-2开源以来,OpenAI首次正式回归开源领域。这一战略举措不仅彰显了OpenAI的技术自信,更为全球AI开发者注入了强劲动力,将加速AI技术的普及化进程与创新浪潮。

两款开源模型均采用Apache2.0许可证发布,赋予开发者完整的自由度,可自由下载、修改并应用于商业场景。gpt-oss-120b和gpt-oss-20b分别拥有1170亿和210亿参数的混合专家(MoE)架构,激活参数量分别为51亿和36亿,在兼顾高效推理与资源控制方面实现了完美平衡。具体性能表现如下:

OpenAI开源gpt-oss-120b与20b模型,赋能开发者创新AI应用插图

gpt-oss-120b:单卡运行能力强大,可在NVIDIA H100 GPU(80GB内存)上流畅运行,性能接近OpenAI专有模型o4-mini。在竞赛编程(Codeforces)、通用问题解决(MMLU、HLE)及健康相关查询(HealthBench)等场景中表现卓越,特别适合数据中心或高端企业级应用。

gpt-oss-20b:极致轻量化设计,仅需16GB内存即可在边缘设备上高效运行,性能媲美o3-mini。在竞赛数学(AIME2024&2025)等细分领域展现出惊人实力,为本地推理和设备端应用提供了理想解决方案。

OpenAI开源gpt-oss-120b与20b模型,赋能开发者创新AI应用插图1

技术细节方面,两款模型均支持长达128k token的上下文长度,创新性地采用交替密集和局部带状稀疏注意力机制,并运用分组多查询注意力技术显著提升推理效率。OpenAI还同步开源了‘o200k_harmony’分词器,进一步降低开发者的技术门槛。

安全与责任并重,OpenAI在开源过程中始终坚持高标准安全原则。针对开源模型可能面临的恶意微调风险,OpenAI对gpt-oss-120b进行了严格的对抗性微调测试,并通过“准备框架”验证确保模型在生物、化学及网络安全等敏感领域不会形成高风险能力。外部安全专家的独立审查进一步强化了模型的安全性。同时,OpenAI呼吁开发者根据实际应用场景补充必要的安全措施,并在模型卡和研究论文中全面披露安全测试数据,为开源社区提供透明参考。

OpenAI开源gpt-oss-120b与20b模型,赋能开发者创新AI应用插图2

此次战略转向被视为OpenAI应对开源领域激烈竞争的明智之举。近年来,Meta、DeepSeek等企业通过开源模型抢占市场,迫使OpenAI重新评估其闭源策略。CEO Sam Altman在Reddit AMA中坦诚表示,过去的开源路线存在失误,此次发布正是兑现回归开源承诺的关键一步。gpt-oss系列不仅满足了企业对本地化部署和数据隐私的迫切需求,更在金融、医疗、法律等高监管行业展现出巨大应用潜力,允许模型部署在私有服务器上彻底规避数据安全风险。OpenAI还与瑞典国家人工智能中心AI Sweden等机构展开合作,探索区域性微调方案,以提升模型在特定语言和文化环境下的适应性。

开发者生态赋能方面,gpt-oss系列展现出极高的兼容性,支持Transformers、vLLM、Ollama和llama.cpp等多种开发框架。开发者可通过Hugging Face、GitHub等平台便捷获取模型权重,并利用OpenAI提供的参考代码快速搭建应用。模型内置链式推理(Chain-of-Thought)、工具调用(支持Python代码执行、网页搜索等)及结构化输出(JSON、YAML等)功能,特别适合构建智能体工作流。此外,三种可调节的推理等级(低、中、高)让开发者能够灵活平衡速度与精度需求。

OpenAI开源gpt-oss-120b与20b模型,赋能开发者创新AI应用插图3

gpt-oss的问世不仅为开发者提供了高性能、低成本的AI工具,更对AI行业格局产生深远影响。相较于Meta的Llama或DeepSeek的R1,gpt-oss在推理能力和工具集成方面具有明显优势,尽管仍以文本单模态为主,但可通过API调用补充多模态功能。OpenAI表示将持续根据社区反馈优化gpt-oss系列,但未透露具体更新计划。业内专家预测,这一举措可能推动更多企业采用混合AI策略,即结合开源模型与云端服务,在成本与灵活性之间实现最佳平衡。

官方博客:https://openai.com/zh-Hans-CN/index/introducing-gpt-oss/

最新快讯

2026年03月04日

13:04
3月4日,中国铁路部门就网传“西安至广州东K731次列车硬座惊现上下铺”消息发布核查通报。经查,西安至广州方向并无K731次列车,该车次实际由大同开往广州白云,不途经西安;节后返程高峰(2月21日至3月2日)期间,相关普速列车硬座客座率均未超140%,属正常范围;各次列车乘务人员均按规巡视服务,未发现硬座下躺人情况。铁路部门呼吁公众不造谣、不信谣、不传谣。
13:04
2026年3月,北京五和博澳药业股份有限公司向港交所递交上市申请。公司核心产品桑博恩®为我国首个、全球首个植物来源降糖天然药物,贡献100%收入,2025年1-9月营收2.07亿元,毛利率74.1%。但其高度依赖单一产品及前三大客户(占比70.7%),且销售费用是研发费用的3倍。公司已融资10.89亿元,截至2026年1月底现金不足亿元,短债缺口3167....
13:04
2026年3月3日,华纳兄弟确认正开发《权力的游戏》电影版,邀请《安多》编剧博·威利蒙执笔,故事聚焦约300年前伊耿·坦格利安一世统一维斯特洛的‘血与火’征程。影片定位宏大,对标《沙丘》系列。目前项目处于剧本初稿阶段,但面临派拉蒙天舞1110亿美元收购华纳兄弟探索公司的重大变数。HBO亦同步开发同题材剧集,二者去留未定。
13:04
3月4日,国家铁路局就《铁路工程质量检测管理办法(征求意见稿)》向社会公开征求意见。该办法拟建立铁路工程质量检测机构许可制度,明确检测定义及资质管理要求;将资质分为综合类与专项类;细化申请条件、材料、程序;规范评审方式、证书有效期、延续、变更、重组及注销等全流程管理。此举旨在强化铁路工程质量检测监管,提升检测工作规范化、专业化水平。
13:04
声明:本文来自于微信公众号 游戏价值论,作者:李亚倢,授权站长之家转载发布。今年的春节档本是大DAU产品们的社交场,腾讯系多款长青游戏以及网易《蛋仔派对》迎合年轻用户的数字过年需求,巨人黑马《超自然行动》的神奇仍在继续,这些产品春节档的优异表现都在情理之中。然而当我在商场看到《我的花园世界》投放广告,下意识想到的却是11年前20...
12:34
微新创想:山东菏泽一位41岁的打铁花网红“村夫”在除夕夜表演完打铁花后,将未燃尽的炭带回家中取暖,不幸因一氧化碳中毒离世,留下了两个年幼的女儿。他的离去让整个家庭陷入深深的悲痛之中 “村夫”的弟弟王先生悲痛地表示这几天他感觉像做梦一样,完全不敢相信那个每天笑着直播、拼命努力的哥哥就这样离开了人世。王先生说哥哥是两个女儿的单亲爸爸,为了生活他搬过砖、送过外卖、...
12:34
微新创想:最近在抖音上,AI生成视频的内容越来越丰富,脑洞也越来越大。从最初的大战小怪兽的特摄片,到现在的小猫上缴红包、小猫小狗偷玩手机、邵氏武侠风格的人猫大战、食堂阿姨采访,再到更硬核的机器人代替人上坟、复活小浣熊水浒卡、疯狂动物城版的《武林外传》,这些内容不仅形式多样,而且创意十足。其中,机器人代替人上坟的视频获得了5.2万个赞,而这条视频的创作者并不是...
12:34
声明:本文来自于微信公众号 数字生命卡兹克,作者:数字生命卡兹克,授权站长之家转载发布。昨天,美团光年之外团队终于悄悄的发布了他们首个AI浏览器。也就是,Tabbit。坦诚的讲,这个AI浏览器,我已经用了快半个月了。现在已经取代了我之前一直在用的Perplexity家的Comet,成为了我如今的默认浏览器。有图为证,我这篇稿子,...
12:34
微新创想:2026年3月2日,Palo Alto Networks Unit 42披露Chrome浏览器Gemini功能存在高危漏洞(CVE-2026-0628) 该漏洞允许低权限恶意扩展通过declarativeNetRequests API向Gemini面板注入JavaScript代码,进而非法获取本地文件读取、摄像头、麦克风及截屏等高权限 攻击无需用户...
12:34
微新创想:2026年3月4日,沃尔玛全球电商宣布启动新卖家激励计划。该计划专门针对在2026年2月1日后入驻沃尔玛美国站的新卖家,为符合条件的商家提供最高可达7.5万美元的激励支持。 微新创想:激励内容包括销售佣金减免、WFS物流费用优惠、SEM广告费返还以及广告抵用金等多项福利。这些措施不仅降低了新卖家的运营成本,也提高了其在平台上的盈利能力。 微新创想:...
12:34
微新创想:3月3日(周一),AOC正式推出G24B36Z与G25B36SN两款FHD分辨率电竞显示器。这两款显示器分别采用了不同的面板技术,以满足不同用户的需求。G24B36Z是一款23.8英寸的Fast IPS面板显示器,具备原生200Hz的刷新率,通过超频可达到260Hz。G25B36SN则为24.5英寸的Fast VA面板显示器,原生刷新率为280Hz...
12:34
微新创想:2026年3月,合肥曦合超导科技有限公司宣布完成A+轮融资。本轮融资由多家知名投资机构共同参与,包括合肥创新投资、江铜投资、中科创星、兴富资本、粤科金融、网达投资、庐阳科创集团及集创基金。此次融资将进一步推动公司的技术研发与市场拓展。 微新创想:曦合超导是一家专注于超导与低温设备研发制造的企业。其产品主要应用于实验室、工业以及特殊场景,涵盖多种高性...