跳转到主要内容

OpenAI发布开源模型GPT-OSS-120B和20B

OpenAI发布开源GPT-OSS模型

在重大战略调整下,OpenAI宣布基于Apache 2.0许可证发布两款开源语言模型——GPT-OSS-120BGPT-OSS-20B。这是自2019年GPT-2以来OpenAI首次重大开源贡献,标志着对开发者社区的重新承诺。

Image

模型规格与部署灵活性

新发布的模型采用专家混合(MoE)架构:

  • GPT-OSS-120B: 具备1170亿参数(51亿活跃),专为单块NVIDIA H100 GPU(80GB显存)的高性能任务优化。在竞技编程(Codeforces)、综合问题解决(MMLU, HLE)和健康咨询(HealthBench)方面表现卓越。

  • GPT-OSS-20B: 针对仅需16GB内存的边缘设备设计,这款210亿参数(36亿活跃)模型的性能可比肩OpenAI专有模型o3-mini,尤其在竞技数学(AIME2024 & 2025)领域。

两款模型均支持128k token上下文窗口,采用稠密与稀疏交替注意力机制提升效率。OpenAI还开源了'o200k_harmony'分词器,降低了开发者门槛。

Image

安全与战略意义

OpenAI强调进行了严格的安全测试,包括根据其预备框架(Preparedness Framework)进行的对抗性微调评估。外部审计确认这些模型在网络安全或生物化学等敏感领域未达到高风险能力等级。

此次发布被视为对Meta的LlamaDeepSeek的R1等开源竞争对手的回应。CEO Sam Altman承认过去闭源策略的失误,称此次发布是纠正措施。

企业与开发者应用场景

这些模型满足金融、医疗等需要本地化部署的行业需求,支持不依赖云端的私有服务器使用。与**AI Sweden等机构合作旨在增强针对特定语言的区域微调能力。

开发者可通过框架如Transformers、vLLM或llama.cpp集成模型,权重文件已在Hugging Face等平台发布。主要功能包括:

  • 思维链推理能力;
  • 工具调用(Python执行、网络搜索);
  • 结构化输出(JSON/YAML)。

Image Image

核心要点:

  1. OpenAI自GPT-2以来首次开源发布,采用Apache 2.0许可证;
  2. 两种版本:数据中心级(120B)与边缘设备友好型(20B);
  3. 通过对抗测试和透明度报告强调安全性;
  4. 瞄准开源竞争下企业对私有化AI部署的需求;
  5. 支持多框架集成以简化开发者适配流程