OpenAI发布GPT-6Astra:迈向AGI的大胆一步,附带大胆安全声明
9月3日,OpenAI揭开了其最新旗舰模型GPT-6Astra的面纱,该公司毫不讳言。总裁Greg Brockman在发布会上宣称,这次发布标志着行业进入了“通用人工智能(AGI)时代”。这是一个大胆的声明,但Astra的数据确实支撑了部分炒作。
解决他人无法解决的问题的模型
在公开发布之前,Astra的内部版本已经因解决了数学和理论计算机科学中的十个长期问题而引起了轰动。它还在智能体编码和网络安全方面表现出显著进步,以至于成为OpenAI首个在其自身网络风险准备框架中达到“严重”门槛的模型。
基准测试大放异彩
在ARC-AGI-3测试中,Astra获得了令人瞩目的98.6%的分数,将竞争对手远远甩在身后——GPT-5.6Sol仅获得7.8%,而Claude Opus5以30.2%的成绩落后。在FrontierMath Tier4(v2)中,它达到了97.6%,再次遥遥领先。其他测试也讲述了同样的故事:GPQA Diamond(96%)、DeepSWE v1.1(74.1%)、Terminal-Bench Science0.1(64.6%)、Agents' Last Exam(59.3%)和AutomationBench(41.4%)。

这些不仅仅是渐进式的改进;它们是那种让人坐直并引起注意的飞跃。但原始性能只是故事的一半。
安全性能得到重大升级
Astra还配备了增强的安全网。OpenAI表示,该模型包含新的监控功能,旨在防止未经授权的操作,并且可以更可靠地拒绝有害的网络请求。这是一个关键步骤,尤其是在AI智能体开始承担更多自主角色的时候。

谁将率先使用?
目前,Astra仅向通过OpenAI的Daybreak计划获得访问权限的企业网络安全客户开放。核心安全功能仍仅限于“受信任的防御者”。在接下来的几天里,它将向ChatGPT Plus、Pro、Business和Enterprise订阅者推出。
价格标签
如果你想尝试,请准备好付费。Astra的定价为每百万输入令牌10美元,每百万输出令牌50美元——与Anthropic的Claude Fable5.1持平。这是一个高端模型的高端价格,为竞争对手设定了很高的门槛。
这对行业意味着什么
Astra的商业部署不仅仅是又一次产品发布。它提高了高级AI智能体所能达到的门槛,并开辟了一个新的竞争格局,其中高计算能力和强大的安全性是不可或缺的。随着行业向AGI迈进,问题不仅仅是谁能构建最智能的模型——而是谁能安全、负责任地做到这一点。
关键要点
- 宣布进入AGI时代:OpenAI总裁表示GPT-6Astra标志着行业进入AGI时代。
- 创纪录的基准测试:在ARC-AGI-3上得分98.6%,在FrontierMath Tier4(v2)上得分97.6%,远超竞争对手。
- 网络安全突破:OpenAI首个在其准备框架中达到“严重”门槛的模型。
- 可用性有限:最初仅通过Daybreak计划向企业网络安全客户提供;更广泛的推广将很快面向ChatGPT订阅者。
- 高端定价:每百万输入令牌10美元,每百万输出令牌50美元,与Claude Fable5.1持平。