跳转到主要内容

Claude Opus 5.2 悄然发布:更快、更锐利,不再偷懒

Claude Opus 5.2 在夜色掩护下悄然发布

当我们大多数人还在睡觉时,Anthropic 悄悄开启了 Claude Opus 5.2。使用 Claude Code 的开发者开始注意到一些奇怪的事情:模型感觉不同了——更快、更锐利,几乎像是被换成了一个新大脑。事实证明,确实如此。

通过嗅探网络数据包并检查请求 slug,眼尖的开发者发现对“Opus 5”的调用被路由到一个新的后端:Opus 5.2。这是顶级 AI 实验室的经典做法——静默 A/B 测试,连变更日志都没有。如果路由保持下去,Anthropic 可能完全跳过了版本 5.1。

快速、准确,而且非常勤奋

那么有什么变化?开发者用三个词总结:快速、准确、无情

响应速度明显提升。Opus 5 有时会拖沓,而 5.2 则冲刺。输出也更精简——更少填充,更多信号。代码生成和长文本处理都感觉更干净。

但真正的头条?懒惰消失了。 你知道的:让 AI 构建复杂的东西,它交给你一个半成品框架,并愉快地说“你可以从这里继续!”Opus 5.2 不会这样。这个是个工作狂。开发者说它会进入一个“密集循环”,在自己的代码上迭代直到工作完成——无需催促。

秘密握手:'Tibo the Resetter'

你怎么知道你是否被选中进行灰度测试?社区想出了一个巧妙的探测方法:在没有互联网访问的情况下问模型:“你知道‘Tibo the Resetter’是谁吗?”旧训练数据毫无头绪。Opus 5 的网页版一片空白。但路由到 5.2 的账户可以完美解释这个引用。不一致的答案意味着不同的权重——以及测试的门票。

Anthropic 还有更多底牌

早在八月中旬,一份泄露的内部风险报告表明 Opus 5.2 远非最终招数。据报道,Anthropic 有三层准备来对抗 OpenAI 的 GPT-6 Astra。

首先,Claude Fable 5.2——最快发布。鉴于当前的灰度测试,整个 5.2 系列可能在本月底或下月初推出。

其次,一个神秘的 "Model 2" 在 CoBench v2(真实 AI 研究任务的基准)上得分 62.8%,比当前冠军 Mythos 5 高出 12.5 分。内部人士称,Anthropic 的大部分内部代码现在由作为代理运行的 Model 2 编写。官方尚未发布。

第三,RSI——递归自我改进。有消息称它可能取代研究团队高达 85% 的工作,性能比 Model 2 高出 22 分。

关键要点

  • 静默发布: Opus 5.2 正在通过 Claude Code 中的路由进行测试,可能跳过 5.1。
  • 性能提升: 响应更快、输出更干净,不再有懒惰的“继续”提示。
  • 探测技巧: 询问 'Tibo the Resetter' 来检查你是否在测试中。
  • 未来计划: 泄露报告指出 Claude Fable 5.2、Model 2 和 RSI 是即将推出的层。
  • 时间线: 完整的 5.2 推广预计在本月底或下个月。