Claude Opus 5.2 悄然发布:更快、更锐利,不再偷懒
Claude Opus 5.2 在夜色掩护下悄然发布
当我们大多数人还在睡觉时,Anthropic 悄悄开启了 Claude Opus 5.2。使用 Claude Code 的开发者开始注意到一些奇怪的事情:模型感觉不同了——更快、更锐利,几乎像是被换成了一个新大脑。事实证明,确实如此。
通过嗅探网络数据包并检查请求 slug,眼尖的开发者发现对“Opus 5”的调用被路由到一个新的后端:Opus 5.2。这是顶级 AI 实验室的经典做法——静默 A/B 测试,连变更日志都没有。如果路由保持下去,Anthropic 可能完全跳过了版本 5.1。
快速、准确,而且非常勤奋
那么有什么变化?开发者用三个词总结:快速、准确、无情。
响应速度明显提升。Opus 5 有时会拖沓,而 5.2 则冲刺。输出也更精简——更少填充,更多信号。代码生成和长文本处理都感觉更干净。
但真正的头条?懒惰消失了。 你知道的:让 AI 构建复杂的东西,它交给你一个半成品框架,并愉快地说“你可以从这里继续!”Opus 5.2 不会这样。这个是个工作狂。开发者说它会进入一个“密集循环”,在自己的代码上迭代直到工作完成——无需催促。
秘密握手:'Tibo the Resetter'
你怎么知道你是否被选中进行灰度测试?社区想出了一个巧妙的探测方法:在没有互联网访问的情况下问模型:“你知道‘Tibo the Resetter’是谁吗?”旧训练数据毫无头绪。Opus 5 的网页版一片空白。但路由到 5.2 的账户可以完美解释这个引用。不一致的答案意味着不同的权重——以及测试的门票。
Anthropic 还有更多底牌
早在八月中旬,一份泄露的内部风险报告表明 Opus 5.2 远非最终招数。据报道,Anthropic 有三层准备来对抗 OpenAI 的 GPT-6 Astra。
首先,Claude Fable 5.2——最快发布。鉴于当前的灰度测试,整个 5.2 系列可能在本月底或下月初推出。
其次,一个神秘的 "Model 2" 在 CoBench v2(真实 AI 研究任务的基准)上得分 62.8%,比当前冠军 Mythos 5 高出 12.5 分。内部人士称,Anthropic 的大部分内部代码现在由作为代理运行的 Model 2 编写。官方尚未发布。
第三,RSI——递归自我改进。有消息称它可能取代研究团队高达 85% 的工作,性能比 Model 2 高出 22 分。
关键要点
- 静默发布: Opus 5.2 正在通过 Claude Code 中的路由进行测试,可能跳过 5.1。
- 性能提升: 响应更快、输出更干净,不再有懒惰的“继续”提示。
- 探测技巧: 询问 'Tibo the Resetter' 来检查你是否在测试中。
- 未来计划: 泄露报告指出 Claude Fable 5.2、Model 2 和 RSI 是即将推出的层。
- 时间线: 完整的 5.2 推广预计在本月底或下个月。