GLM-5.3发布:基座不变,编程能力却跃居开源榜首
智谱今日发布GLM-5.3,与上一代相比,基座模型未变,所有提升均来自后训练阶段的扩展。通过十倍长程任务环境、更多样的环境类型和更长的训练时间,模型智能上限被显著拉高。内部评估显示,编程体验较GLM-5.2提升约50%,成为当前编程能力最强的开源模型。公开基准测试中,Terminal-Bench 3.0得分从4.6飙升至28.3,DeepSWE v1.1从46.2升至66.9,Agent能力逼近Claude Fable 5。安全方面同样出色,白盒代码审查和漏洞检测表现与Mythos 5相当。模型权重将在两周后发布,但需先完成安全评估。







