Skip to main content

腾讯混元Hy4预览版开源:770B参数,百万上下文,跻身顶尖开源模型

腾讯今天放了个大招——混元Hy4预览版正式开源了。这个模型总参数高达770B,激活参数49B,上下文长度直接拉到1M,妥妥的“大块头”。官方说,这次在规模、上下文和数据量上都做了大幅扩展,预训练和后训练一起发力,智力水平又上了一个台阶,在开源模型里算是站稳了第一梯队。

目前,Hy4预览版已经同步上线HuggingFace、GitHub、ModelScope和Gitcode,腾讯云TokenHub和OpenRouter也接入了,想尝鲜的开发者可以随时上手。

Image

生产力场景全面升级,盲测成绩亮眼

这次Hy4预览版在真实任务上的进步可不小。腾讯内部联合了软件工程、游戏、金融、安全等领域的专家,一起搞了高质量数据来训练。在软件工程方面,它强化了长周期开发的理解、规划和验证能力;办公分析场景里,能从数据处理一路做到文档表格呈现,全流程交付;游戏开发中,给个需求就能生成可玩的原型;在分子动力学、凝聚态物理这类科研场景也有进展。

腾讯还组织了163位内部专家,对203个工程任务做了盲测。Hy4预览版平均得分2.99(满分4.00),略胜GLM-5.3的2.92和Kimi K3的2.94。更厉害的是,它和Hyra一起,在三维Blaschke–Lebesgue这个百年几何难题上取得了突破,把体积下界从0.380799推进到了0.41104,离Meissner四面体猜想的0.41986只差大约2%了。

Image

官方坦诚:还有提升空间

不过,腾讯官方也大方承认,Hy4预览版只是Hy4的早期迭代,预训练和后训练都还有改进余地。已知的问题包括复杂任务下思考过长、过度自我验证等,但他们会继续快速迭代。目前,Hy4预览版已经深度集成到CodeBuddy和WorkBuddy,用户也能在元宝和ima等产品里直接体验。

关键要点

  • 参数规模:总参数770B,激活参数49B,上下文长度1M。
  • 开源平台:已上线HuggingFace、GitHub、ModelScope、Gitcode,并集成至腾讯云TokenHub和OpenRouter。
  • 性能表现:内部盲测得分2.99,超越GLM-5.3(2.92)和Kimi K3(2.94)。
  • 科研突破:在三维Blaschke–Lebesgue问题上取得进展,体积下界提升至0.41104。
  • 已知局限:复杂任务思考过长、过度自我验证,官方表示将持续迭代。