Skip to main content

腾讯混元发布开源旗舰模型Hy4preview:7700亿参数,百万上下文

8月28日,腾讯混元正式发布了新一代开源旗舰大模型Hy4preview。这款模型总参数高达7700亿,激活参数为490亿,上下文长度达到100万,直接瞄准真实生产力场景。目前,Hy4preview已在HuggingFace、GitHub、ModelScope等平台同步开源,并上线腾讯云TokenHub和OpenRouter,用户可在WorkBuddy、CodeBuddy、元宝、ima等产品中直接体验。

四大能力方向,直击行业痛点

Hy4preview的研发团队与腾讯内部软件工程、游戏、金融、安全等领域的专家合作,利用高质量数据共同训练,在四个方向上取得了显著进展:

  • 软件工程:增强了对长期开发任务的理解、规划和调试能力,帮助开发者更高效地处理复杂项目。
  • 办公场景:从数据分析到文档、表格、演示文稿的完整交付,一站式搞定,让办公效率大幅提升。
  • 游戏开发:通过MCP支持与Unreal5和Unity引擎集成,仅凭对话就能从零生成可玩的游戏demo,极大降低了游戏开发门槛。
  • 科学研究:覆盖分子动力学、凝聚态物理、基础数学等领域,助力科研人员加速探索。

Image

实力如何?数据说话

内部盲测数据显示,在163位专家对203项工程任务的评分中,Hy4preview平均得分2.99/4.00,略高于GLM-5.3的2.92和Kimi K3的2.94。在科学研究方面,Hy4preview结合Hyra模型,将三维Blaschke–Lebesgue问题这一百年经典难题的体积下界从0.380799推进到0.41104,距离最终证明Meissner四面体猜想仅剩约2%的距离。此外,在模拟32,512原子磷脂双分子层时,实现了2.0倍的加速,达到54.9毫秒/步。

Image

开源策略:从参数竞赛到生产力验证

腾讯表示,Hy4preview是Hy4迭代的早期版本,预训练和后训练仍有改进空间,已知问题包括复杂任务的长思维链等。通过开源方式发布早期版本,腾讯希望吸收真实反馈,快速迭代。这一策略延续了行业趋势:大模型竞争正从参数比拼转向生产力效果的验证。

关键要点

  • 模型规模:总参数7700亿,激活参数490亿,上下文长度100万。
  • 开源平台:HuggingFace、GitHub、ModelScope、腾讯云TokenHub、OpenRouter。
  • 能力亮点:软件工程、办公、游戏开发、科学研究四大领域均有突破。
  • 性能表现:工程任务评分优于GLM-5.3和Kimi K3;科研方面推动Blaschke–Lebesgue问题进展。
  • 迭代计划:早期版本,将根据反馈快速迭代,优化复杂任务处理能力。