跳转到主要内容

腾讯混元Hy3发布:更智能、更便宜、更实用

7月6日,腾讯正式发布混元Hy3,这是其大语言模型的最新版本。与4月发布的预览版相比,Hy3在智能性上显著提升——通常能媲美甚至超越规模大2到5倍的模型。更关键的是,它还更便宜。API定价为输入每百万token 1元,输出每百万token 4元,缓存命中后输入成本降至仅0.25元。

Hy3采用混合专家(MoE)架构,总参数量2950亿,但每个token仅激活210亿参数。这意味着它在不牺牲智能性的同时保持了高效。它最多可处理256,000个token的上下文,足以应对长文档或复杂对话。

Image

更智能的模型,应对实际任务

Hy3的突出之处在于它在实际任务上的大幅提升。在270名专家参与的盲测中,针对真实工作场景,Hy3平均得分2.67(满分4分),超过了GLM-5.1的2.51分。最大优势体现在前端开发、数据存储和CI/CD流水线等领域。这不仅仅是实验室结果——它表明该模型已为现实世界做好准备。

腾讯已将Hy3集成到多个产品中。公司AI办公助手WorkBuddy在切换至Hy3后,任务成功率从72%跃升至90%,平均任务时间缩短了34%。用户反馈也印证了这一点:自预览版发布以来,WorkBuddy上选择Hy3的用户数量增长了六倍。

Image

减少幻觉

AI模型最令人头疼的问题之一是它们会编造信息——即幻觉。Hy3直面这一挑战。在腾讯AI助手元宝中,与预览版相比,模型的常识错误率降低了一半,幻觉减少了超过一半。这得益于更好的训练数据和微调过程中更严格的约束。

元宝现在使用Hy3驱动其智能体功能。你只需告诉它你需要什么——PPT、Word文档、Excel表格——它就能全程处理。而且完全免费。在内部测试中,Hy3在办公和日常生活场景中均优于其他几款顶级国产模型。

Image

不止于对话

Hy3不仅用于聊天。它还被应用于微信的AI虚拟人和客服中,意图识别准确率达到98.94%。即使用户表达不完整,模型也能理解其意图,而不会妄下结论。在微信读书中,标签标注准确率较预览版提升了14.1%,分类效率提高了8.4%。

对于游戏玩家,WeGame上《流放之路:降临》中的AI助手多轮推理成功率提升至92%,幻觉率从4.5%降至2.8%。这意味着更少的奇怪回答和更流畅的体验。

开放与可及

腾讯保持Hy3的开放性。它采用Apache 2.0许可证发布,开发者可免费用于商业项目。该模型已在腾讯云TokenHub上可用,并即将登陆OpenRouter、Hugging Face和ModelScope等海外平台。

从2026年初的基础设施改造,到4月的预览版,再到现在的正式发布,腾讯行动迅速。公司表示将继续推动AI能力的边界,专注于让这些强大模型在日常工作和生活中发挥作用。

关键要点

  • Hy3采用MoE架构:总参数量295B,激活参数量21B,上下文长度256K。
  • 超越更大模型:在许多任务上媲美或超越规模大2-5倍的模型。
  • 实际改进:WorkBuddy中任务成功率高达90%,幻觉减少一半。
  • 集成到腾讯产品:WorkBuddy、元宝、微信、游戏等。
  • 实惠定价:输入每百万token 1元,输出4元,缓存有折扣。
  • Apache 2.0开源:免费商用,多平台可用。