跳转到主要内容

字节跳动豪赌5万亿参数大模型,内部明令禁止蒸馏

字节跳动正在酝酿一个大胆的计划:训练一个参数规模超过5万亿的大模型。如果成真,这将是国内已知参数最大的模型,远超阿里Qwen 3.8-Max的2.4万亿和月之暗面K3的2.8万亿。不过,消息人士透露,该计划尚处早期,最终能否落地还是未知数。

这个项目由Seed基础模型团队负责人向梁主导,沈科联合负责,后者主管大语言模型的预训练数据。Seed团队正在为此重新调整组织架构,明确分工,调配资源。一位接近Seed的人士直言,与其在现有规模上追赶同行,不如把参数规模做到对手的好几倍,直接抢占领先位置。

这背后,是字节跳动高层一系列清晰的表态。创始人张一鸣在最近一次内部会议上罕见发声:“做模型要坚持长期主义,要有延迟满足感,而不是用别人的输出来追逐短期排名。”他明确表示,字节愿意牺牲一些短期利益,换取长远目标。更严厉的是,字节内部目前严令禁止蒸馏开源模型,甚至用API检测等手段加强限制——张一鸣认为,蒸馏会干扰真正的技术突破。

在2026年8月6日的全员会上,CEO梁汝波再次强调了这一逻辑。他说,字节会继续聚焦大模型的自研和基本功,接受短期挫折,坚持长期优化。所谓长期优化,就是聚焦用户价值和增量社会价值,不被短期波动左右;在AI业务上,就是相信AGI,坚持自研。他还特别澄清:“昨天有外部报道说,我们坚持自研是因为外部压力,这纯属猜测。真正的原因是希望团队有延迟满足感,打好技术基础,这对长期实现AGI至关重要。”

从张一鸣到梁汝波,这一系列高层表态,不只是一份技术方案,更是一份完整的战略宣言:对内统一研发思想,对外释放信号——字节跳动无意陷入追随他人的恶性循环,而是要走出自己的增长曲线。

关键要点

  • 参数规模:字节计划训练超5万亿参数模型,国内最大,远超同行。
  • 团队领导:由Seed团队向梁主导,沈科联合负责。
  • 战略定调:张一鸣强调长期主义,禁止蒸馏开源模型。
  • CEO表态:梁汝波重申自研决心,否认外部压力说。
  • 未来展望:计划尚处早期,最终能否发布待观察。