DeepSeek的3万亿参数Code 2.0:下一个GPT-6挑战者?
DeepSeek的下一个大赌注:Code 2.0
就在你认为DeepSeek通过悄然发布V4.1 Flash而表现得很酷时,谣言工厂正在酝酿一些更为雄心勃勃的事情。有消息称,DeepSeek正在准备Code 2.0,这是一个拥有惊人的3万亿参数的大型模型——并且它正瞄准GPT-6 Astra和Mythos 5.1这样的对手。
有什么热点?
根据泄露的消息,Code 2.0计划于9月发布,并有望超越当前顶尖模型。这是一个艰巨的任务,但DeepSeek在突破界限方面并不陌生。据说该模型将加倍投入计算机使用——本质上是让AI掌舵并代表你处理复杂任务。如果Astra的炫目功能有任何指示意义,这可能是一个改变游戏规则的产品。
参数竞赛
让我们把3万亿这个数字放在背景下看。目前,中国最强的模型是拥有2.8万亿参数的K3、2.4万亿参数的Qwen 3.8 Max,以及DeepSeek自家的1.6万亿参数的V4 Pro。跃升至3万亿不仅仅是一种炫耀——更是一种声明。要想与Mythos 5.1和Astra抗衡,你需要这样的肌肉。而且鉴于V4.1 Flash已经通过新架构将其参数数量翻倍,跃升至3万亿似乎是合理的。
回忆之旅
DeepSeek以前曾涉足过以代码为重点的模型。早在2023年和2024年,他们发布了三款以“Code”为名的模型,但并未真正引起轰动。快进到现在,将Code系列作为旗舰产品复活是合理的。这将释放V4.1 Pro和Flash来处理一般的代理任务,而Code 2.0则应对重型的逻辑和编码挑战。
你应该屏息以待吗?
与任何泄露一样,请持保留态度。DeepSeek尚未确认任何事情,而且之前的V4 Pro-0813最终版本未能达到预期。因此,尽管3万亿参数巨无霸的想法令人兴奋,但在官方消息发布之前,明智的做法是保持冷静。
关键点
- DeepSeek Code 2.0据传将于9月推出,拥有3万亿参数。
- 它旨在超越GPT-6 Astra和Mythos 5.1,专注于计算机使用。
- 如果属实,它将成为中国最大的模型,使K3、Qwen 3.8 Max和V4 Pro相形见绌。
- DeepSeek过去的Code模型表现平平,但这可能是一次战略性的复兴。
- 谨慎对待传闻——官方确认仍待公布。