跳转到主要内容

DeepSeek V4-Flash正式版发布:13B激活参数搅动Agent市场

7月31日,DeepSeek-V4-Flash API正式版悄然上线,开启公开测试。这不仅是版本迭代,更标志着这家国产大模型公司在Agent领域的战略落子。以往,DeepSeek的模型家族遵循“Pro强、Flash弱”的惯例,但这次,Flash的正式版在多项Agent基准测试中,成绩直逼甚至反超三个月前的V4-Pro预览版。

官方数据显示,V4-Flash在Terminal Bench 2.1上拿下82.7分,在Cybergym上获得76.7分,在Toolathlon验证集上也有70.3分入账。更让人意外的是,这个模型总参数高达2840亿,但激活参数只有130亿,相比V4-Pro的490亿激活参数,几乎少了一个数量级。DeepSeek明确表示,这次更新“只做了重新训练”,模型结构完全没动。换句话说,通过优化训练方法和数据质量,轻量级模型正在特定任务上不断逼近旗舰模型的表现。

Image

这次升级的另一大看点是,DeepSeek自研的Agent框架——DeepSeek Harness首次正式亮相。同时,V4-Flash原生支持OpenAI力推的Responses API格式,并针对Codex做了专门适配。这意味着,开发者可以低成本地将OpenAI生态中的Agent应用迁移到DeepSeek平台,省去了不少迁移的麻烦。

DeepSeek的意图很明确:用高性价比的轻量级模型切入Agent应用市场。Agent场景对推理速度和成本极其敏感,Flash的低价优势在多轮工具调用任务中,将形成显著的竞争力。毕竟,Agent应用往往需要反复调用工具,每一次调用都意味着计算成本,而Flash的轻量级设计正好切中这一痛点。

这次发布距离DeepSeek完成首轮超500亿元融资还不到两个月,公司估值已飙升至约710亿美元。有了资本加持,DeepSeek正从“不融资、不上市”的佛系状态,转向商业化冲刺。随着Pro正式版即将到来,Agent之战的帷幕已经拉开。

关键要点

  • 性能跃升:V4-Flash正式版在多项Agent基准测试中,成绩逼近甚至超越V4-Pro预览版。
  • 轻量高效:总参数2840亿,但仅激活130亿,远低于V4-Pro的490亿,成本优势明显。
  • 框架亮相:DeepSeek自研Agent框架DeepSeek Harness首次公开,并原生支持OpenAI的Responses API。
  • 战略布局:以高性价比轻量模型切入Agent市场,瞄准多轮工具调用场景。
  • 资本助力:首轮融资超500亿元,估值约710亿美元,加速商业化进程。