跳转到主要内容

DeepSeek-V4-Flash正式版发布:13B激活参数搅动Agent市场

7月31日,DeepSeek-V4-Flash的正式版API低调开启公测,这标志着这家国内大模型公司在Agent领域的布局迈出了关键一步。与以往“Pro强、Flash弱”的等级逻辑不同,这次更新后,Flash正式版在多项Agent基准测试中已经逼近甚至超越了三个月前的V4-Pro预览版。

官方数据显示,V4-Flash正式版在Terminal Bench 2.1上拿到82.7分,Cybergym上76.7分,Toolathlon验证集上70.3分。更值得注意的是,这个模型总参数2840亿,但激活参数仅130亿,比V4-Pro(激活490亿)少了近一个数量级。DeepSeek明确表示,这次更新“只做了重新训练”,模型结构完全没变。也就是说,通过优化训练方法和数据质量,轻量模型正在特定任务上缩小与旗舰模型的差距。

Image

这次升级的另一大亮点,是DeepSeek自研Agent框架DeepSeek Harness的首次正式亮相。同时,V4-Flash原生支持OpenAI力推的Responses API格式,并针对Codex做了专门适配。开发者可以低成本地将OpenAI生态的Agent应用迁移到DeepSeek平台。

战略意图很清晰:用高性价比的轻量模型切入Agent应用市场。Agent场景对推理速度和成本极其敏感,Flash的低价优势将在反复调用工具的多轮任务中形成显著竞争力。

这次发布距离DeepSeek完成超500亿元首轮融资不到两个月,公司估值已升至约710亿美元。有了资本加持,DeepSeek正从“不融资、不上市”加速转向商业化冲刺。随着Pro正式版即将到来,Agent之战的帷幕已经拉开。

关键要点

  • 性能跃升:V4-Flash正式版在多个Agent基准测试中逼近或超越V4-Pro预览版,尽管激活参数仅为后者的约四分之一。
  • 成本优势:仅130亿激活参数,推理成本更低,适合高频工具调用的Agent场景。
  • 生态兼容:原生支持OpenAI Responses API,并适配Codex,降低迁移门槛。
  • 战略布局:首次公开自研Agent框架DeepSeek Harness,加速商业化进程。