Skip to main content

DeepSeek V4 Flash正式版发布,轻量模型逼近旗舰性能

7月31日,DeepSeek的V4-Flash API正式版悄然开启公测,这标志着这家国内大模型公司在Agent领域的布局迈出了关键一步。与以往“Pro强、Flash弱”的层级逻辑不同,这次更新后,Flash正式版在多项Agent基准测试中已经逼近甚至超越了三个月前的V4-Pro预览版。

官方数据显示,V4-Flash正式版在Terminal Bench 2.1上得分82.7,在Cybergym上得分76.7,在Toolathlon验证集上得分70.3。值得注意的是,这款模型总参数达2840亿,但激活参数仅130亿,比V4-Pro(激活490亿)少了近一个数量级。DeepSeek明确表示,这次更新“仅重新训练”,模型结构完全未变。这意味着,通过优化训练方法和数据质量,轻量模型正在特定任务上缩小与旗舰模型的差距。

Image

这次升级的另一大亮点,是DeepSeek自研Agent框架DeepSeek Harness的首次正式亮相。同时,V4-Flash原生支持OpenAI力推的Responses API格式,并针对Codex进行了专门适配。开发者可以低成本地将OpenAI生态下的Agent应用迁移到DeepSeek平台。

战略意图十分清晰:以高性价比的轻量模型切入Agent应用市场。Agent场景对推理速度和成本极为敏感,Flash的低价优势将在反复调用工具的多轮任务中形成显著的竞争力。

这次发布距离DeepSeek完成超500亿元首轮融资不到两个月,公司估值已升至约710亿美元。有了资本加持,DeepSeek正从“不融资、不上市”转向商业化冲刺。随着Pro正式版即将到来,Agent之战的帷幕已经拉开。

关键要点

  • 性能跃升:V4-Flash正式版在Agent基准测试中逼近V4-Pro预览版,激活参数仅为其四分之一。
  • 训练优化:仅通过重新训练实现性能提升,模型结构未变。
  • 生态兼容:原生支持OpenAI Responses API,并适配Codex,降低迁移成本。
  • 战略布局:以轻量模型的高性价比切入Agent市场,加速商业化进程。