跳转到主要内容

DeepSeek V4 Pro登陆SiliconFlow:1M上下文、三种推理模式与超值缓存价格

DeepSeek的最新模型V4 Pro(正式名称为DeepSeek-V4-Pro-0813)已在SiliconFlow上首次亮相,这不仅仅是又一次增量更新。此次发布带来了三大亮点:巨大的1M上下文窗口、三种可调的推理强度级别(低、中、高),以及对编码、工具调用和代理工作流的更深入关注。开源许可证一如既往地宽松——仍然是MIT。

让我们谈谈数字,因为这才是真正有趣的地方。定价结构简单明了:每百万输入令牌1.32美元,每百万输出令牌3.96美元,而缓存命中令牌每百万仅需0.44美元,低得惊人。最后这个数字才是真正让人眼前一亮的。对于构建基于代理的系统、不断用相似提示或长上下文历史来请求模型的开发者来说,成本节省可能是巨大的。想象一下运行一个涉及数百次调用的复杂工作流——每次调用都命中缓存而不是从头开始。按每百万令牌0.44美元计算,这笔账看起来非常划算。

但为什么这不仅仅关乎标价?想想典型的代理场景:模型需要处理一份冗长的文档,然后回答后续问题,再根据用户反馈完善其响应。如果没有缓存,每次交互都需要重新处理整个上下文,导致成本和延迟上升。由于缓存命中率如此之低,开发者可以设计更多迭代、上下文密集的工作流,而不必担心预算超支。对于任何在这些模型之上构建的人来说,这是一个实际的好处。

1M上下文窗口是另一个重大升级。这大致足以在一次处理中处理整个代码库、冗长的报告甚至整本书。对于编码任务,这意味着模型可以跟踪多个文件及其相互依赖关系,从而在调试或重构时更加有效。三种推理强度级别增加了另一层灵活性——您可以降低思考强度以获得快速、成本效益高的响应,或者提高强度以进行需要更深入分析的复杂问题解决。

SiliconFlow决定在第一天就托管这个模型,这充分说明了他们对其能力的信心。这一举措将他们定位为开发者的首选平台,这些开发者希望早期访问尖端模型,而无需管理自己的基础设施。

那么,要点是什么?DeepSeek V4 Pro不仅仅关乎原始规格——它关乎让先进AI对现实世界应用更加可及和实惠。无论您是独自开发副项目的开发者,还是正在构建下一个大事件的初创公司,巨大的上下文窗口、灵活的推理和实惠的缓存定价相结合,都难以忽视。

如果您好奇它的表现,请前往SiliconFlow试用一下。该模型现已上线,而且以这样的缓存价格,实验不会让您破产。

关键要点

  • 模型:DeepSeek-V4-Pro-0813,现已在SiliconFlow上提供。
  • 上下文窗口:100万令牌,非常适合长文档和代码。
  • 推理级别:低、中、高——选择您想要的速度与深度平衡。
  • 定价:输入每百万1.32美元,输出每百万3.96美元,缓存命中仅需每百万0.44美元。
  • 重点:增强的编码、工具调用和代理工作流。
  • 许可证:仍然是MIT,因此您可以自由构建。