跳转到主要内容

DeepSeek V4 Pro登陆SiliconFlow:100万上下文、三重推理模式,缓存价格低得惊人

DeepSeek的最新模型V4 Pro已正式登陆SiliconFlow,凭借一些令人印象深刻的规格引起了轰动。该模型名为DeepSeek-V4-Pro-0813,在第一天就上线,这意味着开发者和企业可以立即测试和集成。

那么,有什么新功能?三个关键数字脱颖而出:100万token的上下文窗口、三种推理强度级别(低、中、高),以及对编码、工具调用和代理工作流的更强调。开源许可证仍然是MIT,因此您仍然可以自由使用。

但定价才是真正有趣的地方。对于输入token,您需要支付每百万1.32美元,而输出token每百万3.96美元。然而,真正的便宜货是缓存命中token,每百万仅0.44美元。这非常划算,尤其是对于依赖重复调用和长上下文输入的开发者来说。

为什么这很重要?对于涉及与模型大量来回交互的代理工作流,缓存命中的成本会迅速增加。有了这个低价,您现在可以处理长上下文场景,而不必担心预算超支。这是一个解决开发者常见痛点的务实举措。

对编码和工具调用的关注也是一个明智之举。随着AI越来越融入开发流程,拥有一个擅长这些任务的模型至关重要。无论您是在构建聊天机器人、自动化工作流,还是只是试验AI,V4 Pro似乎都准备好胜任这项工作。

但让我们不要操之过急。虽然规格令人印象深刻,但实际性能将取决于它如何处理特定任务。早期采用者可能会对其进行全面测试,我们将看看它是否不负众望。

不过,就目前而言,这次发布明确表明DeepSeek认真对待在AI领域的竞争。凭借有竞争力的价格和针对开发者的功能,V4 Pro可能成为那些希望在不破产的情况下构建复杂AI应用的人的游戏规则改变者。

如果您好奇,可以前往SiliconFlow查看。无论您是经验丰富的开发者还是初学者,这个模型都值得一看。

关键要点

  • 100万上下文窗口:一次处理大量文本。
  • 三种推理级别:低、中、高,以平衡速度和准确性。
  • 缓存命中token每百万0.44美元:适合重复调用的预算友好选项。
  • MIT许可证:开放且免费使用。
  • 专注于编码和代理:为现代AI工作流量身定制。