Skip to main content

Kimi K3.1泄露:百万上下文+三档推理,AI要自己干活了

Kimi K3.1意外现身:开发者先于官方挖出猛料

9月28日,几位眼尖的开发者发现,月之暗面API后台的模型列表里悄悄多了一个标识——kimi-k3-1。这可不是空壳,接口探测跑通了,调用也完全正常。当天晚上,Kimi开放平台干脆顺水推舟,放出了K3.1的预览,代号“K311111”,并明确支持百万token上下文窗口。

百万上下文和三档推理,到底意味着什么?

从泄露的配置看,K3.1的最大上下文窗口达到100万token。什么概念?相当于一口气吞下整本《三体》三部曲还有富余。更关键的是,它把推理强度分成了三档:Low、High、Max。

开发者们琢磨,这大概率对应不同的算力分配和计费方式——想省钱选Low,要质量拉满选Max。这种设计让模型从“单打独斗”升级成了“带队作战”。

Agent模式与Swarm协作:AI开始自己组队了

配置里还藏着更让人兴奋的东西:原生Agent智能体模式和Swarm多智能体协作,外加搜索、批处理等任务模式。简单说,K3.1不再只是回答问题,它可能自己拆解任务、调用工具、甚至指挥一群小模型分头干活。

这就像从“一个全能员工”变成了“一个项目经理”——你给目标,它来调度。

价格成谜,但竞赛方向已经变了

目前K3.1的API定价显示与K3相同,不过模型还没正式发布,这多半只是占位符。价格悬念留到最后,但趋势已经藏不住了。

从后台标识被挖出,到官方主动预告,K3.1的出场方式本身就说明问题。当月之暗面把百万上下文、三档推理和多智能体协作塞进同一套配置,下一轮大模型竞赛的焦点,正从“谁更会聊天”转向“谁能自己把活干完”。

关键点

  • 百万token上下文:K3.1支持高达100万token的上下文窗口,处理长文档能力大幅提升。
  • 三档推理强度:Low、High、Max三档可调,兼顾成本与质量。
  • Agent与Swarm协作:可能引入原生Agent模式和Swarm多智能体协作,支持搜索、批处理等任务。
  • 价格待定:API定价暂与K3相同,但可能只是占位,正式发布后或有调整。
  • 竞赛转向:大模型竞争从对话能力转向自主任务处理能力。