Kimi K3.1 泄露:拥有百万级 Token 记忆的三速大脑
Kimi K3.1:可能自带团队的模型
Moonshot AI 的下一代旗舰模型不会保密太久。如果泄露的代码有任何迹象,Kimi K3.1 可能最早于 2026 年 10 月到来,它正逐渐演变成一个更像小型工作团队而非单一聊天机器人的存在。
三个思考层级
首先,该模型似乎提供了三种可调节的推理强度——低、高和最高。想省点钱?选低。需要模型深入思考一个难题?调到最高。这个想法很简单,但它把控制权交给了用户。
百万级 Token 与智能体集群
线索来自内部的 JSON 和 API 片段,最初由爆料者 @MaxForAI 在 X 上发现。这些标识符——如 "k3d1-agent"——指向一个100 万 Token 的上下文窗口(被称为 "Extra Long")、原生 Agent 模式,以及一个名为 Swarm 的功能,允许多个智能体协作完成任务。搜索和批处理模式也在其中。简单来说:该模型正在学习将自己拆分成一个团队,分工协作、自我对话,并接入外部工具。
从孤狼到群首
作为背景,2026 年 7 月发布的 Kimi K3 已经拥有 2.8 万亿参数、原生视觉和百万级 Token 上下文。其架构采用了 Kimi Delta Attention 和稀疏 MoE 等技巧。如果 K3.1 兑现这些泄露信息,将标志着从“单一模型独立工作”向“一个模型领导一组模型”的转变。你可以选择低级别快速起草,用最高级别进行批判性分析,或者将一个混乱的项目交给一群智能体并行处理。
竞赛正在改变
目前这些都尚未官方公布。Moonshot AI 没有宣布任何消息,10 月的日期仍是猜测。但代码不会意外包含 "k3d1-agent" 和 Swarm 开关。当一家公司如此密集地将 Agent、超长上下文和多智能体协作写入其配置文件时,信息很明确:下一场大战不是关于谁聊得更好,而是关于谁能独立工作。
关键要点:
- Kimi K3.1 可能于 2026 年 10 月发布,具有三种推理级别(低、高、最高)。
- 泄露的代码揭示了 100 万 Token 上下文、原生 Agent 模式和 Swarm 多智能体协作。
- 基于 K3 的 2.8 万亿参数和百万级 Token 窗口构建。
- 标志着从单模型聊天向自主、团队式 AI 工作的转变。