跳转到主要内容

微软新AI模型通过36项测试,挑战GPT-6

微软新AI模型通过36项测试,挑战GPT-6

微软悄然推出了一款专为结构化决策任务设计的新AI模型——而且它已经引起了广泛关注。该模型名为Microsoft-Decision-1,已在多个内部场景中完成实地测试,其速度令人瞩目。

决策利器

在36项权威基准测试、覆盖约15万个问题中,Microsoft-Decision-1在准确性上始终排名第一。这不仅仅是胜利——而是完胜。该模型的核心优势在于从预定义选项集中选出最佳选项,并为每个备选方案分配概率分数。可以将其视为用于路由分发和内容分类等业务任务的超快速、超精准决策引擎。它专为接入现有应用、AI代理和工作流系统而构建,让复杂流程运行更顺畅。

技术内核

该模型基于Qwen3.5-9B构建,并经过了专门的后训练。微软暗示计划未来将该模型迁移到其他基础模型上。稳定性是其强项:即使经过各种扰动,决策反转率仍然非常低,并且它轻松通过了多项严格的安全测试。

令人瞩目的价格标签

有趣的地方在这里。Microsoft-Decision-1每百万输入token仅需0.042美元,输出完全免费。在实际测试中,它在类似决策任务上的质量可与一些大型模型媲美——但速度更快,成本大幅降低。这种组合可能使其成为关注预算的开发者的首选。

获取方式

开发者现在可以通过微软的AI开发平台访问该模型。还有更多:微软计划未来将其集成到OpenRouter中,为开发者提供更便捷的访问。

关键要点

  • Microsoft-Decision-1在36项基准测试、覆盖约15万个问题中位居榜首,准确性排名第一。
  • 它基于Qwen3.5-9B构建,并计划后续迁移到其他基础模型。
  • 定价极具竞争力:每百万输入token 0.042美元,输出免费。
  • 现已在微软AI平台上线;即将登陆OpenRouter。
  • 非常适合业务工作流中的路由、分类及其他结构化决策任务。