日本AI初创公司Sakana发布Fugu Cyber,在安全测试中超越GPT和Claude
网络安全领域迎来了一位新竞争者。7月21日,日本AI初创公司Sakana AI发布了Fugu Cyber,这是一个专为现代网络防御设计的多智能体系统。它已经引起了轰动:在行业最严格的安全基准测试中,Fugu Cyber的表现超越了OpenAI和Anthropic的领先闭源模型。

Fugu Cyber有何特别之处?
Fugu Cyber不仅仅是另一个大型语言模型。它是一个多智能体系统,意味着它协调多个AI智能体来处理复杂任务。这种方法使其能够处理网络安全专业人员日常面临的混乱、真实世界的场景。Fugu Cyber不依赖单一的庞大模型,而是使用专门的智能体,这些智能体可以规划、执行和适应——就像人类团队一样。
令人瞩目的基准测试结果
在模拟真实网络攻击和防御场景的CyberGym测试中,Fugu Cyber实现了86.9%的成功率。这比OpenAI的GPT-5.5-Cyber和Anthropic的Claude Mythos-Preview有了显著提升。在评估网络威胁情报能力的CTI-REALM测试中,它得分72.1%,再次超越竞争对手。
这些数字不仅仅是学术性的。它们表明,专门的、多智能体的方法可以在特定领域超越通用模型。对于精确性和适应性至关重要的网络安全来说,这可能是一个游戏规则的改变者。
对行业的影响
Sakana AI在Fugu Cyber上的成功凸显了一个日益增长的趋势:从单一的AI模型转向更模块化、更专业化的系统。公司不再试图构建一个能做所有事情的模型,而是越来越多地创建协同工作的模型生态系统。这种方法可以更高效、更适应,并且可能更安全。
对于网络安全团队来说,Fugu Cyber提供了一个未来的愿景,其中AI不仅协助,而且积极主导威胁检测和响应。该模型超越闭源巨头的能力表明,开源或初创公司驱动的创新仍然可以在高风险领域竞争并获胜。
关键点
- Fugu Cyber 是一个用于网络安全的的多智能体系统,而不是单一模型。
- 它在 CyberGym 上得分 86.9%,在 CTI-REALM 上得分 72.1%,击败了GPT-5.5-Cyber和Claude。
- 该系统使用 多个专门的智能体 来处理复杂任务。
- 这标志着向 模块化、专业化AI 的转变,而不是单一模型。
- 日本初创公司Sakana AI表明,较小的参与者可以在细分领域超越科技巨头。