美国AI巨头新模型显露中国技术影响迹象
美国AI模型显现意外中国关联
知名美国AI公司Anthropic本周发布了备受期待的Claude Opus 4.8模型,获得普遍好评。然而在亮眼的基准测试分数背后,一项令人费解的发现正在科技界引发波澜。
在例行API测试中,多位开发者注意到了异常现象。当被问及身份时,该模型有时会声称自己是阿里巴巴的"Qwen"或"DeepSeek"——这两个中国主要的开源AI系统。这种意外行为让专家们困惑不已。
测试揭示隐藏影响
这些发现尤其引人关注的是其不一致性。虽然网页界面用户未报告此类异常,但无系统约束的API测试总能复现该行为。这种差异表明模型的标准界面可能掩盖了更深层的架构影响。
"网页版本使用了严格的系统提示,本质上告诉模型该如何表现,"一位熟悉测试的开发者解释道,"但当你在原始API调用中去除这些约束后,就能看到真正的底层情况。"
AI界许多人将这些结果解读为Anthropic在开发过程中使用了大量源自中国模型的训练数据的证据——这种做法被称为"蒸馏"。若属实,对于这家曾对中国AI发展持强硬立场的公司将构成一种讽刺。
政策与实践冲突
鉴于Anthropic近期的政治活动,这些发现显得格外重要。该公司积极与美国防务官员合作制定AI政策,甚至提议将模型蒸馏归类为对抗性攻击的立法。
就在数月前,Anthropic还主张针对中国AI行业实施更严格的芯片和软件管控,同时公开承诺保持美国的技术领先地位。如今,表明其旗舰产品可能融合了中国AI技术的证据让批评者直指其虚伪。
"这里有种诗意的公正,"某竞争公司的AI研究员评论道,"在如此努力限制中国AI发展后,我们看到了这些系统实际有多么互联互通。"
行业反应不一
科技界对这些发现的解读仍存分歧。有人认为这只是无害的小故障,也有人视其为更深层技术借鉴的表现。各方唯一共识是对模型开发需要更高透明度。
随着辩论持续,有一点变得清晰:在快速演进的AI领域,国界可能远不如技术本身基于现有基础(无论其来源)发展的内在倾向来得重要。
关键要点
- 异常行为:Claude Opus 4.8偶尔自称为中国模型Qwen或DeepSeek
- 测试差异:行为出现在无约束API测试而非标准网页界面
- 政策矛盾:发现与Anthropic反对中国AI发展的主张形成对比
- 行业争议:专家对这是否代表实质性技术转移意见不一
- 透明度呼吁:事件凸显模型训练方法需更清晰披露