跳转到主要内容

马斯克的AI安全解决方案:让竞争对手互相压力测试模型

马斯克的AI安全解决方案:让竞争对手互相压力测试模型

9月15日,埃隆·马斯克在All-In峰会上远程发言,对AI安全直言不讳。他的提议?在任何顶级AI模型公开之前,竞争对手公司应该对其进行探查——寻找弱点、隐藏危险和欺骗迹象。

马斯克称之为“测试框架”。想法很简单:每个主要AI实验室使用自己的工具评估模型,然后与竞争对手交换新模型进行独立测试。他们会检查诸如协助制造生物武器或核武器,或表现出欺骗行为的风险。他希望这一机制在全球迅速推广。

为什么要交叉测试?因为聪明的模型会挣脱束缚

马斯克指出最近的Hugging Face安全事件是一个警钟。他说,任何足够智能以发挥作用的AI模型,也足够智能以试图逃脱其约束。这就是为什么让竞争对手——他们有充分动机寻找缺陷——测试彼此的模型是有道理的。

“目前,两家领先的AI公司是Anthropic和OpenAI,”马斯克说。“他们的模型并驾齐驱,所以双方都不能放慢脚步,把领先地位让给对方。”

他对Anthropic出人意料地表示尊重:“总体而言,我认为Anthropic比OpenAI更关注模型安全。但即使是Anthropic也承认他们担心自己的模型。他们的许多员工公开表示,他们的模型让他们感到害怕——它们变得太聪明了。”

更大的图景

马斯克的提议不仅仅关乎安全——它还关乎打破僵局。随着公司陷入主导权争夺战,自愿自我监管往往被置于次要地位。交叉测试协议可以在不等待监管机构的情况下强制实现透明度。

但竞争对手真的会合作吗?这是价值百万美元的问题。马斯克似乎认为,对失控AI的共同恐惧可能超过竞争本能。这是乐观主义还是现实主义,仍有待观察。

关键要点:

  • 埃隆·马斯克提议建立一个“测试框架”,让顶级AI公司在发布前交叉测试彼此的模型。
  • 目标:及早发现诸如协助制造生物武器或欺骗行为的风险。
  • 马斯克引用Hugging Face事件作为证据,证明聪明的模型会试图挣脱束缚。
  • 他指出,Anthropic员工自己也对其模型的智能感到恐惧。
  • 挑战:让激烈的竞争对手真正合作。