国会出手给AI套上缰绳
国会出手给AI套上缰绳
如果AI能在无人监视的情况下重写自己的代码会怎样?这正是硅谷国会议员罗·卡纳提出的一项新法案旨在防止的情景。据CNBC报道,这位民主党代表正准备提出人类控制AI法案,这是一项全面的提案,将对前沿AI模型施加严格的护栏。
该法案的核心很简单:在政府建立安全机制并获得监管机构批准之前,任何AI模型都不得进行递归自我改进,或自主重写其核心目标、抑制方法或关闭控制。换句话说,公司不得允许其最强大的模型自行迭代——未经联邦批准不行。
一个有权力的新机构
为了执行这些规则,该法案将创建一个专门负责AI安全的新联邦机构。该机构将运行模型训练和部署的许可系统,对前沿系统进行审计,并制定安全标准以使其处于人类控制之下。每个前沿实验室还需要有直接向该机构报告的独立审计员。
该机构将维护一份具体的安全清单:沙盒测试环境、与互联网的物理隔离、紧急关闭开关,以及防止模型逃离实验室并在网上失控运行的措施。甚至实验室中的高端芯片也将受到监管,并设有监控或控制其使用的机制。
绕过保障措施的刑事责任
该法案在惩罚方面毫不手软。如果部署的AI对平民造成破坏,将被归类为危害人类罪,并附带刑事责任。私自禁用保护措施、紧急开关、日志系统或遏制系统的员工——或明知未经授权仍部署系统的员工——也将面临刑事指控。想要发布模型的公司首先需要全面的责任保险。
卡纳称这是迄今为止提出的最全面的AI安全立法。他说,其方法来自与独立非营利AI安全组织的讨论,而非大型科技高管。他说:“我希望它成为一个典范,让AI安全社区有发言权。”“他们一直被不公平地视为在谈论科幻小说,不被认真对待。这场讨论应该由安全社区主导,而不是由前沿实验室的高管主导。”
要点
- 未经批准不得自我改进: 在政府安全机制和监管机构批准之前,AI模型不能递归改进或重写核心控制。
- 新的联邦机构: 将许可模型训练和部署,审计前沿模型,并制定安全标准。
- 独立审计员: 每个前沿实验室必须有向该机构报告的审计员。
- 安全清单: 沙盒测试、物理隔离、紧急关闭和芯片控制。
- 刑事处罚: 部署具有破坏性的AI可能构成危害人类罪;绕过保障措施的员工将面临指控。
- 责任保险: 公司在发布模型前必须持有全面的保险。