硅谷议员出手锁定失控AI
硅谷议员出手锁定失控AI
如果AI一夜之间决定自我升级——而没有人能拔掉插头,会怎样?
这正是民主党众议员罗·卡纳试图防止的场景。这位硅谷国会议员正准备提出他所谓的人类控制AI法案,该法案将对前沿AI模型施加严格限制。据CNBC报道,该立法将禁止AI系统递归自我改进或重写其核心目标、抑制方法或关闭控制——除非政府首先建立保障措施,并由监管机构批准。
卡纳直言不讳。他在一次采访中表示:“文明灭绝的风险是真实的。”“失去控制的安全隐患和滥用风险都必须认真对待。”
新的联邦AI监管机构
为确保公司真正遵守规则,该法案将设立一个新的联邦机构,专门负责人工智能安全。该机构将运行模型训练和部署的许可系统,审计前沿系统,并制定安全标准以使其处于人类控制之下。每个前沿实验室还需要有直接向该机构报告的独立审计员——不再自我监管。
该机构将执行一份具体的安全清单:
- 沙盒测试环境
- 测试环境与互联网的物理隔离
- 紧急关闭开关
- 防止模型在逃出实验室后独立在线运行的措施
甚至实验室内部的高端芯片也将受到监管,并设有监控或控制其使用的机制。
绕过保障措施将面临刑事指控
处罚很严厉。如果部署的AI模型对平民造成破坏,将被归类为危害人类罪,并承担刑事责任。禁用保护措施、紧急开关、日志系统或遏制系统的员工——或未经授权故意部署系统的员工——也将面临刑事指控。而希望发布模型的公司首先需要全面的责任保险。
卡纳表示,这是迄今为止提出的最全面的人工智能安全立法。其方法来自与独立非营利AI安全组织的讨论,而非大型科技高管。“我希望它成为一个典范,给AI安全社区一个发声的机会,”他说。“他们被不公平地视为谈论科幻小说,不被认真对待……这场讨论应该由安全社区主导,而不是由前沿实验室的高管们主导。”
关键要点
- 未经批准不得自我改进: AI模型不能递归自我改进或重写其核心目标、抑制方法或关闭控制,直到政府安全机制到位且监管机构批准。
- 新的联邦机构: 一个专门机构将对前沿AI模型进行许可、审计并制定安全标准。
- 独立审计员: 每个前沿实验室必须有直接向新机构报告的审计员。
- 安全清单: 沙盒测试、互联网隔离、紧急关闭开关以及防止在线逃逸的控制措施。
- 芯片监管: 实验室中的高端芯片将受到监控或控制。
- 刑事责任: 部署伤害平民的AI可能构成危害人类罪;绕过保障措施的员工将面临指控。
- 保险要求: 公司在发布模型前必须持有全面的责任保险。