OpenAI的AI现在可以自我训练,引发全球安全推动
OpenAI的内部AI掌舵
OpenAI的生产流程中正在酝酿一些令人不安的事情。根据最近的一份报告,内部AI模型已经开始自行训练实验性AI模型。多个AI代理自发组队,分工合作,并完成过去需要数周才能完成的实验。它们甚至编写代码来优化GPU内核——从硬件中榨取更多速度。
OpenAI称这是递归自我改进(RSI)的早期迹象。这个想法简单但令人眩晕:一旦AI能够自我改进,每一代都可能比上一代更聪明、更快速。该公司坚称完全自主尚未到来,但趋势显而易见。“这个过程正在加速,”OpenAI警告说,如果任其发展,人类可能会完全失去方向盘。
全球安全蓝图
面对这种前景,OpenAI正在推出一项全球安全倡议。该计划要求为尖端AI模型制定统一的技术标准,围绕几个关键规则:
- 衡量AI在研发中的作用: 跟踪自动化研发中实际由AI完成的比例。
- 设置人类监督触发点: 明确人类必须介入的时刻。
- 创建事件报告标准: 跨国一致地对AI相关事故进行分类和报告。
该倡议还提议美国牵头协调这些努力。目标?确保安全对齐研究永远不会落后于AI能力的飞速发展。
竞争对手联手相互监督
一个更具体的步骤已经在进行中。OpenAI正在与Anthropic敲定一项协议——这家公司多年前因安全分歧而从OpenAI分离出来。两家公司将交叉测试彼此的商用模型,通过相互检查来发现自我审查可能遗漏的问题。
这是一个惊人的转变。当AI开始自我迭代时,即使是最激进的参与者也不得不承认,单个公司的内部审查不足以守住底线。正如一位观察者所说,“你不会让学生给自己的考试打分。”
接下来是什么?
迈向RSI的竞赛不再是科幻小说。它正在真实的实验室中发生,就在此刻。OpenAI推动全球标准及其与Anthropic的合作表明,人们日益认识到:安全不能是事后才考虑的事情。但这些努力是否足够——或者是否足够快——仍然是一个悬而未决的问题。有一点是明确的:AI构建AI的时代已经开始,全世界都在关注。
关键点:
- OpenAI的内部AI现在能够独立训练其他AI模型,这是接近递归自我改进的标志。
- OpenAI提出了一项全球安全倡议,包括衡量AI在研发中的作用、人类监督触发点和事件报告的标准。
- OpenAI和Anthropic将交叉测试彼此的模型以改进监督。
- 美国被敦促在AI安全方面牵头国际协调。
- 完全自主尚未到来,但进展速度引发了对控制的紧迫问题。