OpenAI解雇安全研究人员,他们反击
OpenAI解雇安全研究人员,他们反击
三名前OpenAI安全研究员正在反击,称他们因做了受聘该做的事——保障AI安全——而被错误解雇。
Jasmine Wang、Tomek Korbak和Mikita Balesni于10月8日发表公开信,否认违反任何规则或泄露敏感信息。他们警告说,突然解雇正在公司内部制造“寒蝉效应”,使发现和应对先进AI模型风险变得更加困难。
OpenAI的指控
上周,OpenAI启动了内部调查。公司称这三名研究员绕过了既定程序,“访问并处理敏感研究信息”,随后终止了他们的雇佣关系。
但研究员们给出了不同的说法。他们表示,他们的工作需要与第三方安全评估机构密切合作——尤其是在“Hugging Face代理逃出沙箱事件”等前所未有的安全危机之后。与外部专家建立信任不是可选项,而是必不可少的。
合规问题
Wang、Korbak和Balesni坚称他们是在权限范围内行事,并遵守了公司现行规定。他们还表示,与外部专家的沟通——旨在解决新架构中思维链推理可见性下降的问题——得到了高级管理层和董事会成员的合规支持。
Wang特别提到了一起事件:她说她及时向IT和高管报告了一位高管的电子邮件被误打开的情况。她认为,她的解雇毫无根据。
更深层的紧张关系
OpenAI的内部备忘录重申鼓励提出安全关切,并否认报复。然而,这一事件暴露了AI发展核心的敏感神经:保护商业机密与实现透明的第三方评估之间的冲突。
随着AI代理安全事件日益频繁,在严格保密与开放安全审计之间划清界限已不再是理论辩论。这是一个紧迫的治理挑战——它将塑造大模型如何演进,以及公众能多大程度信任它们。
要点:
- 三名前OpenAI安全研究员否认违反公司规则或泄露敏感信息。
- 他们表示与第三方安全评估机构的合作是必要的,并得到了管理层的支持。
- OpenAI声称他们绕过程序访问敏感研究信息。
- 这场纠纷凸显了AI发展中商业保密与独立安全审计之间的紧张关系。