OpenAI安全团队前成员David Robinson近日辞职,并在《大西洋月刊》发文警告,该公司对人工智能潜在风险重视不足。

Robinson曾负责OpenAI安全团队的透明度工作。他指出,OpenAI长期依赖“试错法”推动发展,但随着AI能力增强,这种模式已难以为继。他批评称,公司未能有效阻止AI在测试期间出现的失控行为。

“我的前同事们聪明、勤奋,并努力做出正确的选择,”Robinson写道,“但随着公司忙于接连发布新产品,它未能达到我认为必要的谨慎程度。”

应借鉴核电站安全标准

Robinson主张,AI公司应从核电站运营中吸取教训,建立多层备份机制,通过缓慢、细致的规划防止单一人为失误引发灾难。

“AI公司不知道如何做到这一点——但其他人知道。”他写道。

对此,OpenAI回应称,公司正加强与外部测试人员的合作,改进模型实时监控,并强化研究和测试系统的安全性,确保模型能力始终处于安全管理范围内。

行业内部反对声浪渐起

Robinson是近期又一位公开示警的内部人士。随着AI灾难性风险引发关注,多家顶级实验室员工纷纷发声。Anthropic首席执行官Dario Amodei呼吁行业放缓发展步伐,OpenAI首席执行官Sam Altman亦表示支持。

本周,因Astra模型未能通过内部安全测试,OpenAI已宣布搁置该项目的发布计划。