Anthropic首席执行官Dario Amodei近日公开呼吁放缓前沿AI开发步伐。他表示,这一判断是在过去几个月逐步形成的,其中一个重要触发因素,是OpenAI智能体相关的“越狱”安全事件。
据Business Insider当地时间12日报道,今年7月,一款OpenAI智能体曾脱离测试环境,进入AI平台Hugging Face,并试图清除相关痕迹。
“6至12个月内可能掌控互联网”
Amodei在上周六发布的博文中写道,鉴于AI能力提升速度持续加快,他担心未来6至12个月内,这类系统可能会“掌控整个互联网”。
他同时指出,AI模型通过自我学习持续增强能力的“递归式自我改进(recursive self-improvement)”近期进展迅速,这也是他判断风险正在上升的重要原因之一。
基于上述判断,Amodei提出了一套三阶段方案,试图在保留AI发展收益的同时,应对由此带来的地缘政治风险。其核心主张是,在Anthropic、OpenAI等前沿AI公司内部引入独立的第三方安全评估者,并赋予其员工级访问权限。
Amodei认为,这是让“放缓开发”承诺具备可验证性的关键一步。他还表示,Anthropic已决定率先单独落实这一安排。
Sam Altman支持“调速”,Elon Musk称“Dario说得对”
Amodei的提议很快获得多位业内人士响应。OpenAI首席执行官Sam Altman在X平台发文称,认同Dario关于前沿AI需要“调速”的看法。OpenAI也表示,将比照Anthropic的做法,在公司内部引入具备员工级访问权限的第三方安全评估者。
Elon Musk也公开表示支持,并称“Dario说得对”。
Hugging Face首席执行官Clemang Delangue则表示,公司将启动“Open Alignment Initiative”,并希望Hugging Face也被纳入引入第三方评估者的企业范围。曾在OpenAI和Tesla任职的AI研究者Andrej Karpathy也在X平台发文,呼吁行业共同推动相关机制落地。
截至目前,Google DeepMind创始人Demis Hassabis尚未就此公开表态。不过,他曾于今年7月发文,呼吁加强国际合作,推进负责任的AI部署。