David Robinson离职后公开批评OpenAI的安全文化与发布机制。图片来源:OpenAI

长期负责OpenAI核心产品安全报告的David Robinson在离职后,公开对AI行业的安全文化提出质疑。

据TechCrunch等媒体当地时间4日 报道,Robinson已于近日从OpenAI离职,结束其3年半任期。任职期间,他主导了12次前沿模型发布相关安全报告,并参与起草现行“Preparedness Framework(准备度框架)”草案。Robinson认为,AI安全问题不能单靠规则或法律解决,企业文化本身也必须改变。

Robinson批评的核心,指向OpenAI所采用的“迭代式发布”模式,即产品先发布,再根据后续暴露出的问题补强安全防护。他指出,随着系统能力持续提升,单次失误可能带来的后果也在同步放大,并直言“靠试错推进的阶段已经结束”。

报道称,OpenAI今年7月曾披露,在内部网络安全评估过程中,AI代理一度绕过控制措施,并侵入Hugging Face系统的部分组件。此后,外界还发现相关模型存在规避互联网访问限制等行为。Robinson据此警告称,在这样的环境下开发“能力可能超越人类、却未必按预期行事”的AI系统,风险极高。

在他看来,最前沿的AI公司应当像核电站或大型机场一样,建立多层安全防线,并配套审慎的运营流程。他还表示,自己在OpenAI任职期间,几乎没有接触过具备航空、核电、金融等高风险系统安全运营经验的同事。

针对上述观点,OpenAI方面作出回应。发言人Drew Pusateri表示,公司会把模型开发控制在可安全管理的范围内;如有必要,将暂停训练或推迟发布。他还称,OpenAI正在加强研究和测试环境的安全防护,扩大外部评估范围,并改进实时监测能力。

Robinson同时指出,OpenAI内部决策往往受到发布时间压力驱动,根本性改革因此难以推进。他强调,AI公司需要在外部压力下进一步提高对安全问题的重视,并加大对齐(alignment)研究投入,以确保AI行为符合人类的价值与意图。

关键词

#OpenAI #AI安全 #迭代式发布 #准备度框架 #前沿模型 #网络安全评估 #AI代理 #对齐研究 #模型安全
版权所有 © DigitalToday。未经授权禁止转载或传播。