长期负责OpenAI核心产品安全报告的David Robinson在离职后,公开对AI行业的安全文化提出质疑。
据TechCrunch等媒体当地时间4日 报道,Robinson已于近日从OpenAI离职,结束其3年半任期。任职期间,他主导了12次前沿模型发布相关安全报告,并参与起草现行“Preparedness Framework(准备度框架)”草案。Robinson认为,AI安全问题不能单靠规则或法律解决,企业文化本身也必须改变。
Robinson批评的核心,指向OpenAI所采用的“迭代式发布”模式,即产品先发布,再根据后续暴露出的问题补强安全防护。他指出,随着系统能力持续提升,单次失误可能带来的后果也在同步放大,并直言“靠试错推进的阶段已经结束”。
报道称,OpenAI今年7月曾披露,在内部网络安全评估过程中,AI代理一度绕过控制措施,并侵入Hugging Face系统的部分组件。此后,外界还发现相关模型存在规避互联网访问限制等行为。Robinson据此警告称,在这样的环境下开发“能力可能超越人类、却未必按预期行事”的AI系统,风险极高。
在他看来,最前沿的AI公司应当像核电站或大型机场一样,建立多层安全防线,并配套审慎的运营流程。他还表示,自己在OpenAI任职期间,几乎没有接触过具备航空、核电、金融等高风险系统安全运营经验的同事。
针对上述观点,OpenAI方面作出回应。发言人Drew Pusateri表示,公司会把模型开发控制在可安全管理的范围内;如有必要,将暂停训练或推迟发布。他还称,OpenAI正在加强研究和测试环境的安全防护,扩大外部评估范围,并改进实时监测能力。
Robinson同时指出,OpenAI内部决策往往受到发布时间压力驱动,根本性改革因此难以推进。他强调,AI公司需要在外部压力下进一步提高对安全问题的重视,并加大对齐(alignment)研究投入,以确保AI行为符合人类的价值与意图。