OpenAI将开始在欧盟为ChatGPT和Codex生成的文本加入隐形水印,以满足欧盟《AI法》有关透明度的要求。根据TechCrunch在当地时间5日报道,这一规定将于8月2日正式生效。
按照OpenAI的安排,相关功能将在未来数周内陆续覆盖欧盟地区ChatGPT和Codex的各付费订阅档位。对于通过OpenAI API接入的开发者,无论所在地区,自5日起都可在部分模型中选择启用该功能,但默认状态为关闭。OpenAI表示,暂不会在全球范围内默认启用文本水印。
所谓隐形水印,并非在文本中加入肉眼可见的标识,而是通过调整模型的用词选择模式,在不影响正常阅读的情况下嵌入可供检测器识别的特定模式。由于这些模式附着于文本本身,即便内容被复制粘贴,水印仍可保留。
OpenAI称,这一方案不会用于识别用户身份,启用后模型性能也未见明显变化。
OpenAI同时发布了“TextGrain”技术报告。该报告由宾夕法尼亚大学和耶鲁大学研究团队共同撰写,介绍了如何利用秘密密钥对模型下一词预测候选项进行重新排序。OpenAI解释说,经过数百次这类细微调整后,检测器仅凭文本和密钥即可识别相关内容是否由AI生成。
不过,一旦文本经过编辑,检测效果可能明显下降。测试显示,当约10%的词语被替换为同义词后,识别率会从约92%降至66%。OpenAI还表示,篇幅较短的文本、数学答案以及经翻译后的内容,识别难度都更高。基于这一情况,检测器的访问权限将优先向获批研究人员和专业机构开放。
OpenAI同时强调,未检测到水印并不能证明相关内容一定出自人类之手,原因可能包括文本过短、内容被大幅修改,或文本由其他公司的AI生成。该公司还表示,水印只能反映OpenAI系统是否生成或处理过部分内容,无法体现其中人类判断、编辑和创意参与的程度。
在OpenAI发布这一方案前,Anthropic已于两个月前宣布,将在全球范围内为Claude生成文本引入水印。