Anthropic开始在Claude生成文本中加入人眼难以察觉的水印后,围绕版权、隐私及识别边界的争议迅速升温。
据Business Insider等外媒报道,Anthropic本周表示,已在部分Claude模型输出中直接嵌入不易察觉的文本水印。该标记在复制粘贴后仍可能保留,在部分改写或轻度修改后也未必会消失。Anthropic称,此举旨在区分AI生成内容与人工撰写内容,但并未披露具体技术细节。
技术投资人Bill Gurley指出,如果只有Anthropic掌握识别这类水印的能力,公司就等于同时扮演“法官、陪审团和检察官”。对此,Anthropic回应称,计划推出免费API,供用户和第三方自行检测与核验。
部分开发者还担心,水印机制可能影响Claude的回答质量。外界质疑,如果水印依赖特定词语或表达模式来嵌入标记,模型在措辞上可能会变得不够自然。Anthropic则表示,相关水印不会改变Claude回复的含义,也不会影响文本质量和可读性。
争议的另一焦点在于水印的适用范围。批评者认为,即便只是对人工撰写内容进行语法校对等轻度处理,文本也可能因此被标记为AI相关内容。Anthropic解释称,水印仅说明相关文本曾经过Claude处理,并不意味着内容从一开始就是由Claude独立生成;经Claude完成校对、翻译、总结或文件转换后,文本同样可能留下标记。
Anthropic也承认,很多用户本就会使用Claude处理校对、翻译、总结和格式转换任务,即便原始想法、文本或数据来自其他来源,最终结果中仍可能保留Claude的标记。
这也引发了外界进一步担忧:尽管欧盟AI法已将这类轻度编辑工作排除在水印义务之外,但Claude处理后的文本仍可能在仅作润色或校对的情况下留下标记。如果水印无法区分大规模生成与“只改一个逗号”式的微调,那么原本不属于监管重点的内容,也可能被一并纳入标记范围。
隐私问题同样受到关注。微软高管Steven Sinofsky认为,关键在于数据如何留存,以及人们是否仍能保有不留下数字痕迹的私人思考空间。软件工程教育者John Crickett则指出,如果AI生成代码自带水印,人类贡献在主张版权时,可能更难获得充分证明。
Anthropic表示,此举是为了满足欧盟AI法的相关要求。根据该法,AI系统提供方需对AI生成或被操纵的音频、图像、文本和视频结果添加水印。该要求适用于8月2日之后发布的模型;在此之前发布的模型则获得至2026年12月的宽限期。
Anthropic称,不仅是在欧盟,其面向全球推出的新模型也将从一开始启用相关标记机制:对文本输出嵌入用户难以察觉的水印;对其他格式的生成文件,则在支持的情况下加入包含数字签名的来源元数据。公司表示,非文本内容将采用C2PA元数据标准,但也承认,部分平台或功能可能并不支持水印。
Anthropic还表示,自8月2日起,支持的模型已在全球范围内启用水印。Google目前在生成式内容中使用SynthID技术;据悉,OpenAI也在其支持的图像和音频内容中采用SynthID。X(Twitter)则会对其判定为AI生成或被操纵的内容标注“Made with AI”。此前在8月13日,临近离任的白宫新闻秘书Karoline Leavitt的辞职公告帖一度出现该标记,随后又被取消。
不过,也有观点对水印持正面态度,认为其有助于缓解AI系统“自我吞噬”问题,即AI不断学习自身生成内容,进而导致性能下滑。
但对水印有效性的质疑仍未消退。报道称,文本水印通常通过对整篇文档中的选词模式施加细微偏置来实现,且只能借助专用工具识别。在这一过程中,模型为了维持水印信号,可能放弃更自然或更优的措辞,转而使用略显生硬的表达。
即便文本带有水印,只要将其粘贴到其他聊天机器人中再次改写,相关标记也可能消失。图像和视频中的标记,同样可能通过截图、录屏或常见元数据编辑工具被移除。也有人指出,一旦Anthropic公开完整的识别方法,反向开发去除系统的难度并不会太高。
与此同时,外界还指出,水印本身能够传递的信息其实相当有限。Anthropic解释称,“被检测到的标记只是内容曾经由Claude处理过的信号,并非决定性证据”。
换言之,检测到标记,只能说明内容可能经过Claude处理,并不能直接证明它完全由Claude生成;反过来,Anthropic也表示,“未检测到标记,并不意味着内容没有经过AI生成或处理”。
因此,批评者担心,如果普通读者无法清楚区分“经AI处理的文本”与“完全由AI生成的文本”,那么经过轻度编辑的人类写作,也可能被等同看待为纯AI内容。
欧盟AI法第50条第4款还规定了在何种情况下,内容发布方需要面向公众作出明确标注。按照该条款,即便文本完全由AI撰写,多数情况下也不需要额外加注标签,例如AI创作的小说或营销文案通常可以不作标识。
但如果相关内容旨在“向公众告知公共利益事项”,且未经负责任的编辑者审阅,则必须作出标注。由此形成的局面是:在模型层面,几乎所有经处理的内容都可能留下水印;但在面向读者的公开标签层面,只要已有编辑者审阅,哪怕文本本身由AI撰写,也未必会显示相关提示。
欧盟方面表示,这类透明度要求旨在防止信息生态信任被削弱,并降低大规模虚假信息、操纵、诈骗、冒名顶替和消费者欺骗等风险。欧盟委员会指南指出,公众应当知道自己是否正在与AI交互,或是否正在接触AI生成内容,以便据此作出知情判断,调整对AI的信任和依赖,避免误导和欺骗。
不过,也有观点认为,即便是涉及公共利益的AI生成报道,只要经过编辑审阅,面向读者的标签仍可能缺失,这也反映出制度初衷与实际落地之间仍存在落差。
Anthropic表示,未来将继续按照欧盟要求完善水印和检测技术。若相关标记机制未能正常运行,公司依据AI法最高可能面临1500万欧元罚款,或全球年度营收的3%,以较高者为准。