未来几周内,OpenAI将开始为欧盟境内符合条件的用户使用ChatGPT和Codex生成的文本添加不可见水印,此举旨在遵守《欧盟人工智能法案》中的透明度规定。此次发布将涵盖所有套餐,但在初期,文本水印不会成为全球默认设置。
透明度规定于8月2日生效,要求人工智能公司以便于其他系统识别的方式标注机器生成的内容。另一方面,在世界任何地方使用OpenAI API的开发者从现在起都可以在指定模型上启用该功能,但该功能默认处于关闭状态。
水印如何运作?
水印不会以符号或可见提醒的形式出现,而是通过对模型建议的词语选择进行细微调整来生成。这种调整会留下可由专门检测工具识别的模式,并且在文本被复制和粘贴后,该模式仍会保留。OpenAI表示,水印不会透露用户身份,并且在公司测试期间,启用水印并未对模型性能造成有意义的变化。
OpenAI同时发布了一份介绍其方法的技术报告,该方法名为textGrain,由公司以及宾夕法尼亚大学和耶鲁大学的研究人员共同撰写。据报告介绍,该方法依靠秘密密钥在完成句子时排列后续词语的概率,然后汇总数百次此类调整,使检测器能够利用文本和密钥识别出这种模式。
编辑后的检测局限
水印并不能在所有情况下都为文本来源提供决定性证据。在OpenAI进行的一项测试中,将10%的词语替换为同义词后,检测率从约92%降至66%。公司还发现,短文本、数学答案和翻译文本更难检测。
OpenAI警告称,缺少水印并不能证明文本由人类撰写;文本可能过短,可能经过大量编辑,也可能由其他公司的人工智能系统生成。此外,存在水印可能表明OpenAI的某个系统生成或处理了该段文本的一部分,但无法确定其中包含了多少人的判断、编辑或创意。
这条消息为什么重要?
此次发布为欧洲机构提供了另一种技术手段,用于检查ChatGPT和Codex的内容,但它本身并不能解决证明文本来源的问题。由于检测结果容易受到编辑、翻译和文本长度的影响,因此需要谨慎解读。这也促使OpenAI将检测工具的初始访问权限限制在经认证的研究人员和专业组织范围内,以评估其可靠性及负责任的使用方式。
此举发生在Anthropic两个月前宣布在全球范围内为Claude生成的文本添加水印之后。该决定遭到部分用户反对,他们认为自己对指令、上下文和决策所作的贡献意味着Claude是工具而非作者。根据《华尔街日报》于2024年发表的一篇报道,OpenAI此前曾开发过一种文本水印技术,但因担心用户转向不使用水印的竞争对手而没有推出。