来源:环球网

【环球网科技综合报道】10月6日消息,据techcrunch报道,OpenAI宣布将开始在欧盟境内为ChatGPT和Codex生成的文本添加不可见水印,以履行欧盟《人工智能法案》的透明度义务。

打开网易新闻 查看精彩图片

techcrunch报道截图

此次举措的直接动因是欧盟《人工智能法案》透明度条款于8月2日正式生效。该条款要求人工智能企业以“其他系统能够识别的方式”对AI生成内容进行标记,以提升AI产出的可识别性与可追溯性。OpenAI此番为文本植入水印,正是对上述监管要求的直接回应。

OpenAI介绍,所谓水印并非可见的符号或标注,而是通过微调模型的用词分布,在文本内部形成一种读者无法察觉、但检测器能够识别的统计模式。由于水印内嵌于文字本身,文本在被复制粘贴时同样会随之转移。公司强调,水印不识别用户身份,且启用后模型性能未出现显著变化。

在发布公告的同时,OpenAI联合宾夕法尼亚大学与耶鲁大学研究人员发布技术报告,公开了名为“textGrain”的水印方法。报告通过示例演示了如何利用密钥对下一个词的预测进行排序以补全句子,将大量此类信号叠加后,检测器仅凭文本与密钥即可判断内容是否由AI生成。

按照时间表,未来数周内,欧盟境内所有订阅档位的ChatGPT和Codex用户都将默认启用水印功能,但该功能目前仅限欧盟地区。面向全球,使用OpenAI API的开发者即日起可为特定模型开启水印,默认状态下保持关闭。OpenAI同时明确,在功能发布初期,文本水印不会作为全球默认设置。

OpenAI在报告中坦诚了当前技术的边界。测试显示,将约10%的词语替换为同义词后,检测率从约92%下降至66%;短文本、数学解答和翻译文本的识别难度更高。基于这些限制,公司决定仅向经审核的研究人员和专家组织开放检测器的初步访问权限,以便评估其可靠性与负责任的使用方式。

OpenAI同时提醒,缺乏水印并不能证明文本由人类创作——文本可能因过短或经过大量编辑而丢失水印,也可能来自其他公司的AI系统。水印可以表明OpenAI的系统生成或处理了部分段落,但不能反映其中融入了多少人类判断、编辑或创造力。

在OpenAI之前,竞争对手Anthropic已于两个月前宣布对Claude生成的文本添加水印,并在全球范围内推行。该举措一度引发部分Claude用户强烈反对,他们认为指令、背景和决策均由用户提供,Claude仅是工具。

另据《华尔街日报》2024年报道,OpenAI此前已开发文本水印功能却迟迟未发布,部分原因在于担忧用户转而选择提供“无水印”服务的竞争对手。

目前,包括Anthropic、谷歌、Meta、微软和OpenAI在内的多家人工智能企业已承诺遵守欧盟针对AI生成内容的行为准则。(青云)