OpenAI 周一在官方博客中表示,将在欧盟范围内为 ChatGPT 和 Codex 生成的文本添加不可见水印。这一举措是为了遵守《欧盟人工智能法案》(EU AI Act)中关于 AI 生成内容透明度的要求。该条款已于 2026 年 8 月 2 日生效,规定 AI 公司必须以其他系统可识别的方式标记 AI 生成的内容。
合规驱动下的区域性部署
OpenAI 表示,这项水印功能将在未来几周内向欧盟地区所有订阅计划的 ChatGPT 和 Codex 用户逐步推出。与此同时,全球范围内的开发者也可以通过 OpenAI API 为部分模型开启该功能,但默认处于关闭状态。OpenAI 明确指出,目前不会将文本水印设为全球默认设置。
这一安排反映出 OpenAI 在监管合规与用户体验之间的权衡。此前《华尔街日报》曾在 2024 年报道,OpenAI 虽然早已具备文本水印技术,但因担心用户可能转向未实施水印的竞争对手,一直未正式发布。
水印如何运作
OpenAI 此次采用的水印并非在文本中插入可见符号,而是通过微调模型的用词选择,在生成内容中嵌入人眼无法察觉、但检测器可以识别的模式。由于水印直接存在于文字本身,即使内容被复制粘贴,也能保留标记信息。
- 水印不会识别或追踪具体用户
- OpenAI 称开启水印后模型性能未出现明显变化
- 检测过程依赖文本本身和一个密钥
OpenAI 还发布了名为 textGrain 的技术报告,该报告由 OpenAI 与宾夕法尼亚大学及耶鲁大学的研究人员共同完成。其原理是利用一个密钥对模型的下一个词预测结果进行排序,通过数百次类似的细微调整,使检测器能够在仅拥有文本和密钥的情况下识别 AI 生成内容。
编辑可能削弱水印检测
尽管水印可以随文本传播,但 OpenAI 承认其检测能力存在局限。测试显示,如果将文本中 10% 的词语替换为同义词,检测准确率会从约 92% 降至 66%。此外,短文本、数学答案和翻译文本也更难被准确识别。
基于这些限制,OpenAI 初期仅向经批准的研究人员和专业机构开放检测器访问权限,以便进一步评估其可靠性和合理使用场景。
OpenAI 同时提醒,缺少水印并不能证明内容出自人类之手。文本可能过短、经过大量编辑,或来自其他公司的 AI 系统。水印只能说明 OpenAI 系统生成或处理过部分内容,但无法反映其中包含多少人类判断、编辑或创造性。
行业合规正在形成共识
在 OpenAI 之前,Anthropic 已宣布将为 Claude 生成的文本添加水印,并在全球范围内应用。不过,该决定曾引发部分用户反弹,他们认为自己在创作过程中提供了指令、背景和决策,AI 只是工具。
目前,Anthropic、Google、Meta、Microsoft 和 OpenAI 等公司均已承诺遵守欧盟关于 AI 生成内容的行为准则。随着监管框架逐步落地,AI 内容的可追溯性正在成为行业基础能力之一。
分类:大模型
原创文章,作者:点点,如若转载,请注明出处:https://www.dian8dian.com/openai-jiang-zai-ou-meng-wei-chatgpt-wen-ben-tian-jia-yin