共计 1127 个字符,预计需要花费 3 分钟才能阅读完成。
OpenAI 周一表示 , 将在欧盟为 ChatGPT 和 Codex 生成的文本加入不可见水印, 以配合《欧盟人工智能法案》的透明度要求。这意味着同一款产品在不同市场的内容标识策略, 开始出现明显分野。
📌 欧盟先行, 全球暂不默认
欧盟 AI 法案的透明度条款已于 8 月 2 日生效, 要求 AI 公司以其他系统可识别的方式标记 AI 生成内容。OpenAI 称, 水印将在未来数周内推送给欧盟地区符合条件的所有套餐用户; 通过 API 接入的开发者则从即日起可为部分模型开启, 但默认关闭。
值得注意的是,OpenAI 并未把文本水印设为全球默认。这一谨慎姿态与其过往顾虑有关: 公司此前已开发过文本水印, 却迟迟未发布, 原因之一正是担心用户会转向不加标识的竞品。
🔍 不是符号, 而是藏在选词里的模式
这套机制并不在文本中插入可见标记, 而是通过细微调整模型的用词倾向 , 形成读者察觉不到、检测器却能识别的规律。由于模式寄居在文字本身, 复制粘贴后依然随之迁移。OpenAI 强调, 水印不用于识别用户身份, 开启后模型性能也未出现明显变化。
与公告一同发布的技术报告将方法命名为 textGrain, 由 OpenAI 与宾夕法尼亚大学、耶鲁大学的研究者合作完成。其思路是借助密钥影响下一个词的预测排序, 把成百上千次微调叠加起来, 检测器只需文本和密钥即可判断内容是否由 AI 生成。
💡 编辑可削弱检测, 能力边界需要说清
- 测试显示, 将 10% 的词语替换为同义词后, 检测率从约 92% 降至 66%。
- 短文本、数学答案和翻译文本更难被识别。
- 检测器初期仅向经批准的研究者和专家组织开放。
“缺少水印并不能证明内容出自人类之手。”
OpenAI 还提示, 水印只能说明某个片段由 OpenAI 系统生成或处理, 无法衡量其中包含多少人类的判断、编辑与创意。
📊 行业观察: 标识能力与实用性之间的拉扯
两个月前,Anthropic 宣布对 Claude 生成文本加水印, 且全球适用, 曾引发部分用户不满——他们认为指令、上下文和决策都由自己提供, 模型只是工具。如今 OpenAI 选择欧盟先行、API 可选, 某种程度上是在合规与用户体验之间寻找低摩擦路径。
从更长周期看, 文本水印更像是一项兜底能力而非万能方案 。它能提高批量识别 AI 内容的门槛, 却难以对抗改写、翻译与短文本场景。Anthropic、Google、Meta、Microsoft 与 OpenAI 都已承诺遵循欧盟关于 AI 生成内容的实践准则, 一场围绕“可识别性”的基础设施竞争正在成形。
🚀 总结
对欧盟用户而言, 变化即将到来 ; 对其他地区用户, 短期内体感有限。真正决定水印价值的, 不是技术是否存在, 而是检测可靠性、误判风险, 以及它会不会改变人们对“作者”的理解。