谁会被加水印
欧盟 AI 法案第 50 条的透明度规定 8 月 2 日生效,要求 AI 公司以机器可识别的方式标记 AI 生成内容。10 月 5 日,OpenAI 宣布在未来几周内,给欧盟地区所有套餐的 ChatGPT 和 Codex 输出文本加入隐形水印 textGrain。API 客户则在全球范围内可按项目自行开启,默认关闭。OpenAI 明确表示暂不把它设为全球默认。
这和 Anthropic 的做法不同:本站 8 月报道过,Anthropic 在 8 月 2 日后发布的 Claude 模型上全面嵌入文本水印,API 也没有关闭选项。
它怎么工作,有多可靠
textGrain 不插入任何隐藏字符。生成时,如果有几个词同样合适,一把密钥决定落哪个词;单个词看不出来,篇幅够长后,持有密钥的检测器就能识别出这种模式。OpenAI 同时发布了与宾夕法尼亚大学、耶鲁大学研究者合作的技术报告。
按 OpenAI 公布的测试,理想条件下 400 token(约 300 个英文单词)的文本检出率约 95%,200 token 约 80%,数学类内容明显更低。改写的影响很大:把 10% 的词换成同义词,400 token 检出率从约 92% 降到 66%;换掉 25%,就跌到 20% 以下。翻译、短文本、代码和正式文体也会削弱信号。检测器初期只向获批的研究人员和专业机构个案开放。
影响判断
OpenAI 自己的表述很克制:没检出水印不能证明是人写的,水印也不能衡量人的贡献、确定归属或验证准确性。对教师和平台审核来说,这意味着它不是「AI 检测器」的替代品,稍加改写就能绕过。它真正的作用是合规与大规模溯源。对在欧盟提供服务的开发者,需要评估是否在 API 侧开启,以及开启后对用户的告知方式。
via: OpenAI 官方公告、textGrain 技术报告、TechCrunch 报道、The Decoder 报道