Claude 的输出开始带隐形水印:8 月 2 日后发布的模型全覆盖,没有关闭选项

Anthropic 于 8 月 11 日更新帮助中心文档,确认 2026 年 8 月 2 日及之后发布的 Claude 模型会在生成文本中嵌入人眼不可见的水印,图片等文件则附带带签名的 C2PA 溯源元数据。标记发生在模型层,网页版、API、Claude Code 与三家云上的 Claude 一并覆盖,目前不提供关闭选项。对应的是欧盟 AI 法案 8 月 2 日生效的透明度条款。

文本改词频,文件加签名

文本水印的做法是按 Anthropic 持有的密钥,对模型的用词选择做统计意义上的偏置:单看每一处都很普通,文本够长时整体模式就能被检出,且复制粘贴到别处仍会跟着走。Anthropic 称这不改变回答的语义、质量与可读性。文件侧走 C2PA 开放标准,`.svg`、`.png`、`.jpg` 等格式会带上签名过的溯源元数据,标明该文件被 Claude 处理过,并能显示此后是否被篡改。因为标记发生在模型层,它跟着输出跑遍所有入口——Claude 平台 API、网页与客户端、Claude Code、Claude Cowork、Claude Tag,以及经 AWS、Google Cloud 和 Microsoft Foundry 调用的版本。Anthropic 说正在给 8 月 2 日之前发布的模型补这项能力。

合规是动因,边界写得也很清楚

触发点是欧盟 AI 法案第 50(2) 条与 8 月 2 日生效的透明度准则:生成合成文本、音频、图像、视频的提供方须让输出机器可读、可被识别为人工生成。Anthropic 选择在全球统一执行,而不是只对欧盟用户生效。公司自己列了限制:检出标记只说明内容**可能**被 Claude 处理过,不证明创意或文字出自 Claude——让它校对、翻译或做摘要都可能留痕;反过来,大幅改写、转述、转译、文本过短、元数据被剥离或平台不支持,都会让检测失败,没有标记同样不能证明内容出自人手。

争议集中在缺少配套

反弹焦点是误判风险。Anthropic 说会按准则要求支持第三方检测,细节留待后续文档,但检测工具、准确率阈值与申诉流程目前都没公开,开发者也无法把它接进自己的合规流程。结果是:人写、只让 Claude 润色过的稿子可能被判成「AI 生成」,当事人却拿不到可核对的依据,已有用户称因此退订。产出会被查验的场景(投稿、课业、外包交付),短期内更稳妥的是自己留好写作过程记录。

via: Claude 帮助中心《How Claude marks AI-generated content》TechCrunch 报道Forbes 报道;核实于 2026-08-15