Anthropic为Claude新模型全面嵌入隐形水印,全球范围引发争议
2026/08/11 11:51阅读量 3
Anthropic 宣布在受支持的 Claude 模型中嵌入隐形文本水印,并为生成文件附加 C2PA 来源元数据。该机制源于欧盟《AI法案》下的透明度准则,适用于 2026 年 8 月 2 日起发布的所有模型,且在全球统一实施。官方将提供检测工具,但也承认检测结果不能简单等同于“AI 生成”;由于此前隐藏标记争议,此事引发用户强烈不满,生成质量也备受质疑。
事件概述
Anthropic 宣布在受支持的 Claude 模型中嵌入隐形文本水印,并为生成的 .svg、.png、.jpg 等文件附加 C2PA 签名元数据。公司已签署欧盟《AI法案》下的《AI生成内容透明度行为准则》,该准则由独立专家起草,经欧盟委员会和 AI 委员会评估,目前已有约 190 家机构签署,包括 Google、Meta、Microsoft、OpenAI 等。
这套机制将适用于 2026 年 8 月 2 日起及之后发布的所有模型,且在全球范围统一实施,不仅限于欧盟;已上线的 Claude 模型也在研究如何补加水印。
核心信息
- 文本水印:Claude 生成文字时,会在文本中编织一种肉眼不可见的标记。它不改变回复的意思、质量或可读性,但会随文本一起被复制、粘贴到其他地方,经过一定程度编辑后仍可能保留。
- 来源元数据:生成受支持的文件类型时,Claude 会附加遵循 C2PA 开放标准(由 Adobe、OpenAI、Google 等共同推动)的数字签名元数据,标明文件经过 Claude 处理,并能检测文件是否被篡改。
- 覆盖范围:包括 API、Claude、Claude Code、Claude Cowork、Claude Tag 等全线产品;通过 AWS、Google Cloud、Microsoft Foundry 访问 Claude 的云客户同样适用。
- 检测工具与局限:Anthropic 正在开发检测工具,使用户和第三方能查验文字或文件是否携带 Claude 标记,具体技术文档后续公布。官方也明确,检测到标记只说明内容经过 Claude 处理,不能确认 Claude 就是原作者;没检测到标记也不表示内容一定不是 AI 生成,可能是因为出自旧模型、被重度编辑、文本过短,或元数据因格式转换、截图而被剥离。
- 实现方式未公开:Anthropic 目前没有公开水印算法的细节,外部无法核查其具体实现和后续用途。
值得关注
- 文本水印可以通过 Unicode 中肉眼不可见但计算机可区分的字符实现。Anthropic 此前已被发现使用过类似手法:6 月 30 日,有开发者反向工程 Claude Code 后发现,其中包含针对中国用户的隐藏标记——将日期格式中的横杠改为斜杠,并把
Today's中的撇号替换为码点不同但视觉一致的字符。公司尚未透露新水印是否采用同一路线。 - 通过限制模型采样分布来嵌入水印,是否会影响生成质量,仍是外界关注的问题。Anthropic 称不会影响,但疑虑并未完全消除。
- 对抗水印的方案也已出现。Y Combinator 创始人 Paul Graham 孵化了新的创业 idea:做第三方重新生成功能,通过重新措辞在保留原意的同时去除水印。更轻量级的做法是直接用 Kimi 等工具重写文本以去掉隐形水印。
