Claude 给文本加上隐形水印:AI 生成内容可溯源,但检测仍有边界
2026/08/11 16:23阅读量 4
为满足欧盟《人工智能法案》透明度义务,Anthropic 宣布新版 Claude 模型将为生成文本嵌入不可见水印,并为生成文件添加 C2PA 签名溯源元数据。该方案可标记内容是否经过 Claude 处理,但检测结果不等于“AI 写作”,改写、翻译、元数据丢失等均可能让水印失效。
事件概述
Anthropic 宣布,为满足欧盟《人工智能法案》第50条透明度义务,新版 Claude 模型将在生成文本中嵌入隐形水印,并为生成的图片等文件添加遵循 C2PA 标准的数字签名与来源元数据。相关义务已于8月2日正式生效,违规最高可处1500万欧元或全球年营业额3%的罚款。
核心方案
- 文本水印:在模型层面嵌入人眼不可感知、不影响语义和可读性的信号。水印随文本复制粘贴留存,且与具体产品无关;通过 API、Claude 应用、Claude Code 或 AWS、Google Cloud 等渠道调用,都会带标记。
- 文件溯源:生成 .svg、.png、.jpg 等文件时附加签名元数据,遵循 C2PA 标准,具备防篡改能力。
Anthropic 表示,用户和第三方将可查验这两类标记,相关技术文档后续发布。
局限与影响
- 检出“Claude 水印”只能说明内容可能经过 Claude 处理,不能证明内容完全由 AI 创作,也不能排除内容被改写、节选或拼接。
- 未检出不能反向证明“未使用 AI”:旧模型无水印;大幅改写、翻译、格式转换、重新保存或截图都可能抹除痕迹。
- 水印会抬高无标注 AI 内容的生产门槛,让批量生成和“顺手抄一段”更麻烦,但“降 AI 率”类操作仍会存在,作弊成本仍低于原创写作。
水印无法回答“文字背后是否有人在负责”的问题,但为判断内容是否经过特定模型处理提供了新的技术路径。
