Claude隐形水印上线三天即遭开源破解,AI内容标记陷入攻防战

2026/08/19 16:58阅读量 2

Anthropic于8月16日为Claude所有生成内容加入基于SynthID-Text的隐形水印,可在不改变文本质量的前提下标记AI痕迹。三天后,GitHub开源工具watermarks-remover上线,Star数迅速超过1.38万,可清洗文本、图片和元数据水印。该事件折射出AI内容标记与创作权益之间的矛盾,水印被指“一刀切”污名化AI辅助创作,相关攻防预计还将持续。

事件概述

8月16日,Anthropic宣布为所有Claude生成内容(包括文本、SVG、PNG等)加入隐形AI水印。该水印基于谷歌DeepMind的SynthID-Text方案,通过调整生成词的被选概率形成机器可识别的统计规律,肉眼不可见,不消耗额外Token,也不影响生成质量。Anthropic称,复制粘贴和轻度编辑都难以去除。

开源反制:watermarks-remover

功能发布三天后,GitHub上出现开源工具watermarks-remover,Star数迅速升至1.38万以上,可清洗Claude、Google、OpenAI等模型的AI水印。它的主要能力包括:

  • 文本隐藏字符:可无损清理Unicode字符、宽空格、标签字符、bidi控制符等。
  • 文件元数据:剥离PNG、JPG、PDF、DOCX、HTML等格式中的C2PA、EXIF、XMP元数据。
  • 图像像素水印:内置CtrlRegen工具,通过受控生成重新绘制图片,绕过像素级水印。大图会自动分区处理后再拼接。该工具需下载约10GB模型,16GB内存更稳妥,无GPU时处理速度会很慢。
  • Token规律水印:调用另一个模型重写原文,打乱词概率统计规律。代价是可能洗掉原文中好的句子、语气和表达节奏。
  • 效果验证:接入清华大学团队开源的MarkLLM和MarkDiffusion框架,检测水印是否清除成功。

值得注意的是,Claude在对话中会拒绝帮助用户运行该工具,因为它不能亲手移除自己留下的水印标记。

背景与用户反弹

此前,包括OpenAI、Google、Meta、Microsoft在内的190多家AI公司已签署欧盟《AI生成内容透明度行为准则》,承诺推进AI生成内容的标记与检测。Anthropic迅速落实这一方向,将水印默认应用到全球Claude用户生成的内容上。

用户的不满主要集中在“一刀切”判定上:水印只能说明“Claude参与过”,却无法区分是花十小时查资料后仅让AI润色,还是整篇一键生成。被标记为“AI生成”容易让创作者的劳动被一笔抹掉。OpenAI曾在2024年开发过文本水印技术,但最终因担忧用户反感而没有正式上线。

分析认为,只要AI内容鉴别的需求存在,水印升级与清洗工具之间的攻防战就不会结束。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。