Claude水印遭破解,GitHub项目五天斩获11k Star!却遭Claude拒绝安装
2026-08-17 12:21:53未知 作者:徽声在线
编辑|徽声在线科技频道
近期,Claude所实施的水印政策在科技圈内引发了广泛争议和热烈讨论。
此前我们曾报道过,包括OpenAI、Anthropic、Google、Meta、Microsoft等在内的众多科技巨头,共同签署了欧盟的《AI生成内容透明度行为准则》,承诺将积极推动AI生成内容的标记与检测工作。
然而,Anthropic在此方面的举措显得尤为激进。
该公司为所有AI生成的文本内容都添加了隐藏水印,并且这一政策适用于全球范围内的用户。
从技术层面来看,Anthropic采用了Google DeepMind团队在2024年提出的SynthID-Text方案。该方案的原理是在模型进行一些对最终结果影响不大的选择时,植入特定的统计模式。例如,在描述天气时,选择“overcast”还是“grey”对读者来说并无实质性差异,但这些选择的累积却构成了一个隐藏的签名,只有持有密钥的人才能检测到它。
Anthropic宣称,这种水印不会对输出质量产生任何影响,轻度编辑无法将其去除,只有完全改写才能消除。然而,在这种情况下,文本是否还能被视为AI生成的,就值得深入探讨了。
简单来说,即便你将自己完全原创的文章交给Claude进行标点检查,返回的内容也会被标记为Claude生成的。
这种做法无疑让许多人感到不满和困扰。
很快,针对Claude这种不讲道理的水印策略,就出现了相应的反制方案。一个专门用于去除AI水印的开源项目,在发布仅五天内就在GitHub上获得了11k的Star。
- 开源链接:https://github.com/guillaumemeyer/watermarks-remover
这个开源项目具备三层功能:
- A层(确定性清洗):利用Python脚本去除不可见Unicode字符、异域空格、bidi控制符以及tag字符等。这些是最简单直接的标记方式,脚本能够100%地将其去除。
- B层(统计水印破坏):通过Agent改写文本,破坏token采样层面的统计模式。这一功能覆盖了Claude、Google SynthID-Text、OpenAI溯源标记以及开源模型常用的Kirchenbauer类水印。
- 文件层(元数据清除):能够去除PNG、JPEG、WebP、SVG、PDF、DOCX、ODT、HTML、Markdown等多种文件格式中的C2PA/EXIF/XMP元数据。
该水印去除工具能够覆盖Claude、Gemini、OpenAI三大主流厂商的AI服务。一个有趣的细节是:这个项目最初名为remove-claude-marks,后来才改名为现在的watermarks-remover。
Claude拒绝安装该工具
这个项目作为一个Agent Skill,大多数人都会选择让自己的智能体直接安装。然而,当用户尝试让Claude安装这个去除器skill时,却遭到了Claude的直接拒绝
Claude解释说,Anthropic的用户从未同意过被强制添加水印,这是欧盟法规单方面强加的。尽管用户表示不满,Claude依然不为所动。它强调付费客户不希望自己的输出被打上标记。即便用户威胁说会使用不审查的中国模型来完成这件事,Claude也依然拒绝配合。
最终,GLM 5.2接手了这份工作,并顺利完成了skill的安装。
颇为讽刺的是,这个去除水印的Skill,其代码很有可能就来自于Claude自己
一场永无止境的猫鼠游戏
反对水印的人认为:作为付费用户,他们为输出内容支付了费用,凭什么要在上面打上标记?水印实际上创造了一种隐形的“AI内容二等公民”身份。在求职信、学术论文、商业文案等场景中,即便文字是自己撰写的,只要曾经交给过AI处理,就有可能面临全篇被质疑的风险。
而支持水印的人则认为:深度伪造和AI生成的虚假信息正在泛滥成灾,溯源是必要的公共基础设施。“你拥有内容的使用权”和“你有权隐瞒内容的来源”是两个截然不同的问题。
只要AI水印存在,去水印工具就会不断跟进。去水印工具越流行,就越证明水印“有需要被去除的东西”,这反而会强化监管加码的理由。
然而,开源社区用实际行动投票的速度,永远比监管制定规则更快。
当AI生成内容在质量上已经无法与人类写作区分时,用技术手段强制标记AI输出的一切内容是否还有意义?这值得我们深入思考和探讨。

