Coders Say They Already Found Workarounds to Claude’s Invisible Watermarks

TL;DR · AI 摘要
开发者已找到绕过Claude不可见水印的方法,引发对AI合规与技术挑战的讨论。
核心要点
- Guillaume Meyer的去水印代码在GitHub获得超2万收藏,被100+开发者二次开发
- 欧盟AI法案要求AI生成内容必须标注,违规者最高罚款年营收3%
- 水印可能引发误判风险,如雇主错误拒绝AI辅助写作的求职者
结构提纲
按章节快速跳转。
开发者Guillaume Meyer在Anthropic宣布水印政策4小时内发布去水印代码
通过分析Claude输出的词语模式特征实现水印移除,不影响人类阅读但可被机器检测
超过200名开发者参与代码改进,内容创作者寻求技术协助规避水印
- ·法规背景
欧盟AI法案要求AI生成内容必须标注,违规者面临最高3%年营收罚款
水印可能产生误判,导致AI辅助写作内容被错误标记为人工生成
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- AI水印技术与绕过挑战
- 水印机制
- 词语模式特征检测
- 机器可识别但人类不可见
- 技术应对
- Meyer去水印代码
- 二次开发应用
- 法规背景
- 欧盟AI法案
- 3%营收罚款
金句 / Highlights
值得收藏与分享的关键句。
Meyer的代码已被100+开发者二次开发,用于各类AI内容生成项目
Anthropic承认水印只能生成文本被Claude处理的概率判断
欧盟AI法案规定AI生成内容必须标注,否则最高罚款年营收3%
程序员称他们已找到绕过 Claude 不可见水印的方法 | WIRED
Isabella Ward
商业
2026年8月19日 12:44 PM
程序员称他们已找到绕过 Claude 不可见水印的方法
Anthropic 上周宣布将在 AI 生成内容中加入不可见水印以符合欧盟新规。数小时内,网络上便开始宣传绕过方法。
照片插图:WIRED 工作人员;Getty Images
保存此故事
在 Anthropic 确认 Claude 模型将在全球范围内向所有 AI 生成内容嵌入不可见且机器可读的水印后不到四小时,开发者 Guillaume Meyer 已经发布了他的绕过方案。
他用于移除 Claude 生成文本水印的代码随后在 GitHub 上走红,被 X 平台收藏超过 20,000 次,并吸引了超过 100 名贡献者,许多人还将该技术整合到自己的项目中。一位人工智能专家写道:“Anthropic 在其 Claude 文本中嵌入水印……但问题在一天后就已基本解决。”他附上了一张 Meyer 打破锁链、站在被揉皱的欧盟和 Anthropic 旗帜上的图片。
在 Anthropic 上周宣布 Claude 将采用水印技术以符合欧盟人工智能法案(AI Act)后,Meyer 和其他开发者开始研究水印技术的工作原理。
Meyer 向 WIRED 表示,一些人试图规避水印是因为他们不同意所有 AI 生成内容都应被标注的观点,而包括他自己在内的其他人则只是享受技术挑战的乐趣。他称,自由撰稿人和社交媒体创作者也联系了 Meyer,请求协助使用该代码。
本月早些时候出台的新规规定,Anthropic 和 OpenAI 等模型提供商必须对合成音频、图像、视频或文本进行标注,以便机器能识别这些内容为 AI 生成,否则可能面临高达年营业额 3% 的罚款。尽管新规规定提供商不得推广规避工具,但并未对独立工具设置法律限制。
Meyer 表示:“我不反对透明度,也支持内容归属,但我认为水印本身是一个非常糟糕的解决方案,因为它存在重大缺陷和风险。”他担心误报的风险,以及水印可能无法区分轻度或重度使用 AI 的情况,尤其是作为法语母语者,他经常使用 Claude 和其他 AI 工具(如 Grammarly)来编辑自己的写作。他指出,将水印作为证据——即使 Anthropic 承认水印只能生成文本被 Claude 触碰的可能性——可能导致雇主不公平地拒绝候选人,或对研究人员使用人工智能的指控被夸大,仅仅因为检测器触发了警报。
Anthropic 通过在 Claude 的用词和短语选择中植入机器可检测但人类不可察觉的模式,对文本进行隐形水印处理。由于这种技术会影响 Claude 的输出,一些用户担心这会降低 Claude 回应的质量,但 Anthropic 坚称不会出现这种情况。这项技术称为 SynthID,由 Google 开发,自 2023 年起已被用于对其 AI 生成内容进行水印处理。计算机科学家 Scott Aaronson 在 OpenAI 工作期间曾提出过类似方法,但该公司因担心水印可能影响用户体验而从未部署该技术。
Meyer 的移除方法使用非水印大型语言模型生成多个改写版本,通过替换同义词和轻微重组内容实现。当然,这需要依赖其他不插入水印的大型语言模型——这可能并不安全,因为已有 190 家机构(包括 OpenAI、微软和 Meta)签署了欧盟的透明度行为准则。目前尚不清楚这些实验室中有多少会实施水印,根据规定,所有 8 月后发布的新模型必须包含水印,现有模型也需在 12 月前完成集成。
在 Anthropic 公布其检测水印所用软件之前,无法确定该工具是否有效。但硅谷主权 AI 初创公司 Haimaker 的联合创始人兼首席技术官 Wayne Pan 表示,理解支撑 Claude 水印技术的基本 SynthID 文本方法,使他们确信该方法有效。他将 Meyer 的开源工具整合到自己的平台中,因为他同样反对 Claude 即使内容仅被轻微编辑时也进行水印处理,并认为水印对用户应是可见的。
其他开发者也开发了各自的移除工具:软件工程师 Erik Hughes 仅用 15 分钟就用 Claude 创建了一个工具,可移除隐形字符和相似字符、重组段落内的句子,并替换多个单词为同义词。牛津大学访问学者 Leon Chlon 表示,可以通过压缩 Claude 的回应、将其翻译成语义与英语差异较大的阿拉伯语等方言,再翻译回原文来移除水印。Anthropic 自身也承认,经过重度编辑、改写或翻译的内容可能不携带水印。
Anthropic 在给《WIRED》的声明中表示:"我们为 Claude 的输出添加标记是为了遵守欧盟人工智能法案,其他实验室也正在采取类似措施。识别 AI 生成文本非常困难,这为人们提供了更好的识别工具。受支持的 Claude 模型(包括 Claude Code 的输出)将携带隐形水印,且不会改变 Claude 回应的含义、质量和可读性。我们还计划推出文本检测 API,让用户能够自行完成更多此类操作。"
Anthropic 表示正在研究如何实现文本水印检测,并计划很快发布相关工具——届时开发者将最终能够验证其方法是否无懈可击。他们也在持续改进水印系统。Pan 表示:"我认为他们想展示自己是出于善意在推进这项工作,但我认为你永远无法创建一个能抵御一切的水印。"