
自 2026 年 8 月初起,Anthropic 开始为其模型 Claude 生成的文本嵌入一种”难以察觉的隐形水印”。然而就在功能上线后不久,一批开发者连夜造出了专门”清洗”这些标记的开放工具,一场围绕 AI 内容标识的拉锯战就此展开。
水印如何工作
据 Anthropic 介绍,这套水印并不在文本中留下可见字符,而是通过 Claude 在选词上的统计规律形成”数字指纹”——当多个同义表达都合适时,模型会偏向其中一个,从而在输出中留下机器可识别、人类却难以察觉的痕迹。由于特征附着在文字本身,即使用户复制粘贴,标记也会随之保留。
Anthropic 表示,此举是为了履行其在欧盟《人工智能法案》(AI Act)下的承诺。该法案要求模型提供方对合成文本做出机器可识别的标记,违规企业最高可能面临年度营业额 3% 的罚款。今年 7 月,Anthropic 与 OpenAI、微软、Meta 等约 190 家机构共同签署了欧盟的透明度行为准则。
反弹为何来得这么快
许多用户和专业人士担忧,即便只是用 Claude 做校对、翻译或总结,隐藏标记也会随最终内容一起传播。一些人因此取消了订阅。据美国地区搜索趋势,”AI watermark remover”(AI 水印移除工具)的搜索热度环比上涨约 60%。
开发者反应迅速。常驻巴黎的科技创业者、AI 电商工具 Memo 创始人 Guillaume Meyer 在公告后数天内就发布了开源项目”Watermarks Remover”。该工具会清除隐藏字符与元数据,再在不改变原意的前提下重写文本,从而破坏承载水印的统计性选词模式。Meyer 称初版大约花了 5 小时开发,项目在 GitHub 上已获得超过 1.4 万个 Star。他也坦言,工具无法保证百分之百去除水印。
与此同时,AI 教育者 Sabrina Ramonov 在社交平台分享了免费的浏览器端”Watermark Remover”,宣称可从文本、PDF、Word、网页、图片及数据文件中清除隐藏的 AI 标记;常驻东京的开发者 Ansh Aneja 也在公告当天做出针对 Claude 的移除工具,随后放出名为 MarkScrub 的本地开源版本。
技术局限与法律灰色地带
支撑这套水印的技术名为 SynthID,由谷歌开发,自 2023 年起便用于其 AI 生成内容的标识。苏黎世联邦理工学院研究员 Thibaud Gloaguen 指出,水印技术长期存在固有局限——”总会有办法移除水印”,比如对整段文字重新措辞。
法律层面同样模糊。欧盟要求提供方的标识系统能抵御常见修改与对抗性操作,但并未明确禁止第三方开发或尝试移除水印。不过,若用户利用这类工具将 AI 生成内容伪装成人类创作,则可能触碰 Anthropic 禁止”冒充人类”的服务条款。随着 Anthropic 计划在下一代模型发布时同步推出文本检测接口,这场”加水印”与”去水印”的博弈预计还将升级。
(本文综合 Business Insider、WIRED 等报道。)







