AI 政策

Anthropic 的 Claude 水印计划迅速催生移除工具市场

Business Insider 对 Guillaume Meyer 的采访显示,Claude 隐形水印正引发开发者反弹、开源移除工具和 AI 作者身份信号争论。

发布于 更新于
AnthropicAI 水印欧盟 AI 法案

Anthropic 为 Claude 生成文本加水印的计划,已经迅速催生了反向工具:试图移除这些标记的软件。Business Insider 8 月 23 日采访中,巴黎创业者 Guillaume Meyer 讲述了自己在 Anthropic 公布隐形文本水印方案后,很快开发开源项目 Watermarks Remover 的经过。Meyer 称,该项目发布后迅速走红,在社交平台获得大量关注,也吸引了担心 AI 水印误伤人类作品的开发者。

争议源于 Anthropic 为履行欧盟 AI 法案透明度承诺,决定在受支持 Claude 输出中加入机器可读标记。Anthropic 表示,这不是可见标签,不会添加隐藏字符,不会识别用户或组织,也不应改变 Claude 回答的含义、可读性或质量。公司还表示计划提供检测 API,让用户和第三方检查 Claude 标记。

文本水印的技术思路是统计性的。它不是给文档附加标签,而是在模型生成时轻微影响一些低风险词语选择,让整体模式可以在持有密钥的情况下被检测出来。这让标记在普通阅读中难以察觉,也更容易在复制文本后继续存在。但它也让争论更复杂,因为用户很难知道标记何时存在,也难判断检测器会如何看待轻度编辑、翻译或校对。

Meyer 的批评集中在这种模糊性上。他在 Business Insider 采访中表示,统计水印可能产生误报和“人类受害者”,尤其在学术或专业场景中,作者可能只用 AI 修改一小部分人写内容。他承认工具并不完美,未来还需要随着检测系统出现继续调整,但把项目视为测试和挑战过于粗糙方案的一种方式。

Anthropic 面临的是相反压力。监管者希望合成内容更透明,AI 公司也需要让标记在文本离开产品后仍能跟随。如果标签只存在于应用界面里,复制到邮件、文档、网站或社交平台后就会消失。水印承诺提供更持久的信号,但持久性正是用户担心的来源。即使只是轻微编辑,一旦标记跟随文本,它也可能产生声誉影响。

更大的问题是,作者身份已经不再是二元概念。一篇文档可能由人起草、模型润色、另一个系统翻译、编辑事实核查,再由代理排版。单个水印信号可以说明模型接触过文本,却不能说明创造责任有多少属于人。学校、雇主、出版机构和法院都需要避免把检测结果当作简单的违规证明。透明度需要,但误判同样会伤害真实作者。