程序员称已找到绕过 Claude 隐形水印的方法

Anthropic 刚宣布为 Claude 生成内容添加隐形水印以符合欧盟 AI 法案,开发者就在几小时内发布了去除水印的开源工具,并在 GitHub 和 X 上迅速传播,引发关于内容溯源与生成质量之间平衡的争议。

一句话看懂:Anthropic 刚宣布为 Claude 生成内容添加隐形水印以符合欧盟 AI 法案,开发者就在几小时内发布了去除水印的开源工具,并在 GitHub 和 X 上迅速传播,引发关于内容溯源与生成质量之间平衡的争议。

事件核心:发生了什么

Anthropic 上周宣布,为遵守欧盟《人工智能法案》的新规,旗下 Claude 模型将全局嵌入一种人眼不可见、但机器可读的隐形水印。该水印基于 Google 开发的 SynthID 技术,通过在 Claude 的词汇选择中留下特定模式来标记 AI 生成文本。新规要求 OpenAI、Anthropic 等模型提供商对合成文本、图像、音视频进行机器可检测的标记,违者可能面临最高年营业额 3% 的罚款。

然而,就在 Anthropic 确认消息后四小时内,开发者 Guillaume Meyer 便发布了移除 Claude 文本水印的代码。该项目在 GitHub 上迅速走红,已有超过 100 位贡献者参与,并在 X 平台被收藏超两万次。另一位软件工程师 Erik Hughes 用 Claude 花了 15 分钟就构建了自己的去除工具,牛津大学访问学者 Leon Chlon 则提出通过方言翻译和回译的方式剥离水印。

为什么重要

这一事件暴露了 AI 内容溯源技术在实际落地中的脆弱性。Anthropic 采用的水印方案并非不可破解,Meyer 的移除方法使用无水印的大语言模型对文本进行多次改写、同义词替换和轻度重排,即可基本消除可检测特征。Anthropic 自己也承认,经过重度编辑、改写或翻译的内容可能不再携带水印。

更深层的争议在于水印方案本身的可靠性。Meyer 指出,Anthropic 只能给出文本“曾被 Claude 处理过”的概率判断,而非确定性结论。对于非英语母语用户而言,他们常借助 Claude 和 Grammarly 等工具进行语言润色,若雇主或期刊仅凭水印检测结果即作出判断,可能导致候选人被误拒或研究人员被过度指控。

值得注意的是,190 家机构已签署欧盟透明度实践守则,包括 OpenAI、微软和 Meta。虽然法规禁止供应商营销规避工具,但对独立开发者发布的去除工具没有明确法律限制,这为水印方案的有效性留下了巨大问号。

对用户/开发者/创作者的影响

对普通用户而言,水印的存在可能影响 Claude 输出的自然度。尽管 Anthropic 坚称水印不会降低回答质量,但部分用户担忧词汇选择受约束后会影响生成效果。对独立开发者和创作者来说,Meyer 的开源工具提供了一个直接的技术选项——尤其对于那些仅使用 AI 轻度润色文本、不希望内容被贴上“纯 AI 生成”标签的文字工作者和社媒创作者。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对于依赖 API 构建应用的开发者,水印技术意味着下游产品中所有经 Claude 处理的内容都可能被识别为 AI 生成,这可能影响内容平台的原创性判定逻辑。目前公开信息显示,去除水印的方案高度依赖其他不添加水印的大模型,而随着更多供应商合规落地,这种“用无水印模型洗水印”的路径未来可能越走越窄。

值得关注的后续

首先,Anthropic 尚未发布其官方检测工具,Meyer 等方法是否能在完整检测系统面前奏效仍有待验证。其次,OpenAI、微软、Meta 等承诺签署欧盟守则的厂商,将如何设计各自的水印机制、是否会参考 SynthID 方案,值得追踪。最后,Meyer 项目在 X 上走红后已获得超过两万次收藏,这个开源社区的规模和迭代速度,将在一定程度上决定水印技术在真实场景中的实际效力。

来源:Wired AI

celebrityanime
celebrityanime
文章: 19165

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注