AI文本水印的工作原理

Google 和 Anthropic 已经在实际产品中部署了 AI 文本水印,它不藏在字符或元数据里,而是藏在模型逐词生成时的“词汇选择”中,肉眼不可见,却能通过统计方法识别文本是否由 AI 生成。

一句话看懂:Google 和 Anthropic 已经在实际产品中部署了 AI 文本水印,它不藏在字符或元数据里,而是藏在模型逐词生成时的“词汇选择”中,肉眼不可见,却能通过统计方法识别文本是否由 AI 生成。

事件核心:发生了什么

据 Hacker News 上的一篇技术长文披露,Google 自 2024 年起已为 Gemini 应用和网页版输出添加文本水印,API 当前属于明确例外;Anthropic 计划让新款 Claude 模型从 2026 年 8 月起在模型层面标记文本,旧模型随后跟上。

这类水印的原理是:模型在生成每个词时,会基于上下文维护一个候选词列表(类似输入法预测)。带密钥的水印系统把候选词分成“绿色”和“红色”两组,并给绿色词一个极小的概率加成,使最终文本中的绿色词比例略高于随机水平。检测时,验证方用同一密钥重新分组并统计绿色词出现频率——超过 50% 越多,越能确定是 AI 生成。该路线最早由 Kirchenbauer 等人于 2023 年提出,Google 生产环境中的 SynthID 则采用更复杂的“锦标赛”式实现。

编辑会破坏水印:每个词的判断依赖前面一小段原文的完整性。实验数据显示,在真实实现中,全文重写后

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

celebrityanime
celebrityanime
文章: 18313

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注