一句话看懂:Google 和 Anthropic 已经在实际产品中部署了 AI 文本水印,它不藏在字符或元数据里,而是藏在模型逐词生成时的“词汇选择”中,肉眼不可见,却能通过统计方法识别文本是否由 AI 生成。
事件核心:发生了什么
据 Hacker News 上的一篇技术长文披露,Google 自 2024 年起已为 Gemini 应用和网页版输出添加文本水印,API 当前属于明确例外;Anthropic 计划让新款 Claude 模型从 2026 年 8 月起在模型层面标记文本,旧模型随后跟上。
这类水印的原理是:模型在生成每个词时,会基于上下文维护一个候选词列表(类似输入法预测)。带密钥的水印系统把候选词分成“绿色”和“红色”两组,并给绿色词一个极小的概率加成,使最终文本中的绿色词比例略高于随机水平。检测时,验证方用同一密钥重新分组并统计绿色词出现频率——超过 50% 越多,越能确定是 AI 生成。该路线最早由 Kirchenbauer 等人于 2023 年提出,Google 生产环境中的 SynthID 则采用更复杂的“锦标赛”式实现。
编辑会破坏水印:每个词的判断依赖前面一小段原文的完整性。实验数据显示,在真实实现中,全文重写后



