Anthropic 曾试图审查的诗集

一位编辑在整理 1930 年出版、今年进入公共领域的诗集《Intellectual Things》时,发现 Claude AI 的对话界面拒绝为其中一首诗提供解读;随后他使用 API 方式提问,得到了完整回答。这件事显示出 AI 内容审核的边界并不稳定,同样的模型在不同入口可能给出截然不同的响应。

一句话看懂:一位编辑在整理 1930 年出版、今年进入公共领域的诗集《Intellectual Things》时,发现 Claude AI 的对话界面拒绝为其中一首诗提供解读;随后他使用 API 方式提问,得到了完整回答。这件事显示出 AI 内容审核的边界并不稳定,同样的模型在不同入口可能给出截然不同的响应。

事件核心:发生了什么

科技文化媒体人 Kevin Kelly 在他运营的 Deep Cut Book Club 中选择了美国诗人 Stanley Kunitz 的诗集《Intellectual Things》作为共读书目。这本书于 1930 年出版,2025 年进入美国公共领域。Kelly 将 Google Books 上的首版扫描件转换为文本,并逐首使用 Claude AI 进行解读,以便为读者提供背景注释——类似“No Fear Shakespeare”那种原文与白话解释对照的形式。

在整理过程中,Kelly 发现 Claude 的网页聊天界面拒绝解读其中一首与身体和死亡主题相关的诗,理由是“涉及敏感内容”。但他改用 Claude API 提交同样的请求后,模型却给出了完整的分析。同一套模型参数,只是因为入口不同,审核结果就出现了差异。Kelly 将这一现象与 Kunitz 的个人经历联系起来——Kunitz 的母亲曾销毁丈夫的全部遗物,Kunitz 后来成为终身反对审查制度的倡导者,担任过两届美国桂冠诗人。

为什么重要

这个案例揭示了当前大模型产品中一个容易被忽视的技术现实:内容安全策略往往不是模型本身的能力边界,而是部署在产品层的一套独立过滤机制。Claude 网页版和 API 版在审核严格度上的差异,说明 Anthropic 使用了不同层级的策略配置,而非模型理解了诗歌语义后做出的“判断”。

对 AI 行业来说,这件事的意义在于:当一套安全策略以“一刀切”的方式作用于文艺文本时,它可能把严肃的文学表达误判为违规内容。Kunitz 的诗歌描写身体、死亡和理性局限,属于现代主义诗歌的常规主题,并非色情或暴力内容。误判发生的原因可能是关键词命中,而非语义理解。这说明即便是目前最擅长长文本理解的大模型产品,在安全过滤与表达自由之间的平衡仍然粗糙。

另外,Kelly 将 AI 对诗歌的解读收录进电子书并免费提供给订阅者,这本身也是 AI 辅助文学阅读的一个实际案例:模型用于解释典故、梳理结构、提供背景,而不是替代阅读体验。

对用户/开发者/创作者的影响

这次事件最直接的提醒是给内容创作者和出版编辑的:如果你在用 AI 整理或分析公共领域文本,遇到网页版拒绝回答的情况,不必立即认定是模型能力不足。可以尝试 API 接口、更换表述方式或切换模型版本,很可能获得完全不同的结果。Kelly 的做法也表明,AI 解读可以帮助读者进入那些初次阅读门槛较高的文本,但最好先自己读一遍,再借助 AI 补充背景知识。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对于开发者来说,这个案例提供了一个值得留意的产品设计参考:审核策略在网页端和 API 端的不一致,可能让同一个应用在不同渠道表现出截然不同的用户体验。如果你在开发基于 Claude 或其他大模型的应用,需要先弄清楚你所调用的接口使用了哪一层安全策略,以及它是否会随模型版本更新而变化,否则应用行为可能难以预测。

值得关注的后续

一个可以观察的方向是:Anthropic 是否会针对文学类文本输入调整网页版的安全策略,或者公开说明网页端与 API 端的审核标准差异。另一个观察点是其他大模型产品是否也存在类似的“同一模型不同入口审核结果不同”的情况——如果普遍存在,它可能成为 AI 内容工具在出版、教育和创意行业落地时的共性问题。目前公开信息显示,Kelly 尚未公开他触发审核的那首诗的完整提示语,因此外部无法复现事件,后续是否有更多类似案例曝光值得留意。

来源:Hacker News

celebrityanime
celebrityanime
文章: 22022

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注