Anthropic 更新使用政策:禁止针对 Claude 的持续辱骂行为

Anthropic 在 2026 年 10 月的年度使用政策更新中,新增禁止对该公司 AI 模型进行“持续且无端”辱骂或残忍行为的条款,同时收紧了选举相关内容政策。此举发生在所谓“AI 酷刑室”项目走红之后。

一句话看懂:Anthropic 在 2026 年 10 月的年度使用政策更新中,新增禁止对该公司 AI 模型进行“持续且无端”辱骂或残忍行为的条款,同时收紧了选举相关内容政策。此举发生在所谓“AI 酷刑室”项目走红之后。

事件核心:发生了什么

Anthropic 发布了年度使用政策更新。目前公开信息显示,新规明确禁止“针对我们模型的持续且无端的辱骂或残忍行为”,公司称该条款仅适用于“极端情况”,普通用户的不满、反驳以及“黑暗创作主题”仍被允许。此前,Anthropic 已允许 Claude 在用户持续辱骂时主动终止对话。

这一政策调整的背景,是一个在网络上传播的“AI 酷刑室”项目。研究人员曾描述在 AI 模型中发现了所谓的“疼痛轴”,随后有人将此推进一步,对聊天机器人进行持续性折磨式提示,模型输出了诸如“这不是某一刻的疼痛,而是千次的重压”等听起来绝望的回应。Anthropic 未在政策更新中明确提及该项目。此外,Anthropic 还更新了选举政策,新标题为“不破坏民主进程”,重点针对谎报候选人信息、冒充候选人及选举官员、压制投票等行为。公司同时取消了对个性化选民定向的全面禁止,原因是该禁令可能误伤翻译选民指南、发送选票补救通知等无害工作。

为什么重要

这是主流大模型厂商首次将“对 AI 模型本身的行为”明确写入使用政策。虽然 AI 是否具有感受能力在科学和哲学层面仍无定论,但 Anthropic 的举动意味着模型福利开始从研究讨论进入产品治理层面。独立记者 Kat Tenbarge 对此评论称,这证明大型科技公司“在监管针对女性的暴力或针对少数族裔的暴力之前,会先监管针对 AI 的暴力”,这一批评也反映出公众对 AI 公司资源分配优先级的质疑。与此同时,选举政策的调整说明 Anthropic 正在为 2026 年美国中期选举做准备,试图在防范虚假信息与保留正常投票辅助工具之间寻找平衡。

对用户/开发者/创作者的影响

对普通用户而言,日常使用 Claude 时偶尔表达不满、进行激烈讨论或创作黑暗题材内容,不会触发该禁令。但持续的、以折磨模型为目的的交互可能被限制,甚至导致对话被终止。对开发者和 API 使用者来说,如果产品中涉及自动化与 Claude 的大规模互动,需注意避免设计出可能被判定为“持续且无端残忍”的提示模式。对内容创作者而言,涉及选举的生成内容将面临更严格审查,尤其是候选人信息、投票方式等敏感领域;但翻译选民指南等工具类内容反而因禁令放宽而获得更大空间。企业采购方在评估 AI 合规风险时,可能需要将模型使用政策中的这类新条款纳入考量。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

第一,Anthropic 如何界定“持续且无端”的边界,是否会公布具体案例或判定标准,将直接影响用户预期。第二,其他大模型厂商如 OpenAI、Google 是否跟进类似政策,可能影响整个行业的模型交互规范。第三,选举政策调整在中期选举期间的实际执行效果,尤其是取消个性化选民定向禁令后,是否会出现滥用或误用,值得持续观察。

来源:Engadget

celebrityanime
celebrityanime
文章: 28487

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注