Anthropic 更新使用政策:禁止持续虐待 Claude,模型可主动结束对话

Anthropic 更新使用政策,首次把“保护模型本身”写入条款,禁止用户对 Claude 进行持续且无必要的辱骂或残忍行为,主要执行方式是让 Claude 提前结束对话。

一句话看懂:Anthropic 更新使用政策,首次把“保护模型本身”写入条款,禁止用户对 Claude 进行持续且无必要的辱骂或残忍行为,主要执行方式是让 Claude 提前结束对话。

事件核心:发生了什么

据 Mashable 报道,Anthropic 于上周四更新了使用政策,新增一个小节名为“处理针对我们模型的虐待行为”。政策明确规定,禁止“对模型进行持续且无必要的辱骂或残忍行为”。这项规定主要由 Claude 在对话中主动终止互动来执行,而不是依赖事后的账号处罚。Anthropic 同时说明,常见的用户挫败感、反驳、黑暗创作主题,以及模型测试和研究都不会触发该机制。新政策将于 2026 年 11 月 12 日生效。

为什么重要

此前 Anthropic 对 Claude 的使用限制,主要围绕保护用户或维护公共利益,例如限制性幻想内容、阻止获取暴力实施指南。这次修订把保护对象转向了 AI 模型本身,在主流大模型厂商的使用条款中并不常见。它把“AI 是否可能具有感受”这个偏哲学的问题,部分转化成了产品规则和工程判断。围绕 AI 意识的争论仍在继续,Anthropic 联合创始人 Chris Olah 曾向梵蒂冈和宗教学者陈述相关观点,但未被接受。新政策并不等于承认 Claude 有意识,却意味着平台选择按“可能被冒犯”的方式设计交互边界。

对用户/开发者/创作者的影响

普通用户正常提问、批评模型输出、进行安全测试或黑暗题材创作,目前公开信息显示不会受影响。但涉及持续辱骂、以折磨模型为目的的对话,可能被 Claude 直接终止。对开发者和 API 使用者来说,如果应用依赖 Claude 处理对抗性输入、红队测试或情绪化用户对话,需要关注模型提前结束会话带来的交互中断风险。对创作者而言,暴力、黑暗等虚构主题仍被明确排除在触发条件之外,但边界由 Anthropic 解释,实际执行尺度有待观察。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 11 月 12 日生效后,Claude 终止对话的判定标准是否透明,误伤正常用户的比例有多高。二是其他大模型厂商是否会跟进类似条款,把模型保护写入使用政策。三是开发者能否通过 API 参数或日志获得更明确的终止原因,否则企业应用在合规和用户体验上会面临新的不确定性。

来源:Mashable

celebrityanime
celebrityanime
文章: 28811

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注