标签: Claude

Anthropic 放在《寓言》前面的分类器太热心了

Anthropic 放在《寓言》前面的分类器太热心了

Anthropic 为其对话模型 Claude 引入了一个前置分类器,试图在用户请求进入模型之前就判断是否为“生物学”相关高风险内容。然而实际使用中,这个分类器极度敏感,连“问几个动物学冷知识”这样的无害请求都被降级处理,导致用户反复被踢到一个更弱的模型,引发了社区对过度安全的普遍不满。