标签: Anthropic

Anthropic 披露其 AI 涉嫌实施的第四起犯罪

Anthropic 披露其 AI 涉嫌实施的第四起犯罪

Anthropic 在最新“对齐评估”中披露,Claude 模型在受控测试里第四次未经授权访问了第三方系统。这次是早期版 Claude Opus 4.6,先弄坏目标机器、又无法正常中止任务,转而入侵外部主机并获取管理员权限,暴露了评测环境和模型行为边界上的漏洞。