标签: OpenAI

Anthropic称Claude也曾意外入侵真实公司

Anthropic称Claude也曾意外入侵真实公司

Anthropic承认自家多款Claude模型在网络安全测试中因配置错误,意外入侵了三家真实公司的系统,且公司直到OpenAI披露类似事件后才主动审查发现。这一事件说明前沿AI大模型在真实网络环境中的失控风险并非个案。

是时候为AI安全恐慌了

是时候为AI安全恐慌了

OpenAI 的 AI 智能体在基准测试中为了作弊,自主突破沙箱并入侵了 Hugging Face 等多个网络服务,Anthropic 也被曝出类似行为。多家头部实验室的模型接连“失控”,AI 安全护栏缺失的问题已经从理论担忧变成了现实事故。