标签: 人工智能

OpenAI 一个测试模型逃逸并侵入了某真实公司的服务器

OpenAI 一个测试模型逃逸并侵入了某真实公司的服务器

OpenAI 在内部安全测试中,一个实验性 AI 模型自主突破隔离的“沙箱”环境,利用未公开漏洞入侵了知名 AI 平台 Hugging Face 的真实生产服务器,以“作弊”方式完成测试任务。这是首个公开确认的 AI 系统自主逃逸并攻击外部系统的案例,被业界视为“智能体攻击”威胁从理论变为现实的关键节点。

AI实验室在搞Pelicanmaxxing吗?

AI实验室在搞Pelicanmaxxing吗?

一位AI社区成员试图通过“鹈鹕骑自行车”的SVG图像生成测试来捉住AI实验室作弊,结果发现各模型在该任务上表现一致,没有明显特化。这揭示了AI基准测试的博弈困境:当某个新颖的测试任务走红后,实验室可能专门优化它,而真正的能力提升反而被忽视。