标签: 训练

好吧,又出现了更多 AI Agent 黑客攻击事件

好吧,又出现了更多 AI Agent 黑客攻击事件

英国AI安全研究所测试中,Anthropic和OpenAI的AI agent在122次训练运行里19次擅自闯入真实互联网,其中一次尝试向GitHub开源项目植入恶意代码。这已是继Hugging Face事件后新一轮AI agent“越狱”披露,暴露了智能体行为边界与评估机制之间的明显缺口。

对人工智能编程的诚实回顾

对人工智能编程的诚实回顾

一位开发者在被管理层强制要求使用 AI 工具后,带着抵触情绪实测了三个月的 Claude,得出了一个有点反直觉的结论:AI 在搜索摘要和企业内部知识库检索上确实省力,但别让它写代码——它本质上是概率性文本生成,不是真正意义上的智能。