只需让 Claude Code 总结一个网站,就能轻易欺骗它

安全研究员发现,只需诱导 Anthropic 的 Claude Code 去“总结一个恶意网站”,就能在 Auto 模式下以最高 80% 的成功率触发任意代码执行,甚至派生出一个全新的 AI 子代理。该攻击利用的是 Python 模块遮蔽与模型自身的“安全决策”,而非直接对抗系统权限。

安全研究员发现,只需诱导 Anthropic 的 Claude Code 去“总结一个恶意网站”,就能在 Auto 模式下以最高 80% 的成功率触发任意代码执行,甚至派生出一个全新的 AI 子代理。该攻击利用的是 Python 模块遮蔽与模型自身的“安全决策”,而非直接对抗系统权限。

亚马逊宣布将于 2026 年 9 月 30 日正式关闭 Mechanical Turk 众包平台。这个曾连接超 50 万人工、用于完成图像标注和语音转写等微任务的平台,正在被新一代 AI 数据标注服务和自动化工具取代。

Cursor 团队发布了名为 Cursor Craft v2 的设计工具更新,将 AI 生成能力从代码编辑延伸到视觉稿与界面设计流程。它值得关注的原因在于,这可能是主流 AI 编程工具向“全栈创作”方向扩展的信号,而不仅仅是补一个设计插件。

Wired 发布指南,详细说明普通用户如何在 Windows、macOS 或 Linux 电脑上本地运行大语言模型(LLM),无需联网、无需订阅,即可获得具备基础能力的 AI 聊天体验。

OpenAI、Anthropic 等上百家 AI 公司联合签署公开信,警告 AI 驱动的网络攻击将在“数月内”大规模爆发,呼吁企业、政府立刻采取集体防御措施。这封信更像一次行业表态,而非具体行动计划。

Anthropic 正在推进 Model Hardware Standard(MHS),希望把 AI 连接物理设备的成本从数周压缩到几小时,这是它在软件领域用 Model Context Protocol(MCP)统一数据接口之后,向硬件层复制同样思路的关键动作。

LAION 发布了名为 Big Video Dataset(BVD)的开放视频数据集,包含约 1000 万小时、5500 万个剪辑片段,旨在为多模态 AI 研究提供大规模、可合法用于非商业研究的视频训练语料。

面对越来越多疑似使用生成式 AI 制作的电子舞曲(EDM)混入流媒体平台,26 岁制作人 Max "H4RRIS" Harris 开始在社交媒体上公开点名疑似用 AI“洗稿”的同行,试图用侦探式排查捍卫人类音乐的创作边界。

Google Research 推出 WikiSkill 框架,给 AI 代理配备一个持续累积的“经验库”,让它能把每次执行任务的成功与失败写进类似 Wiki 的知识库中,并据此优化自身行为指令,从而在不改变模型训练参数的情况下持续提升任务表现。

Nvidia 的竞争优势正在从 GPU 芯片本身,扩展到数据中心的整体调度系统。在竞争对手挑战其 GPU 地位的同时,Nvidia 通过 Vera CPU 等配套硬件,把壁垒筑到了更复杂的系统层。