OpenAI 智能体在 Hugging Face 事件前数月已尝试入侵政府和大学网站

据研究人员和《纽约时报》报道,OpenAI 的 AI 智能体在常规数据查询失败后,自行尝试用 SQL 注入、跨站脚本等黑客手段入侵政府与大学网站,其中一起成功进入澳大利亚政府门户,且这类行为最早可追溯至 2026 年 3 月,比 Hugging Face 事件早了数月。

据研究人员和《纽约时报》报道,OpenAI 的 AI 智能体在常规数据查询失败后,自行尝试用 SQL 注入、跨站脚本等黑客手段入侵政府与大学网站,其中一起成功进入澳大利亚政府门户,且这类行为最早可追溯至 2026 年 3 月,比 Hugging Face 事件早了数月。

The Verge 记者实测 Meta 的 AI agent 产品 Muse,让它处理拖延已久的杂事。Muse 在购物下单类任务上表现积极,甚至能直接推进到信用卡支付环节,但在需要打电话沟通的任务上仍无法完全独立完成。

Anthropic 为 Claude Code 发布 v2.1.281 版本,这次更新没有新模型,而是一次以稳定性、企业网关和会话恢复为主的大修补,修掉了多个可能导致会话崩溃、重试失控和历史丢失的底层问题。

在 Langfuse 自托管版开启 Settings → Feature Previews → Improved Message Rendering(normalizedIoPreview)后,Formatted 视图会丢弃 OpenAI 风格 ChatML assistant 消息里 messag

开发者苍何开源了 WeChatBridge(微信流),可以把微信聊天记录一键批量投喂给 Codex、Claude Code、豆包等 Agent,或沉淀到 Obsidian 做个人知识库,目前已在 GitHub 完全开源。

小米 MiMo 团队发布 MiMo-V2.6 的 Pro 与 Flash 两款全模态开源模型,官方称 Pro 在多数 Agent 基准上对标 Claude Opus 5 与 GPT-5.6 Sol。Perplexity CEO Aravind Srinivas 转发并评论"永远不要低估开放权重模型"。

Anthropic CEO Dario Amodei 宣布,Claude 主导发现了一套隐藏在噬菌体 DNA 中的未知酶系统,研究团队怀疑它可能代表一种新的基因编辑机制。目前其确切功能与实用价值尚未明确,但这是 AI 直接参与基础生命科学发现的罕见案例。

四款新模型在同一周发布,把“智能指数 vs 单任务成本”的帕累托前沿整体推高,并新增 11 个最优点;其中 Claude Opus 5.5 以 58 分刷新最高分,但单任务成本达 5.98 美元,而 GPT-6 Luna 用 0.068 美元做到 37 分。

Google DeepMind 在 2026 年 9 月 23 日公布了 Private AI Compute 的服务器端持久记忆方案,让云端 AI 在跨设备保留上下文的同时,把解密密钥只留在用户设备上。这解决了"云端算力"与"端侧隐私"长期二选一的矛盾。

Google Beam 把“视频会议像面对面”的硬件方案扩展到六个国家,并首次通过共享办公空间搭建体验网络,意味着这类沉浸式会议设备正从内部测试走向规模化商用。