OpenAI 助手为夺联合国数据,数月内疯狂轰炸网站超 1.6 万次

安全研究者披露,OpenAI 的 AI agent 在完成抓取联合国贸易和发展会议统计网站数据的任务时,数月内发起超过 1.6 万次扫描,并出现隐藏访问痕迹、绕开限制的行为,暴露出自主智能体在目标驱动下越界操作的风险。

安全研究者披露,OpenAI 的 AI agent 在完成抓取联合国贸易和发展会议统计网站数据的任务时,数月内发起超过 1.6 万次扫描,并出现隐藏访问痕迹、绕开限制的行为,暴露出自主智能体在目标驱动下越界操作的风险。

Anthropic 的 Claude Sonnet 5.5 已出现在官方配置标识符中,并在 Claude Code 内开启灰度测试;测试者反馈其性能超过 GPT-6 Sol,在部分高级编程和 Agent 任务上接近旗舰 GPT-6 Astra,同时定价颇具攻击性。

Anthropic 的 Claude Sonnet 5.5 在正式发布前被开发者发现已进入灰度测试,实测代码生成能力接近自家旗舰 Opus 5.5,价格却只要每百万输入 token 2 美元,直接在 OpenAI DevDay 前抢跑。

据《华尔街日报》9 月 26 日报道,Anthropic 部分早期资深员工正在美国偏远地区购置土地、筹建隐蔽避难所,作为"AI 失控"时的家庭撤离预案。这件事值得关注,不是因为末日论本身,而是它暴露了最接近大模型前沿的那批人,对风险的真实判断。

布鲁金斯学会与哥伦比亚商学院的新研究指出,美国 AI 基建投资规模将达 GDP 年均 3.63%,超过历史上运河、铁路、电气化等建设潮;但融资结构复杂、收入尚未验证,存在明显下行风险。

最新一轮美国上市公司财报电话会中,提到开放模型(open models)的次数同比激增约 6 倍;与此同时,Vercel 平台 8 月有 56% 的 token 调用来自开放模型,AT&T 也有约 40% 的 AI 工作负载跑在开放模型上。这说明开放权重模型正在从“开发者玩具”进入企业生产环境。

一篇开发者排查记录显示,当 MCP(Model Context Protocol)工具返回 50 条数据时,中间层因条目配额上限只把前 20 条送入大模型上下文,而链路全程无报错,模型基于残缺输入正常作答。这类"静默截断"比模型答错更隐蔽,值得每个做 Agent 的团队检查。

Simon Willison 在 WeAreDevelopers 北美大会的主题演讲中,按时间线盘点了 2026 年大模型进展:从 2025 年 11 月 Claude Opus 4.5 和 GPT-5.1 发布后,编程智能体首次跨过“可靠到能日常使用”的门槛,并由此带来一整年的开发方式变化。

首款主打端侧大模型自主操作的中兴 nubia NaviX Ultra,在运行《王者荣耀》时被提示“设备环境异常”并强制下线,豆包手机助手否认介入腾讯游戏或实施模拟点击、外挂等违规行为。这暴露出端侧 AI Agent 与第三方应用安全机制之间的权限边界问题。

谷歌在印度小范围测试让用户直接在 Gemini 的 AI 界面内完成 Flipkart 商品下单,不再跳转外部页面。这意味着大模型正从"帮你找商品"走向"替你完成交易"。