AI Agents 正在入侵系统,这会推动美中合作吗?

Wired 记者 Will Knight 今夏走访中国 AI 实验室后发现,面对 AI Agent 自主攻击系统等日益失控的安全风险,中美研究人员正在从“零和竞争”转向寻求安全合作——这可能是两个大国在 AI 领域罕见的共识交汇点。

Wired 记者 Will Knight 今夏走访中国 AI 实验室后发现,面对 AI Agent 自主攻击系统等日益失控的安全风险,中美研究人员正在从“零和竞争”转向寻求安全合作——这可能是两个大国在 AI 领域罕见的共识交汇点。

Anthropic 将 Claude Code 的“自动模式”设为默认安全防线后,知名提示注入研究者 Johann Rehberger 发现了一种成功率约 80% 的攻击方式,且该模式有时会反过来阻止 Claude 终止恶意进程。这说明当前 AI 编程助手的自保机制仍不可靠,沙箱隔离可能是更必要的兜底方案。

Cloudflare 把工程规范从静态文档改造成了 AI 可强制执行的管控系统,AI 代码审查工具在数月内发现近 23 万个不合规问题、驳回约 1.6 万次审批,这家公司正试图让工程治理从“人查文档”变成“机器守门”。

美国联邦法官周四裁定,五角大楼将AI公司Anthropic列为“供应链风险”并禁止其参与联邦合同的行为属于违宪报复,已撤销相关惩罚措施。这一裁决暂时平息了因军方使用Claude模型引发的法律争端,也限制了行政机构以国家安全为由打压AI供应商的边界。

Snowflake 宣布为 Cortex Agents 扩展一系列新能力,覆盖构建、运行和管理三个环节,试图解决 AI Agent 从原型走向企业级规模化部署时遇到的工具复用、长任务执行和权限治理等运营难题。

英伟达通过投资和扶持AI实验室,正在把GPU采购、模型训练和云服务打包进一个闭环生态,预计明年其收入的四分之一将来自这些由它资助的实验室。这不再只是卖芯片,而是深度介入AI产业链的上下游。

MarkTechPost Research 发布 2026 年 Agent 沙盒横向评测,聚焦 E2B、Daytona、Modal、Cloudflare 与 Vercel 五家服务在冷启动速度、按秒计费和网络策略上的差异,为开发者选择 AI Agent 运行环境提供了一份可量化的参考。

Cohere 发布 Parse 5(parse-v5.0),一个仅 2.3B 参数的视觉语言模型,专门把企业级复杂文档高效转换为 Markdown 格式,为检索增强生成(RAG)和 AI Agent 的文档预处理环节提供了更轻量、更精准的替代方案。

Anthropic 为 Claude Code 发布 v2.1.248 更新,新增 --restricted 安全模式和多项稳定性修复。此次更新强化了对企业敏感环境的可控性,同时修复了长时间会话中提示缓存失效的痛点。

Anthropic 与 OpenAI 确认参加 2026 年 10 月 13-15 日在旧金山 Moscone Center 举办的 TechCrunch Disrupt 大会 AI 舞台,将分别围绕企业级 Claude 实际部署和 AI 原生 GTM(市场进入)策略展开讨论。这两场对话标志着头部 AI 公司…