从Token到任务:Agentic AI 如何改变基础设施的关注焦点

今天的 AI 系统正从单次问答转向持续执行复杂任务,导致性能评估标准从每秒生成 Token 数变为完成任务的效率。这意味着 CPU 和头节点在 AI 基础设施中的角色被重新定义,Arm 借此推出了专为智能体 AI 设计的 AGI CPU。

今天的 AI 系统正从单次问答转向持续执行复杂任务,导致性能评估标准从每秒生成 Token 数变为完成任务的效率。这意味着 CPU 和头节点在 AI 基础设施中的角色被重新定义,Arm 借此推出了专为智能体 AI 设计的 AGI CPU。

NVIDIA Labs 开源了面向对象智能体框架 NOOA,核心结论是智能体的性能不仅取决于模型本身,更取决于“框架架构”(harness)的设计——通过将智能体定义为 Python 类,NVIDIA 在 SWE-bench、CyberGym 等基准上取得领先得分,开发者可以用标准软件工程流程来构建、测试和迭…

特朗普政府内部围绕如何应对中国开源AI模型能力提升,分裂成多个派系——从主张严格限制的网络安全官员,到奉行“放手放任”的前AI沙皇——政策走向将取决于谁能对总统施加最大影响。

Anthropic 的 Claude 共享聊天记录因缺少 noindex 标签被搜索引擎公开索引,用户通过 Google 搜索即可访问,部分内容包含加密密钥等敏感信息。Anthropic 已快速修复,但事件再次暴露了 AI 产品共享功能的常见隐私设计漏洞。

美国科技巨头正以前所未有的规模向AI基础设施投入资金,这股投资浪潮已从数据中心扩展到能源、芯片制造和产业应用,正在实质性地改变美国的就业结构和经济增长模式。

AI正在将中国新药研发的传统“十年十亿美元”周期压缩至数年甚至数月,通过加速靶点发现、分子筛选和临床前预测,降低试错成本,推动更多创新药进入临床。

2026年7月27日,AI 产品「Her」正式上线。创始人在公开分享中透露,该产品的核心不是任务效率,而是让 AI 记住用户的个人轨迹、生活习惯甚至身体状态,并在适当时刻主动关心——这标志着 AI 应用从“工具助手”向“长期关系”的设计思路出现实质性落地。

Berkeley RDI 提出软件自主开发三级框架,将 AI 在软件工程中的责任从代码编写逐步扩大到需求定义,并指出当前 AI 代理虽能独立完成复杂任务(如 16 个 Claude 代理用不到 $20K 构建 C 编译器),但在连续演化中可靠性不足,需要类似自动驾驶的等级化安全保障。

软银为投资 OpenAI 安排了一笔 400 亿美元的桥接贷款,目前新增 21 家金融机构参与分销,其中约 70 亿美元额度被分摊给这些新机构。这笔贷款是亚太史上最大规模桥融之一,直接支撑软银对 OpenAI 的股权投入,也折射出 AI 头部公司吸引巨量资金的结构性趋势。

美团于7月27日发布全场景AI Agent平台CatPaw,并同步开源其1.6万亿参数大模型LongCat 2.0。这标志着美团首次将自研的万亿参数模型从技术开源推进到行业应用阶段,并展示了基于国产算力的全流程训练能力。