Meta 的 AI agent Muse 现在已是美国第二大应用

Meta 新推出的 AI agent 应用 Muse 上线后在美国 iOS 下载约 8.3 万次,冲到 App Store 总榜第二;但相比 Threads、Meta AI 和 ChatGPT 的同期表现,这个开局明显更慢,说明 agent 类产品的用户教育成本可能被低估。

Meta 新推出的 AI agent 应用 Muse 上线后在美国 iOS 下载约 8.3 万次,冲到 App Store 总榜第二;但相比 Threads、Meta AI 和 ChatGPT 的同期表现,这个开局明显更慢,说明 agent 类产品的用户教育成本可能被低估。

Anthropic 为 Claude Code 发布 v2.1.268,重点强化了自托管网关的计费与访问控制能力,同时修掉了一个让第三方 Anthropic 兼容端点全部请求失败的高危回归问题。对依赖 Claude Code 做企业部署和 API 兼容接入的团队来说,这次更新更多是“止损+补管理能力”。

OpenAI 因新模型 Astra 需求过大,暂时关闭每月 200 美元的 Pro 订阅入口,以缓解算力压力。这是少见的“有钱也先别买”的供给端动作,说明顶级推理模型的算力瓶颈正在直接影响商业化节奏。

OpenAI 把支撑 Codex 的 Agent 工具链(业内常称为 Codex harness)封装成 Agents API 并进入公开测试,开发者一次 API 调用就能调用完整的代理执行能力,而不必自己搭建工具调度、执行循环和状态管理。

英伟达 CEO 黄仁勋在高盛科技会议上重申,公司下一财年营收有望同比增长约 70%,按分析师预期本财年约 4000 亿美元计算,明年营收可能逼近 6800 亿美元。这一判断的关键不是 GPU 卖得好,而是英伟达认为自己已经嵌入 AI 产业链的每一环。

NVIDIA 公布了面向生物分子推理的 BioNeMo Inference Runtime(BioIR),在 8 张 H100 上跑 Boltz-2 折叠模型时吞吐提升到 2.90 倍,达到每 GPU 小时 58.5K 残基。它说明 AI 蛋白质结构预测的竞争,正从“模型精度”转向“推理效率与单位算力产出”。

Redis 推出托管式语义缓存 LangCache,宣称最多可将 LLM API 调用成本降低 90%,缓存命中响应速度提升至 15 倍。它把「语义相似」而非「字面相同」作为复用判断标准,直指大模型应用最烧钱的一环。

Cursor 正式推出 Projects 功能,用一个“协调者智能体”调度数千个子智能体,处理功能开发、代码迁移这类跨月的大型工程任务。这是在把 AI 编程从“对话式结对”推向“指挥式外包”。

Anthropic 发布报告,指控阿里巴巴、月之暗面(Moonshot AI)和 DeepSeek 等中国 AI 公司对 Claude 发起大规模“蒸馏攻击”,试图套取模型推理过程来训练自家模型。这是目前公开披露的规模最大的一类模型能力窃取指控,涉及近 2 亿次交互。

OpenAI 于 2026 年 9 月 10 日推出 Agents API 公测版,把驱动 Codex 的智能体运行框架和托管基础设施开放给开发者,一次 API 调用即可创建可长时间运行的云端 agent。