OpenAI 推出新版 Codex Cloud,Agents API 开放预览并支持 computer use

OpenAI 推出升级版 Codex Cloud,并把支撑其全部云端代理(包括 dots)的 Agents API 开放预览,且支持 computer use。这意味着开发者可以直接调用与 OpenAI 自有产品相同的代理技术。

OpenAI 推出升级版 Codex Cloud,并把支撑其全部云端代理(包括 dots)的 Agents API 开放预览,且支持 computer use。这意味着开发者可以直接调用与 OpenAI 自有产品相同的代理技术。

三星、SK 海力士、美光等存储原厂正通过更长周期、更大规模的长期协议把产能优先锁定给数据中心客户,导致消费级内存与 SSD 供应被大幅挤占,过去一年价格成倍上涨。这意味着 AI 算力扩张的成本,正在以硬件涨价的形式转嫁给普通 PC 用户、开发者和创作者。

Anthropic 与 SpaceX 签署了一份最高可达 845 亿美元的算力租用协议,租用后者 Colossus 数据中心内的英伟达 GPU,但 Anthropic 只需提前 90 天通知就能解约。这份合同把两家正在筹备 IPO 的公司绑在了一起,也暴露出大模型公司对算力的长期重资产押注。

美国硅谷选区民主党众议员 Ro Khanna 正准备提交《人类控制 AI 法案》,要求 AI 模型在政府审查和监管机构批准之前,不得进行递归式自我改进,也不得自行改写核心目标、抑制机制或关机控制。这是目前针对前沿模型自治能力最直接的一类立法尝试。

OpenAI 与 AWS 达成战略合作,用 AWS 基础设施运行托管 AI 智能体(hosted agents),同时把 ChatGPT 全面接入 Slack 和 Microsoft Teams,并推出每月 500 美元的 Pro 顶配套餐。

Business Insider 汇总了美国多个已开工的超大型 AI 数据中心项目,单体容量普遍达到 1 吉瓦以上,最大项目规划容量高达 17 吉瓦。这些设施将直接决定未来几年大模型训练和推理的算力上限,也会给当地电网和社区带来现实压力。

开发者 lostmsu 在 Hacker News 发布 TurboGPT,用 13 秒训练出一个体积仅 22KiB 的 transformer 模型,定位是受 minGPT 启发的家庭实验项目。它本身的实用价值有限,但把“模型体积”重新推到讨论中心,也再次引发了对这类极小型 GPT 复现项目的必要性争论。

一个名为 TurboGPT 的开源项目,用纯 CUDA C++ 实现了字节级微型 GPT 的训练流程,在 13 秒内完成 22KiB 模型的训练,代码以 MIT 协议开放。它更像是一份“从零手写大模型训练管线”的教学级实现,而非可直接商用的产品。

贝恩公司提出,当前的数据中心投资热潮需要 AI 业务每年产生约 6 万亿美元收入才能被合理支撑,而这一数字远高于多数人对 AI 商业化速度的预期。值得关注的是,争论的焦点已从“模型能不能用”转向“这些算力到底由谁来买单”。

推理服务商 Baseten 与 OpenAI 达成合作,OpenAI 企业客户可以直接把已有的消费承诺,用于 Baseten 托管的开源模型,并在 Codex 或 Responses API 中调用。这意味着企业买 OpenAI 的额度,不再只能换闭源模型,也可以换成开源模型的推理算力。