AI 正成为 AI 的最大客户,OpenRouter 上智能体 Token 用量飙升 14 倍

OpenRouter 平台数据显示,AI 智能体消耗的 Token 量在半年内增长约 14 倍,并可能已在 2026 年 2 月超越人类用户。智能体正在成为 AI 算力消耗的主要来源,但缓存机制降低了实际成本增速。

OpenRouter 平台数据显示,AI 智能体消耗的 Token 量在半年内增长约 14 倍,并可能已在 2026 年 2 月超越人类用户。智能体正在成为 AI 算力消耗的主要来源,但缓存机制降低了实际成本增速。

Palantir CEO Alex Karp再度公开批评OpenAI与Anthropic等前沿AI实验室,认为企业不应在调用大模型时被迫交出数据与知识产权,并主张企业应拥有可控的模型与基础设施。

美国共和党参议院竞选委员会(NRSC)私下向头部 AI 公司发出警告,指出数据中心正在成为选举中的“政治负资产”,俄亥俄州一场关键参议院选举可能成为转折点——如果亲数据中心的候选人落败,全美各地立法者可能对新建算力设施“避而远之”。

根据 Ramp 的数据,Anthropic 于今年 6 月发布的 Fable 5 模型,在企业客户中的 API 调用支出占比已稳定在约 11%,且被更新的 Opus 5 反超。这反映出企业正在从追求“最强模型”转向优先考虑成本效益,顶级模型的生命周期明显缩短。

Hacker News 上一场关于“是否应赋予 AI 智能体法律人格”的争论,暴露了当前 AI 治理的一个关键盲区——我们正在用“人”的框架去理解工具,却忽略了真正应该讨论的是责任归属与权利边界。

尽管 Anthropic 的顶级模型 Opus 5 在能力上被视为“过剩”,但 HN 社区讨论显示,多数用户在实际工作流中更青睐廉价、稳定且够用的模型(如 Fable 或 Ox Alpha),反映 AI 应用正从“拼参数”转向“拼性价比”。

法律科技公司 Harvey 发布新模型 Harvey Tenet,基于 Moonshot AI 的 Kimi K3 进行后训练,目标是支撑长时程、多步骤的法律 Agent 工作。这是垂直行业模型与通用大模型路线的一次直接碰撞,也意味着法律 AI 的竞争开始从“会问答”转向“能干活”。

OpenAI 的 Codex 已经从单纯的代码生成工具演变为可执行任务的 AI Agent,但多数新用户卡在界面逻辑和功能选择上。这篇社区长文教程梳理了 Codex 的项目、任务、权限和扩展能力,帮助开发者避免把 Agent 当成普通聊天机器人来用。

一份关于 OpenAI Codex CLI 斜杠命令的完整指南在社区流传,系统梳理了 /model 、 /fast 、 /personality 等命令的真实用法,核心观点是:提示词负责“做什么”,斜杠命令负责“怎么工作”,两者不应混淆。

Anthropic 正式上线了由社区贡献的 Claude 插件市场,所有插件已通过安全扫描并经过官方审核,标志着 Claude 的插件生态从官方自营走向开放共建。