中国大模型周调用量达67.46万亿Token,连续21周领先美国

OpenRouter 最新周度数据显示,9 月 14 日至 20 日中国大模型周调用量达 67.46 万亿 Token,连续第 21 周超过美国;同期美国为 14.21 万亿 Token,环比下降 34.7%。值得关注的是,这一优势主要由国产模型的密集迭代与价格下探支撑。

一句话看懂:OpenRouter 最新周度数据显示,9 月 14 日至 20 日中国大模型周调用量达 67.46 万亿 Token,连续第 21 周超过美国;同期美国为 14.21 万亿 Token,环比下降 34.7%。值得关注的是,这一优势主要由国产模型的密集迭代与价格下探支撑。

事件核心:发生了什么

根据 OpenRouter 统计,上周全球 AI 大模型总调用量为 129 万亿 Token,环比增长 1.57%。其中中国大模型周调用量 67.46 万亿 Token,环比增长 10.28%;美国大模型为 14.21 万亿 Token,环比下降 34.7%。

全球调用量前五名中,中国模型占据四席。9 月 10 日发布的 DeepSeek V4.1-Flash 以 15.8 万亿 Token 排名第一,环比增长 219%,主打编码、Agent 与多模态理解能力,采用 Causal-Encoder-Decoder 架构,全局 KV Cache 降至 V4-Flash 的约四分之一;其空闲时段每百万 Token 的缓存命中输入、未命中输入与输出价格分别为 0.02 元、1 元、4 元,较上一代下降 60%、33.3% 和 11.1%。Zhipu GLM5.3Flash 以 14.1 万亿 Token 排名第二,腾讯混元 Hy4preview 以 12.5 万亿 Token 排名第三,DeepSeek-V4-Flash-0731 以 9.44 万亿 Token 排名第五。

为什么重要

调用量是衡量模型实际使用强度的直接指标,比单纯的榜单分数更接近真实生态。中国模型连续 21 周领先,说明在开发者调用层面已经形成规模效应。不过需要区分“调用量”和“任务成本”:Artificial Analysis 测试显示,V4.1-Flash 单任务平均输出约 8.9 万 Token,高于 V4Flash0731 的 6.2 万 Token,被评价为输出偏冗长。这意味着单价下降未必直接带来单任务总成本同步下降,厂商在推理效率和输出控制上仍有优化空间。

另外,美国模型周调用量出现较大幅度环比回落,目前公开信息未给出具体原因,可能与模型版本切换、评测口径或统计周期有关,不宜直接解读为需求萎缩。

对用户/开发者/创作者的影响

对开发者而言,头部国产模型的 API 价格竞争仍在持续,缓存命中价格低至每百万 Token 0.02 元,适合高频调用场景,例如 Agent 工作流、代码补全和批量内容处理。但接入前建议实测单任务总消耗,避免因输出冗长抵消单价优势。对创作者和企业采购来说,多模型并行、按任务分配调用成本的策略会比绑定单一模型更稳妥;国产模型在多模态理解和中文场景上的可用性正在提升,可作为主力或备份选项。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 DeepSeek V4.1-Flash 的高增长能否延续,以及输出长度问题是否会在后续版本中调整;二是智谱、腾讯等厂商是否跟进价格或架构优化,进一步拉动调用量;三是美国模型调用量回落是短期波动还是趋势性变化,需要观察未来两到三周的 OpenRouter 数据。

来源:AIbase

celebrityanime
celebrityanime
文章: 24703

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注