DeepSeek 高峰/非高峰定价更新

DeepSeek 为 V4-Flash 和 V4-Pro 引入高峰/非高峰分时定价,非高峰时段价格下调,但高峰时段价格大幅上浮,对欧美用户而言相当于变相涨约 2 倍。这标志着大模型 API 定价从“统一价”走向“分时计价”的新阶段。

一句话看懂:DeepSeek 为 V4-Flash 和 V4-Pro 引入高峰/非高峰分时定价,非高峰时段价格下调,但高峰时段价格大幅上浮,对欧美用户而言相当于变相涨约 2 倍。这标志着大模型 API 定价从“统一价”走向“分时计价”的新阶段。

事件核心:发生了什么

DeepSeek 更新了 API 定价策略,按中国市场的峰谷时段进行差异化收费。以 DeepSeek-V4-Flash 为例,非高峰时段缓存命中约 $0.007、缓存未命中约 $0.22、输出约 $0.66;而高峰时段分别上浮约 2.5 倍、1.5 倍和 2.25 倍。V4-Pro 模型同样执行高峰 x2 左右的计费规则。Hacker News 上有用户直接测算,对于欧洲和美国的开发者来说,由于工作时区与高峰时段重叠,实际支付金额接近翻倍。另有评论指出,这一政策由一个“不理解 LLM 工作原理”的人起草,但也有人认为这不过是 GPU 生命周期管理下的定价策略——硬件有有限的服务寿命,服务商必须让算力 24×7 保持运转,才能摊薄成本。

为什么重要

这次调整折射出 AI 算力商业化正在转向更精细的时段管理。过去一年,大模型 API 价格一路走低,但底层 GPU 成本依然高昂。据网友在讨论中引用,字节跳动今年 CapEx 高达 $700 亿,大部分投向马来西亚、泰国、巴西等海外地区,且可合法租赁 NVIDIA 芯片。如此庞大的算力投入,注定服务商不能忍受空闲的 GPU。分时定价本质上是在用价格杠杆引导开发者把推理任务挪到非高峰时段,从而抬升算力利用率和收入。与此同时,模型权重开源让用户保有退出通道——只要还有第三方托管商提供旧版本,用户就可以避开官方定价变动。OenRouter 等服务商已接入 DeepSeek 模型,说明这种生态缓冲是真实存在的。

对用户/开发者/创作者的影响

对 API 开发者来说,成本模型从“单价 x 用量”变成了“单价 x 用量 x 时段系数”,需要重新评估缓存策略和批处理任务的时间窗口。欧美开发者受到的影响比亚洲用户更明显,因为高峰时段恰好对应欧美工作日,原本的低价红利被大幅压缩。有用户在评论区表达了对 AI 产品频繁改价和调整使用模式的疲惫——两个月内价格和最优调用方式变了数次,这种不稳定性正在消耗信任。不过也有声音提醒,行业的终局可能是“底价趋近于零、无限量订阅制”,细粒度 token 计费未必是最终形态。对普通 C 端用户而言,这次调整暂时不影响聊天产品,但对依赖 API 的中小团队,建议关注缓存命中率优化与错峰调度。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是其他国产大模型如 GLM、豆包是否跟进分时定价,若跟进则意味着行业默认新规则成立;二是 DeepSeek 是否会在海外节点采用不同计费策略,以缓解欧美用户的涨价感受;三是开源模型生态能否持续充当“价格缓冲垫”,让开发者用脚投票。目前公开信息显示,讨论中有人提到 GLM 已更新至 5.3,说明模型迭代节奏依然很快,新的价格优势可能随时出现。

来源:hackernews

celebrityanime
celebrityanime
文章: 18435

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注