[分享创造] DeepSeek 今晚零点涨价:缓存命中率越高,账单涨得越狠(650 次请求实测,已与官方账单对账)

DeepSeek 今晚零点调整 v4-pro API 价格,实测数据显示,缓存命中率越高的用户,账单涨幅越大——98% 命中率的典型 Agent 负载涨价至原来的 2.7 倍,而零命中负载反而只涨 1.5 倍。

一句话看懂:DeepSeek 今晚零点调整 v4-pro API 价格,实测数据显示,缓存命中率越高的用户,账单涨幅越大——98% 命中率的典型 Agent 负载涨价至原来的 2.7 倍,而零命中负载反而只涨 1.5 倍。

事件核心:发生了什么

据 V2EX 用户基于本地日志的 650 次请求、16 个会话实测,DeepSeek v4-pro 新价格体系将在今晚零点生效。该用户按新价重算后发现:缓存命中率 98.09% 的负载,账单变为原来的 2.7 倍;同样的 token 量若零缓存命中,反而只涨 1.5 倍。

原因在于三档价格并非同比例上调。官方口径中“输出涨 2.3 倍”是显眼的变化,但实际涨幅最猛的是原本最便宜的缓存命中档。旧价目表对高命中率用户极度友好,这一轮调价后折扣力度大幅收窄,因此存量受益最大的开发者受伤最深。

该测试者已将费用与 DeepSeek 控制台账单对账:花费差额 2%、token 差额 2%,差异来自本地日志漏记的 34 次请求(含已删除会话和失败重试),可视为真实涨幅的下限。

为什么重要

这次调价反映出大模型推理定价的一个关键转变:从“鼓励缓存、降低算力成本”转向“精准区分付费能力”。缓存命中率是决定 API 成本的核心变量,旧价格体系相当于把高复用负载的成本补贴给零散请求;新体系则让高确定性、高频复用的 Agent 流量承担更接近其实际推理负载的价格。

按 UTC 划分峰谷时段、中国工作日早九点到晚六点几乎全部落在高峰价区间,也意味着 DeepSeek 的价格策略更贴近全球算力调度逻辑,而非中国开发者的使用习惯。对于正在将 DeepSeek 接入生产环境的团队来说,这是一次需要重新测算 unit economics(单位经济性)的变动,也提醒开发者审视对单一模型定价的依赖度。

对用户/开发者/创作者的影响

影响最直接的是使用 DeepSeek v4-pro 构建 Agent、批量任务流水线或高复用工具链的开发者。缓存命中率是这类负载的常态指标,若不调整调用策略,月账单可能接近翻倍。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

短期内最实用的对冲方式是“错峰”运行:新价下北京时间的夜间为半价时段,能延迟执行的批量任务(数据清洗、日志处理、批量内容生成、离线评测)尽量挪到 01:00-08:00 或 18:00 之后,不改代码就能省一半成本。

可以考虑调整缓存策略:降低 KV cache 依赖、主动重置会话以缩短缓存窗口,按零命中负载重新估算成本,避免下一轮调价再次击中高命中率用户。对普通创作者而言,如果只是低频使用交互式对话或单篇内容生成,缓存命中率通常不高,本次实际支出增长可能小于 1.5 倍,短期内无需过度焦虑。

值得关注的后续

几个具体观察点:第一,DeepSeek 官方是否会发布正式调价说明或补充阶梯计费方案,以缓解高命中率用户的不满;第二,其他国产和海外大模型 API 是否会跟进类似“缓存越省、单价越贵”的梯度定价,形成行业性调整;第三,这一价格变动是否会影响开发者对 DeepSeek 开源生态的采用意愿,尤其是将它作为本地推理替代方案的团队。

目前公开信息显示,价格调整尚未触发官方渠道以外的政策回应,后续影响仍以实际账单变化为准。

来源:V2EX (创意工作者社区)

celebrityanime
celebrityanime
文章: 18661

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注