DeepSeek 再度调价;英伟达AI服务器涨价超 15%;“AI红娘”承诺三年不结婚就退款,前 Kimi搜索负责人创业目标:拉高10%结婚率 | AI周报

DeepSeek 再次调整 API 峰谷定价,周末统一执行低谷价以分流算力压力;同时英伟达 AI 服务器因内存成本上涨将提价超 15%,大模型算力成本正在产业链上下游同步传导。

一句话看懂:DeepSeek 再次调整 API 峰谷定价,周末统一执行低谷价以分流算力压力;同时英伟达 AI 服务器因内存成本上涨将提价超 15%,大模型算力成本正在产业链上下游同步传导。

事件核心:发生了什么

DeepSeek 宣布自 2026 年 8 月 23 日起调整 API 峰谷计费规则,周六、周日全天统一按低谷时段价格收费,工作日峰谷价格维持不变。此前 8 月 17 日 DeepSeek 已引入峰谷定价,旗舰模型 V4 Pro 在高峰时段输入价格(缓存未命中)为每百万 tokens 9 元,涨幅 200%,输出价格 27 元,涨幅 350%;空闲时段价格则为高峰时段的一半。此次调整后,周末调用成本将明显下降。

同周,OpenAI 宣布未来三个月将 GPT-5.6 Sol 的 API 与 Credit 调用价格下调 20% 以上,输入从每百万 tokens 5 美元降至 4 美元,输出从 30 美元降至 20 美元。但大量 Codex 用户发现周额度被大幅削减,官方回应称未主动调整额度,部分异常与缓存命中率下降有关。

硬件层面,据彭博社报道,英伟达已告知部分大客户,搭载其 AI 芯片的服务器价格将上涨超 15%,主要源于内存芯片(HBM)成本大幅提升,涨价将从明年初出货的系统开始生效,涉及 Vera Rubin 和 Grace Blackwell 等旗舰产品。

为什么重要

DeepSeek 的峰谷定价调整说明国产大模型厂商已开始用市场化手段管理算力资源:通过价格杠杆引导开发者错峰调用,缓解日间计算拥堵。这种定价模式如果被更多厂商采用,将改变开发者的任务调度习惯和成本结构。

英伟达服务器涨价则揭示了 AI 产业链的利润分配变化。即便英伟达在 AI 芯片市场占据主导地位,也无法消化内存芯片涨价压力,说明 HBM 供应商(三星、SK 海力士、美光)的议价能力正在上升。对云厂商和企业客户而言,GPU 算力的采购成本将进一步提高,并可能传导至下游 API 价格。

OpenAI 同时降价和缩减额度的操作,反映出头部模型厂商在用户规模扩大后,正试图平衡算力消耗与商业收益,但沟通方式引发了社区信任问题。

对用户/开发者/创作者的影响

开发者:如果工作负载可以安排在周末运行,DeepSeek API 的调用成本将明显降低;反之,高峰时段的费用已大幅上调,需要评估任务是否值得错峰执行。对于批量推理、数据清洗等非实时任务,建议利用低谷时段降低成本。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

企业采购方:英伟达 AI 服务器涨价超 15% 将直接推高自建或托管 GPU 集群的硬件成本,涉及明年初下单或续约的客户需提前预算。若成本压力传导至云厂商,下半年大模型 API 价格可能不再延续此前的降价趋势。

Codex 用户:额度缩水问题尚未完全解释清楚,重度用户应密切关注自己的用量统计,并在官方进一步说明前合理规划额度使用。

值得关注的后续

1. DeepSeek 峰谷定价是否会被其他国产大模型厂商跟进,以及周末低价能否持续拉高非高峰时段的利用率。

2. 英伟达服务器涨价的幅度和生效范围是否进一步扩大,云厂商是否会相应调整 GPU 实例的租赁价格。

3. OpenAI 对 Codex 额度争议的后续解释是否到位,以及 GPT-5.6 Sol 降价后 API 调用量是否出现显著增长。

来源:InfoQ CN

celebrityanime
celebrityanime
文章: 19912

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注