一句话看懂:DeepSeek 正式发布 DeepSeek-V4-Pro,升级 Agent 能力并原生支持 OpenAI Responses API,同时推出峰谷电价:非高峰时段 API 价格直降 50%,把算力成本压力转化为价格杠杆,值得开发者重点关注。
事件核心:发生了什么
DeepSeek 于 2026 年 8 月宣布 DeepSeek-V4-Pro 正式 GA(General Availability),新模型主打生产级 Agent 工作负载。V4-Pro 在 App/Web 端以“Expert Mode”上线,API 同步开放,模型名称保持不变。此次更新有三个可核查的关键点:一是为 V4-Pro 和 V4-Flash 引入分档推理力度(reasoning effort),低档处理简单任务,高档应对复杂 Agent 流程;二是原生支持 OpenAI Responses API,并为 Codex 做了兼容优化,可一键配置;三是 API 定价改为峰谷电价模式,非高峰时段价格比高峰低 50%,新价格于 2026 年 8 月 16 日 16:00 UTC 生效。
为什么重要
峰谷电价在大模型 API 定价中并不常见。它本质上是用价格信号引导开发者把可延迟的推理任务(如批量数据处理、夜间评测、测试回放)挪到算力空闲时段,帮助服务方平抑算力潮汐,同时降低开发者的推理成本。配合三档 reasoning effort,开发者可以根据任务复杂度精细控制推理开销——这是大模型商业化从“按 token 计费”走向“按算力负载计费”的一次试水。原生兼容 OpenAI Responses API 则表明,DeepSeek 的竞争策略不止于模型能力,也在对接既有开发者生态,尽量降低迁移成本。
对用户/开发者/创作者的影响
普通用户可以直接在 App/Web 的 Expert Mode 中选择 V4-Pro 体验新模型,不需要额外配置。开发者是最直接的受益者:原本基于 OpenAI API 的代码可以较低成本切换到 DeepSeek,Codex 用户也能快速适配;API 模型名称不变,意味着现有集成无需改代码。配合非高峰 50% 折扣,适合把大批量推理任务集中到低峰时段执行。创作者如果使用 Agent 类工具链,V4-Pro 的高推理档位在处理多步骤任务时会更稳定,但近期来看,价格变化对创作类工作流的影响小于对工程类任务的影响。目前公开信息显示,V4-Flash 的具体定价尚未披露。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
后续可以观察三点:一是 V4-Flash 的定价与峰值/非峰值规则是否与 V4-Pro 保持一致,这将决定开发者是否会把混合模型调度纳入成本策略;二是峰谷电价是否会引发其他大模型 API 服务商跟进,形成行业性的“错峰定价”趋势;三是推理力度分档在实际 Agent 场景中的效果,是否会出现低档输出质量波动、高档响应延迟拉长等需要开发者权衡的情况。


