一句话看懂:DeepSeek 计划于 2026 年 9 月 10 日调整 Flash 系列定价,并可能将 v4.1 Flash 作为 v4 Pro 的默认替代模型提供服务,引发开发者对 API 模型“被静默更换”的广泛不满。
事件核心:发生了什么
DeepSeek 宣布自北京时间 2026 年 9 月 10 日 12:00 起调整 Flash 系列模型价格。新定价显示,非高峰时段输入缓存命中单价为 0.003 美元,未命中为 0.15 美元,输出价格为 0.6 美元;高峰时段价格翻倍。更令开发者警觉的是,公告暗示 v4.1 Flash 版本性能优于 v4 Pro,但价格更低,可能被用作 v4 Pro 的默认升级路径。多位开发者在 Hacker News 上指出,DeepSeek 似乎计划将 v4 Pro 用户直接切换到 v4.1 Flash,而非保留旧模型供用户自行迁移。
为什么重要
这次争议的核心不是价格,而是 API 服务的“确定性”问题。开发者表示,在 v4 Pro 上验证过的系统提示词、内容安全规则和工作流,一旦底层模型被替换为 v4.1 Flash,输出分布必然改变。对于教育、医疗等受监管行业,每次模型更换都需重新进行内容安全审查和回归测试。DeepSeek V4 论文明确追求“端到端、逐位 batch-invariant、确定性内核”,说明技术层面具备一致输出能力,但供应商是否配置同样的推理逻辑并不受控。这件事暴露了开源权重模型与云 API 服务之间的根本张力:即使权重开源,第三方托管的可用性仍需依赖提供商策略。有评论者指出,这本质上与 Anthropic 等闭源厂商调整模型的行为没有区别,只不过 DeepSeek 的开源属性让用户对“连续性”有了更高预期。
对用户/开发者/创作者的影响
对于依赖 API 的开发者而言,这意味着需要重新评估“模型即服务”的可靠性——任何单一云厂商都可能在你未授权的情况下调整后端模型。如果企业已有系统提示词依赖于 v4 Pro 的特定行为模式,v4.1 Flash 的潜在替换可能直接改变输出质量。对于有严格合规要求的团队,唯一规避方案是自行托管开源权重模型,或采用按硬件付费而非按 API 调用的远程托管方式。对于普通创作者和轻量用户,Flash 系列降价则是明确利好:非高峰时段输入缓存命中低至 0.003 美元,意味着大规模批处理任务的成本显著下降。但如果你正在构建稳定的产品功能,建议在架构中将模型版本作为显式参数锁定,而不是依赖供应商的默认指向。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
首先是 DeepSeek 是否会调整迁移策略。社区声音普遍认为,若 v4 Pro 用户在未确认的情况下被切到 v4.1 Flash,而不是给出明确弃用周期并保留旧版本接口,将加速开发者流向 Together.ai、OpenRouter 等第三方托管渠道。其次,观察 DeepSeek 是否会对“确定性”诉求作出具体承诺,例如允许用户选择特定权重快照或提供行为对账机制。最后,竞品定价策略也可能随之变化:Flash 系列的降价幅度如果确实覆盖多数推理场景,或迫使其他开源模型厂商跟进更激进的定价体系。


