一句话看懂:DeepSeek 把原来的快速模式、专家模式和图像识别模式合并成一个统一智能模式,不再需要手动切换;同时 V4.1 Flash 最快于 2026 年 9 月 10 日发布,并将在 9 月 14 日 12:00 正式替代 V4 Pro,后者按 V4.1 Flash 价格计费。
事件核心:发生了什么
据 AIbase 消息,DeepSeek 宣布将原有的三种使用模式整合为统一的智能模式:系统会自动判断用户提问的复杂度,检测到图片输入时自动启用视觉能力,并依据任务难度调整推理算力,用户无需再手动切换。此前,多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 已在 DeepSeek API 平台上线,支持 Chat Completions、Messages、Responses 三种调用格式。
模型迭代方面,DeepSeek 计划在 2026 年 9 月 10 日前后正式发布 V4.1 Flash。经内外部测试,它在性能、成本、速度、总耗时等指标上全面超过 V4 Pro。V4 Pro 服务将于 2026 年 9 月 14 日 12:00 下线,届时请求会路由到 V4.1 Flash,并按后者的价格计费。价格上,Flash 系列自 9 月 10 日 12:00 起调整:低峰时段输入缓存命中 0.02 元、缓存未命中 1 元、输出 4 元,高峰时段为低峰的两倍。
为什么重要
把三种模式收进一个自动路由的入口,实质是把“选模型”的决策成本从用户侧转移到平台侧。对大模型产品来说,这意味着竞争重点不只是单点跑分,而是如何用统一的推理调度同时覆盖轻量问答、复杂推理和视觉理解,从而压低整体成本。V4.1 Flash 在多维度全面优于 V4 Pro,且采用新的模型结构、原生支持多模态,说明 DeepSeek 在推理效率和架构上做了取舍。旧模型直接退役而非长期并行,也反映出闭源 API 服务快速迭代、压低运维成本的思路。
对用户/开发者/创作者的影响
普通用户最直接的变化是不用再纠结模式选择,上传图片即可获得视觉理解,交互更接近通用助手。开发者需要留意 API 侧的迁移节奏:V4 Pro 下线后调用会被自动路由,计费口径切换到 V4.1 Flash,低峰与高峰的价差可能影响批量任务和批处理的调度策略。对内容创作者而言,原生多模态和更低价格意味着图文混合的 AI 应用调用成本下降,但是否适合生产环境,还要看 V4.1 Flash 的实际稳定性和视觉精度。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是 V4.1 Flash 正式发布后的实测表现,是否与官方“全面超越 V4 Pro”的表述一致;二是缓存命中价 0.02 元能否在真实业务中兑现,这会直接影响开发者的成本模型;三是 9 月 14 日 V4 Pro 下线后,路由计费和调用稳定性是否平滑过渡,以及竞品是否会跟进类似的模式合并与降价策略。目前公开信息显示,上述时间点和价格均来自 DeepSeek 官方沟通渠道。
来源:AIbase


