DeepSeek-V4-Flash正式版上线,130亿激活参数撬动Agent战场

DeepSeek于7月31日低调上线V4-Flash API正式版公测,以130亿激活参数在多项Agent基准测试中逼近甚至超过三个月前的V4-Pro预览版,并首次公开自研Agent框架DeepSeek Harness。这是DeepSeek用轻量模型切入Agent市场的明确信号。

一句话看懂:DeepSeek于7月31日低调上线V4-Flash API正式版公测,以130亿激活参数在多项Agent基准测试中逼近甚至超过三个月前的V4-Pro预览版,并首次公开自研Agent框架DeepSeek Harness。这是DeepSeek用轻量模型切入Agent市场的明确信号。

事件核心:发生了什么

7月31日,DeepSeek-V4-Flash API正式版面向公众开放测试。与以往“Pro强、Flash弱”的产品分层不同,这次Flash正式版在多个Agent基准测试中表现亮眼:Terminal Bench 2.1得分82.7,Cybergym得分76.7,Toolathlon verified得分70.3,已接近甚至超过三个月前的V4-Pro预览版。

官方信息显示,该模型总参数量为2840亿,但实际激活参数仅130亿,远低于V4-Pro的490亿激活参数。DeepSeek特别强调,此次升级“仅重新训练”,模型结构完全未变,性能提升来自训练方法和数据质量的优化。

同步公开的还有DeepSeek自研Agent框架DeepSeek Harness,这是该框架首次正式亮相。此外,V4-Flash原生支持OpenAI推动的Responses API格式,并为Codex做了专门适配,开发者可以将OpenAI生态中的Agent应用低成本迁移到DeepSeek平台。

为什么重要

这次更新的关键不在于单点性能提升,而在于它验证了一个判断:在模型结构不变的前提下,通过训练方法和数据质量的改进,轻量模型可以在特定任务上显著缩小与旗舰模型的差距。这对行业内“性能必须靠参数量堆出来”的惯性认知构成挑战。

更重要的是战略意图。Agent场景对推理速度和调用成本高度敏感,多轮任务中工具反复调用会迅速累积费用。V4-Flash的低激活参数意味着更低推理成本,这在大规模Agent应用中会形成明显的成本优势。DeepSeek选择在这个时间点把Flash推向正式版,并配套自研Agent框架和OpenAI兼容API,本质上是想用高性价比轻量模型撬动Agent应用市场,而不是继续在旗舰模型的参数竞赛中正面硬拼。

这次发布发生在DeepSeek完成超500亿元首轮融资、估值升至约710亿美元之后不到两个月,商业化提速的意图十分明显。

对用户/开发者/创作者的影响

对开发者而言,最直接的影响是迁移成本下降。V4-Flash原生支持Responses API格式并适配Codex,意味着原本跑在OpenAI生态上的Agent应用,不需要大规模重写即可切换模型,同时获得更低的调用成本。对于依赖多轮工具调用的Agent类产品,省下的推理费用会比较可观。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对企业用户来说,这意味着在构建Agent应用时多了一个高性价比的模型选项,尤其是对成本敏感的中长尾场景。

对普通用户和创作者,目前公开信息显示这次更新主要面向API和开发者场景,普通消费者端的变化仍需等待产品形态落地后才能体现。

值得关注的后续

有几个具体观察点值得跟进。第一,V4-Pro正式版何时发布,届时能否延续Flash正式版这种“重训提效”的路线,将决定DeepSeek旗舰模型的天花板。第二,V4-Flash正式版的定价策略是否会进一步压低Agent应用的推理成本,以及OpenAI、Anthropic等厂商是否会跟进类似的轻量Agent模型路线。第三,DeepSeek Harness框架的开放程度和生态建设情况——它是仅服务自家模型,还是计划向外部模型开放,会直接影响DeepSeek在Agent基础设施领域的实际份额。

来源:AIbase

celebrityanime
celebrityanime
文章: 16224

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注