一句话看懂:DeepSeek 于 7 月 31 日发布并开源了新模型 DeepSeek V4 Flash 0731,在 Artificial Analysis 智能指数上拿下 50 分,进入开源模型前三,且采用 MIT 许可,允许自由商用和修改。
事件核心:发生了什么
据 Artificial Analysis 在 X 平台发布的消息,DeepSeek 已正式开放 DeepSeek V4 Flash 0731 的模型权重。这是一个新的 flash 系列模型,在 Artificial Analysis Intelligence Index 上得分为 50,位列当前开源权重模型排行榜前三。模型以 MIT 许可证发布,意味着无论商业使用还是二次修改都没有额外限制。
从技术规格上看,DeepSeek V4 Flash 0731 与此前推出的 DeepSeek V4 Flash 共享完全相同的架构和定价。模型总参数量为 284B,但激活参数仅 13B,属于典型的稀疏激活架构。权重以 FP4/FP8 混合精度发布,总体积约为 167GB。在“智能指数 vs 总参数量”的效率对比中,该模型进入了 Artificial Analysis 的帕累托前沿。目前,DeepSeek 第一方 API 也已同步上线该模型。
为什么重要
这次发布的看点不在于又一个大参数模型,而在于效率和开源策略。
284B 总参数、13B 激活、FP4/FP8 混合精度、167GB 文件体积——这几个数字组合在一起,指向一个明确信号:模型能力的竞争正在从“堆参数”转向“压推理成本”。低精度量化与 MoE 稀疏激活的组合,让开源模型在接近闭源模型智能水平的同时,把部署门槛和单次调用成本大幅压低。
MIT 许可同样关键。相比带有商用限制的社区许可,MIT 意味着企业可以没有任何法律顾虑地把模型接进生产环境,甚至修改后闭源商用。这会让 DeepSeek 在开源生态里获得更大的开发者采用面,也给闭源 API 厂商带来了更直接的价格和性能压力。
对用户/开发者/创作者的影响
对开发者而言,167GB 的模型文件配合 13B 激活参数,意味着在单张高端 GPU 上做推理成为可能,自部署门槛比同级别稠密模型低很多。MIT 许可也让企业可以直接基于这个模型做微调、蒸馏甚至二次分发,无需走复杂的授权流程。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对普通用户来说,DeepSeek 第一方 API 已经上线该模型,且定价与原先的 V4 Flash 保持一致,意味着可以用同样的价格获得更强的模型能力,长文本处理、代码生成等任务的体验会有所提升。
对创作者而言,这个模型在同等参数规模下实现了显著的智能度跃升,对于需要批量处理内容、构建自动化写作或分析管线的场景,是一个值得测试的高性价比选项。不过目前公开信息显示,该模型主要面向文本与推理任务,并未涉及图像生成能力。
值得关注的后续
接下来有几个具体观察点:一是该模型的 API 定价是否会在后续出现调整,以及第三方推理服务商是否快速跟进上架;二是其他开源大模型团队是否会针对这一效率路线做出回应,比如推出同等稀疏度或更低精度的版本;三是 DeepSeek 是否会基于该架构继续迭代出更大规模的完整版模型,进一步拉高开源模型的天花板。


