未来变量 | 深度研报 🎯 核心结论 **284B 参数的模型,只需 $0.14/M 输入、$0.28/M 输出,就能在 9 项 Agent 基准测试中全面击败自家 1.6T 参数的旗舰——DeepSeek V4 Flash 凭什么重新定义 AI 成本与性能的边界?** > 📌 这不是又一个”性能差不多但更便宜”的模型。这是 2026 年 7 月 31 日刚刚发布的、在 DeepSWE 基准上暴涨 645%、终端任务准确率 82.7%…

DeepSeek 于 7 月 31 日发布 V4 Flash——一款 284B 总参数、仅激活 13B 的 MoE 架构模型,在多项 Agent 基准上超越自家旗舰,API 价格仅为 GPT-5.5 的约 1/35,把“高性能 + 极低成本”的组合推向新边界。

一句话看懂:DeepSeek 于 7 月 31 日发布 V4 Flash——一款 284B 总参数、仅激活 13B 的 MoE 架构模型,在多项 Agent 基准上超越自家旗舰,API 价格仅为 GPT-5.5 的约 1/35,把“高性能 + 极低成本”的组合推向新边界。

事件核心:发生了什么

V4 Flash 是 DeepSeek V4 系列的轻量化版本,采用混合专家架构,总参数 284B,推理时仅激活 13B,支持 100 万 token 上下文。官方数据显示:Terminal-Bench 2.1 得分 82.7,DeepSWE 软件工程基准 54.4,较 V4-Pro-Preview 提升约 645%;Toolathlon 70.3 是目前唯一明确经过第三方验证的成绩。API 定价输入 $0.14/M、输出 $0.28/M,同期 GPT-5.5 为 $5/M 输入、$30/M 输出,Claude Opus 4.7 高达 $15/M 输入。需要注意的是,除 Toolathlon 外,多数基准分数来自 DeepSeek 自报,尚未被独立复现。

为什么重要

首先是

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

celebrityanime
celebrityanime
文章: 16340

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注