一句话看懂:DeepSeek 于 7 月 31 日发布 V4 Flash——一款 284B 总参数、仅激活 13B 的 MoE 架构模型,在多项 Agent 基准上超越自家旗舰,API 价格仅为 GPT-5.5 的约 1/35,把“高性能 + 极低成本”的组合推向新边界。
事件核心:发生了什么
V4 Flash 是 DeepSeek V4 系列的轻量化版本,采用混合专家架构,总参数 284B,推理时仅激活 13B,支持 100 万 token 上下文。官方数据显示:Terminal-Bench 2.1 得分 82.7,DeepSWE 软件工程基准 54.4,较 V4-Pro-Preview 提升约 645%;Toolathlon 70.3 是目前唯一明确经过第三方验证的成绩。API 定价输入 $0.14/M、输出 $0.28/M,同期 GPT-5.5 为 $5/M 输入、$30/M 输出,Claude Opus 4.7 高达 $15/M 输入。需要注意的是,除 Toolathlon 外,多数基准分数来自 DeepSeek 自报,尚未被独立复现。
为什么重要
首先是



