​DeepSeek 传闻将推 3 万亿参数 Code 2.0,剑指 GPT-6 Astra

据 AIbase 报道,DeepSeek 在发布 V4.1Flash 之后,业内传闻其将于 9 月推出参数规模超过 3 万亿的 DeepSeek Code2.0,主打“电脑控制”能力,性能目标直指前沿闭源模型。目前这些信息尚未获得官方完整确认。

一句话看懂:据 AIbase 报道,DeepSeek 在发布 V4.1Flash 之后,业内传闻其将于 9 月推出参数规模超过 3 万亿的 DeepSeek Code2.0,主打“电脑控制”能力,性能目标直指前沿闭源模型。目前这些信息尚未获得官方完整确认。

事件核心:发生了什么

据 AIbase 报道,DeepSeek 本周上线了 V4.1Flash,官方未变更版本号,但底层架构改动幅度被描述为达到 V5 级别;官方同时确认后续会推出 V4.1Pro 系列,具体升级细节尚未披露。考虑到 V4Pro-0813 最终版表现未达市场预期,业界对 Pro 系列保持理性观望。

更受关注的是传闻中的 DeepSeek Code2.0:定位于代码与逻辑任务,参数规模超过 3 万亿。作为参照,目前公开的高参数模型包括 K3 的 2.8 万亿、Qwen3.8Max 的 2.4 万亿,以及 DeepSeek V4Pro 的 1.6 万亿。若 V4.1Flash 的新结构确已实现参数翻倍,Code2.0 从 1.6 万亿跃升至 3 万亿在逻辑上有一定合理性。目前公开信息显示,该模型预计延续开源路线,设计重心转向“computer control”,即由 AI 代替用户自动操作电脑完成复杂任务,传闻性能可能超过 Mythos5.1 和 GPT-6Astra。

为什么重要

“电脑控制”意味着大模型竞争正从对话与代码补全,转向能够直接调用系统、操作软件、执行多步任务的智能体形态。这一方向对训练数据、推理成本和工具调用协议都提出更高要求,3 万亿参数级别的开源模型如果落地,会进一步抬高开源与闭源之间的参数与能力对标线。对行业而言,DeepSeek 同时在 V4.1Flash、V4.1Pro 和 Code2.0 上多线推进,说明其产品策略并非单点押注,而是覆盖通用推理与代码智能体两条路径。

对用户/开发者/创作者的影响

开发者最直接的利益点在于开源权重和 API 成本:若 Code2.0 延续开源传统,围绕代码生成、自动化脚本、测试与运维的二次开发空间会扩大,本地部署和微调的门槛可能随之下降。创作者和企业用户则需关注“电脑控制”类功能的实际开放程度——如果只能通过官方客户端调用而非 API,集成到现有工作流的难度会明显提高。算力层面,3 万亿参数模型的训练与推理成本不容小觑,服务定价和可用性将是决定其能否被广泛接入的关键。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 Code2.0 是否在 9 月如期发布,以及官方是否公开参数、评测与开源许可证细节;二是“电脑控制”能力以何种形式提供,是否开放 API 及是否涉及权限与合规限制;三是 V4.1Pro 的实际表现能否挽回 V4Pro-0813 的口碑,并影响市场对 Code2.0 性能传闻的信任度。在这些信息落地前,对其超越 Mythos5.1、GPT-6Astra 的说法,宜视为未经证实的行业传闻。

来源:AIbase

celebrityanime
celebrityanime
文章: 23340

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注