讯飞星火 X2.5 正式发布:MoE 架构 293B,代码与智能体能力大幅提升

科大讯飞正式发布星火 X2.5 旗舰大模型,采用 MoE 架构、总参数量达 293B,重点强化代码生成和智能体能力,同时坚持全流程国产算力训练推理。这意味着国产大模型在高端能力上继续加码,代码与 Agent 赛道的竞争将更加直接。

一句话看懂:科大讯飞正式发布星火 X2.5 旗舰大模型,采用 MoE 架构、总参数量达 293B,重点强化代码生成和智能体能力,同时坚持全流程国产算力训练推理。这意味着国产大模型在高端能力上继续加码,代码与 Agent 赛道的竞争将更加直接。

事件核心:发生了什么

9 月 7 日,科大讯飞正式发布星火 X2.5 大模型。该模型采用 MoE(混合专家)架构,总参数量 293B,激活参数为 30B,官方口径中又称“293B-A30B”。相比前代,X2.5 将提升重点放在代码生成、智能体(Agent)能力上,同时继续强化数学、理解等通用能力。值得注意的是,星火 X2.5 的训练和推理过程均使用全国产算力完成,并在国产超长序列训练与推理场景上做了针对性优化。

目前该模型已在讯飞开放平台上线。在此之前,星火 X2.5 的端侧版本(4B 和 1.7B)已经先行开源,二者均支持最高 100 万 Tokens 的上下文窗口,可本地部署用于长文档处理、代码辅助和数据分析等场景。随着本次旗舰模型发布,讯飞在云端与端侧两条产品线都完成了新一轮版本布局。

为什么重要

星火 X2.5 的发布有两点信号意义。其一,代码与 Agent 能力成为各家旗舰模型的“必争之地”,讯飞选择在 X2.5 上重点投入,说明行业对模型能力评判标准正从单纯的聊天与写作转向可执行、可编程、可自主完成任务的复杂场景。其二,全流程国产算力训练与推理在 293B 参数规模上得以实现,这不仅是技术路线验证,也直接关系到未来政企市场、数据敏感行业在采购大模型时的合规性与可控性。

从竞争格局看,MoE 架构配合激活参数控制推理成本已是国内头部厂商的主流选择。星火 X2.5 的参数量级与架构方向表明,讯飞希望在高阶开发者工具和智能体平台层面与同类产品正面竞争,而不仅仅停留在通用对话助手层面。

对用户/开发者/创作者的影响

对开发者而言,星火 X2.5 的代码能力提升意味着可以通过讯飞开放平台调用相关 API,辅助完成代码生成、补全、解释和调试工作;MoE 架构下 30B 的激活参数也预示着推理成本可能相对可控。对需要处理长文档的企业用户,端侧开源的 4B 和 1.7B 模型支持百万级上下文,可以直接本地部署,适合内部知识库处理、会议纪要分析或代码仓库理解等数据敏感场景。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对普通用户来说,最直接的感知可能来自接入星火能力的办公助手、学习工具等应用在数学解题或复杂指令执行上的表现变化。而对依赖国产算力栈的行业客户而言,星火 X2.5 提供了又一个可选的高参数规模模型方案。

值得关注的后续

第一,星火 X2.5 旗舰模型的实际代码生成与 Agent 任务执行效果有待第三方基准测试验证。第二,目前公开信息显示,本次率先开源的是端侧小参数版本,旗舰级模型的开放方式、API 调用价格与开源计划尚未完全披露,值得关注其后续商业化定价。第三,国产算力训练在大规模 MoE 模型上的稳定性、吞吐效率是否具备持续迭代的产能基础,也是判断讯飞后续模型更新节奏的关键变量。竞品是否会在代码与 Agent 领域跟进类似定向强化,同样值得观察。

来源:AIbase

celebrityanime
celebrityanime
文章: 22177

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注