一句话看懂:科大讯飞将于9月1日开源两款星火X2.5边缘侧大模型(4B和1.7B),并于9月7日发布293B参数的基础版X2.5。这次密集动作的重点在于边缘端部署与国产算力适配,而非单纯比拼参数规模。
事件核心:发生了什么
据科大讯飞官方公告,9月1日将正式开源星火X2.5-4B和星火X2.5-1.7B两款边缘侧通用大模型,两者原生支持最高100万token的上下文窗口,官方称在智能体交互、数学计算和基础通用理解等核心维度上有明显提升,目标场景包括车载终端、智能硬件和万物互联设备。随后在9月7日,讯飞计划发布规模为293B的星火X2.5基础模型,该版本将深化代码生成和智能体协作能力。
此外,在2026年年中业绩说明会上,讯飞曾透露将在本年度的全球1024开发者节上推出基于全自主算力的新一代主通用大模型。这意味着讯飞正在走“开源边缘小模型+闭源主模型+国产算力底座”的并行技术路线。
为什么重要
这轮发布的核心信号不是“参数竞赛”,而是算力分层策略的落地。4B和1.7B级别的模型主要面向端侧推理,这类尺寸对显存和功耗要求更低,能直接在车载芯片、IoT设备甚至手机上运行,降低了对云端API的依赖。值得注意的是,两款边缘模型原生支持100万token上下文,在端侧模型里属于较高规格,可能对有长文档处理需求的离线场景产生实际价值。
从竞争格局看,讯飞选择在9月初集中开源+发布,明显是在对齐国内大模型厂商的发布节奏。而“基于全自主算力”的主模型表态,则延续了国产算力替代的政策方向,在政企客户采购中可能成为差异化卖点。
对用户/开发者/创作者的影响
对开发者来说,4B和1.7B模型开源意味着可以在不依赖云端API的情况下,在本地硬件或私有化服务器上进行微调和推理,这在数据敏感场景(如医疗、政务、企业内部知识库)中更具可操作性。100万token的上下文窗口,则让长文本分析、代码库理解、多轮复杂对话等任务在端侧有了更多可能性。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对硬件厂商和方案集成商而言,这两款小模型为车载助手、智能音箱、教育硬件等产品提供了更可控的离线AI能力选项,相比调用云端接口,端侧部署在延迟、隐私和成本上都有不同取舍。普通用户短期内可能感知不强,但后续搭载这些模型的智能硬件产品体验会有变化。
值得关注的后续
有三个观察点值得跟进。其一,9月7日发布的293B基础版具体能力评测如何,特别是在代码生成和智能体协作上是否真的“加深”,这需要后续基准数据验证。其二,两款开源小模型的许可证条款和商用边界,将直接影响开发者社区的实际采用意愿。其三,今年1024开发者节上亮相的“全自主算力”主模型,具体使用哪家国产芯片方案、训练效率如何,这些信息对评估国产AI算力产业链的实际进展比发布会本身更有价值。
来源:AIbase


