科大讯飞旗下词元星火重磅开源两款全新机型

科大讯飞旗下词元星火于9月1日发布并开源两款边缘侧通用大模型——星火X2.5-4B和星火X2.5-1.7B,首次在小型模型上原生支持100万tokens超长上下文,让端侧设备具备了处理超长文本和复杂任务的底层能力。

一句话看懂:科大讯飞旗下词元星火于9月1日发布并开源两款边缘侧通用大模型——星火X2.5-4B和星火X2.5-1.7B,首次在小型模型上原生支持100万tokens超长上下文,让端侧设备具备了处理超长文本和复杂任务的底层能力。

事件核心:发生了什么

9月1日,科大讯飞全资子公司词元星火正式宣布推出两款面向边缘侧场景的通用大模型:星火X2.5-4B和星火X2.5-1.7B,并同步开源。这两款模型的核心技术变化在于突破了此前边缘硬件算力的常见瓶颈,原生支持高达100万tokens的超大上下文窗口。这一特性意味着,算力有限的智能终端不再被“内存不足”或“长文本处理能力弱”所限制,可以直接在本地完成对超长文档、大规模数据和复杂长期任务的推理工作,为AI大模型在智能终端上的深度普及和离线应用提供了更扎实的基础支撑。

为什么重要

过去,边缘侧小模型的优势在于低延迟、隐私安全和离线可用,但受限于参数量和内存带宽,上下文长度普遍较短,通常只能处理几千到几万tokens的文本,难以覆盖完整的书籍、代码仓库或长时间连续对话。词元星火此次将100万tokens上下文能力下沉到4B和1.7B这样的中小参数模型,实际是在重新划分端云协同的技术边界——很多原本必须上传云端才能完成的长文本分析任务,现在可以完全在本地设备完成。对于开源生态而言,这两款模型的发布也意味着开发者可以在消费级硬件和移动设备上直接构建具备强记忆能力的AI应用,而不必依赖高成本的云端推理服务,这可能会加速端侧AI在办公、教育、医疗等垂直场景的落地速度。

对用户/开发者/创作者的影响

对普通用户而言,搭载这类模型的手机、PC或智能音箱在离线状态下也能完成整本电子书摘要、超长会议纪要整理等任务,且数据无需上传,隐私性更强。对开发者来说,星火X2.5系列的100万token上下文直接放宽了应用设计的限制,比如可以构建基于完整项目代码的本地编程助手,或是能记住用户全部历史偏好的端侧智能体;同时,开源协议意味着开发者可以基于模型自行微调、部署到自有硬件上,降低了长期使用的API调用成本。对内容创作者而言,长上下文带来的连续创作能力值得关注——AI可以在理解前文数万字情节铺垫的基础上,保持风格和逻辑的一致性,而不至于在中途“失忆”。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

目前公开信息显示,词元星火尚未公布这两款模型具体的开源许可证类型、商用授权边界以及主要适配的芯片平台。后续可以关注以下三个方面的实际进展:第一,模型跑通哪些主流端侧芯片(如高通、联发科、苹果的神经引擎),推理速度和内存占用的实测数据是否与宣传相符;第二,科大讯飞是否会借此推动自家硬件产品(如录音笔、办公本)的AI功能升级,形成软硬一体的差异化竞争力;第三,其他大模型厂商是否会在小参数模型上跟进“超长上下文”这一技术方向,从而改变当前端侧模型重轻量化参数、轻上下文能力的行业惯例。

来源:AIbase

celebrityanime
celebrityanime
文章: 21255

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注