Qwen3.8-Flash 开源,Qwen4 架构预览

阿里通义千问团队正式发布 Qwen3.8-Flash,这是一个采用 MoE 架构、开放权重的新模型,同时被视为 Qwen4 架构的早期预览,API 已率先上线。

一句话看懂:阿里通义千问团队正式发布 Qwen3.8-Flash,这是一个采用 MoE 架构、开放权重的新模型,同时被视为 Qwen4 架构的早期预览,API 已率先上线。

事件核心:发生了什么

8 月 26 日,通义千问团队在 X 平台宣布,Qwen3.8-Flash 已开放权重,并同步开放 QwenCloud API 调用。这个模型被定位为 Qwen4 架构的早期预览版本,采用多模态 MoE(混合专家)设计,总参数量为 125B,其中包含 51B 的 N-gram 参数。生产版本的 Qwen3.8-Flash API 定价为每 100 万输入 tokens 0.16 美元,每 100 万输出 tokens 0.47 美元。目前 API 已在 QwenCloud 平台上线,团队在推文中表示“让我们一起构建点什么”。

为什么重要

这次发布的看点不只是新模型本身,而是它作为 Qwen4 架构预览的身份。MoE 架构意味着推理时并非所有参数都会被激活,这通常能带来更低的单次推理成本,同时保持较高的模型容量。从 QwenCloud 给出的 API 价格来看,它明显低于目前市面上多数同规模商用闭源模型的定价,这可能会进一步压低大模型推理服务的市场价格基准。此外,选择“开放权重”而非完全闭源,延续了 Qwen 系列在开源生态中的一贯策略,对于依赖自部署或私有化大模型的企业来说,这是一个值得评估的新选项。目前公开信息显示,这一模型在技术细节上仍需等待官方完整的模型卡和评测数据,但其作为下一代架构探路石的意义已经明确。

对用户/开发者/创作者的影响

对于开发者而言,Qwen3.8-Flash 的开放权重意味着可以基于它进行本地部署、微调和二次开发,而不必受限于 API 的调用频率和合规约束,尤其适合对数据隐私要求较高的企业场景。对于普通用户和创作者来说,低至 0.16 美元/百万输入 tokens 的 API 价格,可能会让基于大模型的原生应用、批量内容处理或图像理解类工具的运行成本明显下降。对于正在做技术选型的企业,需要留意的是,当前开放的版本是“早期预览”,生产级稳定性尚未经过大规模验证,建议在关键业务中谨慎试用,并与官方后续发布的正式版本做对比评估。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

后续可以重点关注几个方向:一是 Qwen3.8-Flash 的正式生产版本何时大规模开放,以及实际吞吐量和延迟表现是否与预览阶段一致;二是 Qwen4 完整架构的发布节奏,以及它是否会带动新一轮开源模型的性能基准刷新;三是其他大模型厂商是否会跟随这一价格区间,对 API 定价策略进行针对性调整。此外,开发者社区对这一开放权重模型的适配和生态工具支持情况,也将直接影响它的落地速度。

来源:X:通义千问 / Qwen (@Alibaba_Qwen)

celebrityanime
celebrityanime
文章: 20482

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注