阿里重磅开源2.4万亿参数大模型,多项性能比肩Fable 5

阿里 Qwen 团队正式开源了总参数达 2.4 万亿的旗舰模型 Qwen3.8-2.4T-A95B,这是该团队首次完整开放 Max 级模型权重。它采用每 token 仅激活 950 亿参数的 MoE 架构,在编程、研究辅助和长任务智能体等场景已展现出对标国际一线模型的能力。

一句话看懂:阿里 Qwen 团队正式开源了总参数达 2.4 万亿的旗舰模型 Qwen3.8-2.4T-A95B,这是该团队首次完整开放 Max 级模型权重。它采用每 token 仅激活 950 亿参数的 MoE 架构,在编程、研究辅助和长任务智能体等场景已展现出对标国际一线模型的能力。

事件核心:发生了什么

据 AIbase 报道,阿里巴巴 Qwen 大模型团队于近期正式发布了 Qwen3.8-2.4T-A95B 模型权重,面向全球开发者和研究人员开放。该模型总参数量达到 2.4 万亿,但得益于混合专家(MoE)架构,处理每个 token 仅激活 950 亿参数,兼顾了规模与推理效率。

模型原生支持 26 万 token 的超长上下文,并可进一步扩展至 101 万 token。底层架构延续了 Qwen3.5 的设计优势,在编程、日常办公、研究辅助及长期智能体任务上均获得综合性能提升。在 PaperBench 论文复现基准和 OSWorld-Verified 计算机操作能力评测中,其成绩位居前列,部分指标超过若干国际主流模型。官方同时展示了它连续数天独立完成复杂编程任务、自动复现并优化研究论文的能力。

为什么重要

这是国内头部大模型厂商首次将旗舰级 Max 模型完整开源,而并非此前常见的“蒸馏版”或“中小尺寸版”,对开源社区是一次实质性的能力下放。2.4 万亿总参数配合 950 亿激活参数的设计,展示了从“拼参数总量”转向“拼激活效率”的技术路线,有利于降低长上下文和复杂智能体任务的推理成本。

此外,这一动作直接加剧了开源与闭源模型之间的竞争。当前闭源前沿模型在部分基准上仍具优势,但开源模型在可定制性、数据隐私和本地部署方面具备天然吸引力。阿里选择此时开放旗舰权重,既是对自身技术成熟度的信号释放,也可能推动其他大模型厂商重新评估开源策略。

对用户/开发者/创作者的影响

对开发者而言,获得了一个可商用、可微调的高上限底座模型,可以用相对可控的推理成本处理长文档、复杂代码库和自动化智能体任务,不再局限于调用闭源 API。对研究机构来说,完整的 Max 级权重让复现前沿训练与对齐技术成为可能,模型架构细节和超长上下文策略都值得深入拆解。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对企业用户,这一选择意味着在构建内部知识库、自动化编程助手或长时间运行的数字员工时,多了一个可私有化部署的选项。普通创作者则可以通过开源社区的二次开发,间接使用到更强的长文本创作辅助和代码生成能力。不过需要注意的是,2.4 万亿参数的模型即使采用 MoE 架构,完整部署仍需可观的 GPU 显存资源,个人开发者更适合先通过 API 或量化版本体验。

值得关注的后续

目前公开信息显示,模型权重已经发布,但尚不清楚官方是否会同步推出配套的 API 服务及定价,这将直接影响中小开发者的接入门槛。其次,开源社区能否在消费级硬件上完成有效的量化部署,决定了这波开源红利能触达多大范围。此外,其他头部厂商是否会跟进,将同类旗舰模型以开放权重形式发布,也值得作为观察开源与闭源路线之争的重要信号。

来源:AIbase

celebrityanime
celebrityanime
文章: 18294

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注