一句话看懂:阿里发布新一代基座大模型 Qwen3.8,总参数达 2.4 万亿,在编程和智能体任务上大幅提升,API 已上线且定价对标 Claude Opus 5 更具性价比。旗舰模型下周开源,值得关注。
事件核心:发生了什么
8 月 3 日,阿里巴巴正式发布旗舰基座模型 Qwen3.8-Max。该模型采用稀疏 MoE 架构与混合注意力机制,总参数量 2.4 万亿,激活参数 95B,支持视觉理解,上下文长度达 1M Tokens。官方称其在 CodeArena 编程榜中排名全球第四,在 Arena 综合榜单中仅次于 Anthropic 的 Claude 系列。
同步发布的还有企业级 Agent 产品“千问办公”(QwenWork),网页版和 PC 客户端已开放公测,钉钉入口近期开放。目前 Qwen3.8 的 API 已上线千问 AI 平台,国内每百万 Tokens 输入 12 元、输出 36 元,隐式缓存命中仅 1.5 元;国际定价分别为 Opus 5 的 40% 和 24%。官方确认 Qwen3.8-Max 和 Qwen3.8-27B 将于下周开源。
一个典型能力展示是:Qwen3.8 从空文件夹出发,自主运行约 16 天,独立开发出一个名为“oh-my-cli”的自进化智能体框架,项目已开源至 GitHub,过程记录公开可查。
为什么重要
Qwen3.8 是阿里首次将千问系列总参数推至 2.4T 规模。结合 MoE 架构,它把更大的模型容量和可控的推理成本放在同一套框架里,这是大模型竞争中非常实际的技术路线选择——用参数换能力,用稀疏激活控制成本。
更值得关注的是其自主编程表现。模型能自己完成数十天的真实项目交付,意味着 AI 从“辅助写代码”向“独立做项目”迈出一步。虽然这仍是演示性质的能力展示,但它指向了 AI 在软件工程中的新角色边界。
在商业化层面,Qwen3.8 的国际定价明显低于 Claude Opus 5,同时性能处在同一讨论区间。这种“高性价比”打法,加上即将开源 Max 版本,会直接冲击闭源和开源两条赛道上的现有竞争格局。
对用户/开发者/创作者的影响
开发者现在就可通过千问 AI 平台调用 Qwen3.8 API 进行测试,国内价格处于较低水位,适合做大批量文本处理类应用;需要私有化部署的团队可以等待下周开源版本,尤其是 27B 这一尺寸,对中等规模算力更加友好。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
企业用户可通过“千问办公”体验模型能力,官方展示的法务条款标注、篮球比赛录像拆解、ETF 策略研究等案例,均属于长文档理解、多模态分析和多智能体协作场景,适合审计、研究、运营类岗位做初步验证。
创作者可以关注它的视觉理解能力:模型能读取 200 页 PDF、理解超 100 小时视频,这意味着视频剪辑、素材整理、财报解读等工作中,AI 可以从“文字助理”扩展到“多模态资料员”。
值得关注的后续
第一,下周开源后的实际部署反馈。Qwen3.8-Max 参数量巨大,普通开发者难以本地运行,开源更多是生态信号;Qwen3.8-27B 的社区适配和量化效果更值得观察。
第二,“oh-my-cli”项目的可信度验证。官方已公开完整开发日志,社区可以审查模型是否真的独立完成了项目,这将直接影响外界对“自主编程”能力的判断。
第三,“千问办公”公测期间的企业真实采用情况。Agent 产品能否在生产环境中稳定交付,比模型榜单分数更能说明问题。
来源:InfoQ CN


