阿里Qwen3.8正式发布:2.4T规模,自主编程16天搓出一个Hermes Agent

阿里发布新一代基座大模型 Qwen3.8,总参数达 2.4 万亿,在编程和智能体任务上大幅提升,API 已上线且定价对标 Claude Opus 5 更具性价比。旗舰模型下周开源,值得关注。

一句话看懂:阿里发布新一代基座大模型 Qwen3.8,总参数达 2.4 万亿,在编程和智能体任务上大幅提升,API 已上线且定价对标 Claude Opus 5 更具性价比。旗舰模型下周开源,值得关注。

事件核心:发生了什么

8 月 3 日,阿里巴巴正式发布旗舰基座模型 Qwen3.8-Max。该模型采用稀疏 MoE 架构与混合注意力机制,总参数量 2.4 万亿,激活参数 95B,支持视觉理解,上下文长度达 1M Tokens。官方称其在 CodeArena 编程榜中排名全球第四,在 Arena 综合榜单中仅次于 Anthropic 的 Claude 系列。

同步发布的还有企业级 Agent 产品“千问办公”(QwenWork),网页版和 PC 客户端已开放公测,钉钉入口近期开放。目前 Qwen3.8 的 API 已上线千问 AI 平台,国内每百万 Tokens 输入 12 元、输出 36 元,隐式缓存命中仅 1.5 元;国际定价分别为 Opus 5 的 40% 和 24%。官方确认 Qwen3.8-Max 和 Qwen3.8-27B 将于下周开源。

一个典型能力展示是:Qwen3.8 从空文件夹出发,自主运行约 16 天,独立开发出一个名为“oh-my-cli”的自进化智能体框架,项目已开源至 GitHub,过程记录公开可查。

为什么重要

Qwen3.8 是阿里首次将千问系列总参数推至 2.4T 规模。结合 MoE 架构,它把更大的模型容量和可控的推理成本放在同一套框架里,这是大模型竞争中非常实际的技术路线选择——用参数换能力,用稀疏激活控制成本。

更值得关注的是其自主编程表现。模型能自己完成数十天的真实项目交付,意味着 AI 从“辅助写代码”向“独立做项目”迈出一步。虽然这仍是演示性质的能力展示,但它指向了 AI 在软件工程中的新角色边界。

在商业化层面,Qwen3.8 的国际定价明显低于 Claude Opus 5,同时性能处在同一讨论区间。这种“高性价比”打法,加上即将开源 Max 版本,会直接冲击闭源和开源两条赛道上的现有竞争格局。

对用户/开发者/创作者的影响

开发者现在就可通过千问 AI 平台调用 Qwen3.8 API 进行测试,国内价格处于较低水位,适合做大批量文本处理类应用;需要私有化部署的团队可以等待下周开源版本,尤其是 27B 这一尺寸,对中等规模算力更加友好。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

企业用户可通过“千问办公”体验模型能力,官方展示的法务条款标注、篮球比赛录像拆解、ETF 策略研究等案例,均属于长文档理解、多模态分析和多智能体协作场景,适合审计、研究、运营类岗位做初步验证。

创作者可以关注它的视觉理解能力:模型能读取 200 页 PDF、理解超 100 小时视频,这意味着视频剪辑、素材整理、财报解读等工作中,AI 可以从“文字助理”扩展到“多模态资料员”。

值得关注的后续

第一,下周开源后的实际部署反馈。Qwen3.8-Max 参数量巨大,普通开发者难以本地运行,开源更多是生态信号;Qwen3.8-27B 的社区适配和量化效果更值得观察。

第二,“oh-my-cli”项目的可信度验证。官方已公开完整开发日志,社区可以审查模型是否真的独立完成了项目,这将直接影响外界对“自主编程”能力的判断。

第三,“千问办公”公测期间的企业真实采用情况。Agent 产品能否在生产环境中稳定交付,比模型榜单分数更能说明问题。

来源:InfoQ CN

celebrityanime
celebrityanime
文章: 16624

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注