一句话看懂:阿里通义千问的 Qwen-Image-2.1 已接入 ComfyUI,并同步开放开源权重下载,单模型同时覆盖图像生成和图像编辑。这意味着创作者不必依赖闭源 API,也能在本地工作流里跑一个 7B 级别的图像模型。
事件核心:发生了什么
据通义千问官方 X 账号(@Alibaba_Qwen)消息,Qwen-Image-2.1 现已支持 ComfyUI。ComfyUI 官方账号同步确认了这一适配,并给出了更具体的能力说明:开源权重,一个 7B checkpoint 同时负责生成与编辑;支持原生 2K 分辨率图像生成;支持指令式编辑,单次最多可引用 10 张参考图;输出为 RGBA 格式,包含 alpha 通道。该消息发布于 2026 年 9 月 20 日,公开可见浏览量约 1.89 万次。
为什么重要
把生成和编辑压进同一个 checkpoint,是当前图像大模型一个明确的技术方向。此前不少开源方案要么只做文生图,要么编辑能力需要额外挂载模块,工作流容易变重。Qwen-Image-2.1 用单一 7B 模型同时承担两类任务,对显存和推理成本更友好。同时,接入 ComfyUI 这个节点式工作流工具,等于直接进入了一个成熟的开源创作生态,用户不需要自己写推理脚本就能调用。对阿里来说,开源权重是扩大模型影响力和开发者心智的常规打法,与闭源 API 形成互补。
对用户/开发者/创作者的影响
创作者层面,最直接的变化是可以在 ComfyUI 里搭本地管线,做 2K 出图、多参考图编辑和带透明通道的素材,适合电商图、海报分层、素材合成等场景,且不产生按次调用费用。开发者层面,7B 规模意味着消费级显卡有机会跑起来,具体显存占用和推理速度目前公开信息显示尚未给出官方基准,需要实测确认。RGBA 输出是一个容易被低估的细节,省去了后期抠图或外部蒙版处理,对需要图层级素材的流程很实用。企业侧如果已有 ComfyUI 部署,迁移和接入成本相对可控。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是官方是否公布量化版本、显存门槛和推理速度数据,这直接决定普通设备能否落地;二是多参考图编辑在 10 张输入下的稳定性和一致性表现,需要社区实测反馈;三是其他开源图像模型是否会跟进“生成+编辑单 checkpoint”路线,以及 ComfyUI 生态里相关节点和工作流的丰富速度。


