商汤发布 SenseNova U1.5-Lite-Preview 开源模型

商汤于2026年8月3日发布开源多模态模型 SenseNova U1.5-Lite-Preview,以8B规模的MoT参数实现图像生成与编辑能力的大幅提升,官方基准成绩接近甚至对标部分闭源商业模型。值得关注的是,这是商汤在原生统一多模态架构上的一次关键开源验证。

一句话看懂:商汤于2026年8月3日发布开源多模态模型 SenseNova U1.5-Lite-Preview,以8B规模的MoT参数实现图像生成与编辑能力的大幅提升,官方基准成绩接近甚至对标部分闭源商业模型。值得关注的是,这是商汤在原生统一多模态架构上的一次关键开源验证。

事件核心:发生了什么

商汤 SenseTime 在 X(原 Twitter)官方账号宣布推出 SenseNova U1.5-Lite-Preview,一个轻量级、原生统一的多模态开源模型预览版。该模型基于自研 NEO-Unify 原生统一架构构建,能以 8B-MoT 参数量完成跨模态的理解、推理、生成与编辑任务。

相比上一代 U1,U1.5-Lite-Preview 的官方公开改进集中在三方面:支持最高 4K 分辨率输入输出,图像细节更丰富、视觉伪影更少;中英文文字渲染与复杂版面构图能力增强;在长提示词、多约束条件下具备更精确的视觉控制,同时优化了参考图风格迁移、多图融合、局部信息图修改和文字编辑等原生图像编辑功能。

商汤同时公布了多项基准测试的提升数据:Qwen-Image-Bench 从 47.14 提升至 55.20(启用 PE),ImgEdit-Bench 从 3.90 提升至 4.37,GEdit-Bench 英文从 7.47 提升至 8.17,中文从 7.42 提升至 8.05。模型已上线 GitHub、Hugging Face 与 Discord 社区。

为什么重要

这次发布的价值不在于“又出了一个开源模型”,而在于三点判断依据。

第一,轻量参数路线正在被头部厂商验证。8B-MoT 规模下追求接近商业闭源模型的质量,意味着多模态生成任务对算力依赖的议价空间正在打开,也从侧面说明架构设计和数据策略在生成质量上的权重越来越高。

第二,原生统一架构成为新竞争点。NEO-Unify 并非简单的视觉编码器加语言模型拼接,而是从底层统一了理解与生成的能力边界,这为后续端侧部署、实时交互和代理型应用提供了更好的基础。

第三,开源策略卡位明显。在闭源模型迭代加速的周期里,商汤选择把预览版直接开源,并公布相对完整的基准对比,目标不只是技术展示,更是在争夺开发者生态和多模态工具链的早期入口。

对用户/开发者/创作者的影响

对开发者而言,这是低门槛接入多模态生成能力的机会。8B 规模意味着显存需求和推理成本相对可控,个人开发者或中小团队有望在本地或私有云环境部署测试,基于 GitHub 和 Hugging Face 上的权重与代码快速验证图像编辑、风格迁移等场景。对于内容创作者,4K 分辨率和中英文文字渲染的改进直接作用于海报排版、电商图文、信息图修改等真实工作流,减少“生成后再用修图软件加工”的往返成本。需要提醒的是,官方宣称的“媲美闭源商业模型”是基于商汤公布的基准成绩,实际效果仍应以真实业务场景测试为准。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

接下来有三个具体观察点。第一,U1 Pro 的开放节奏。商汤表示面向创作者的生产级模型 U1 Pro 将很快公开访问,这条产品线从开源预览到商业化服务的路径是否顺畅,直接关系到该系列模型能否形成可持续的商业模式。第二,开发者生态的实际反馈。开源模型的价值最终取决于社区是否愿意基于它做微调、部署和二次开发,GitHub 星标与 Hugging Face 下载量是短期内可量化的观测指标。第三,竞品的跟进策略。在轻量级开源多模态模型这条赛道上,其他国产模型厂商是否会以类似参数规模和开源方式回应,将影响未来半年该细分市场的格局。

来源:X:商汤 SenseTime (@SenseTime_AI)

celebrityanime
celebrityanime
文章: 16697

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注