昆仑万维押注世界模型的两大产业路径:内容创作实时、可交互,机器人先“预演”再行动

昆仑万维集中发布 Matrix-3.5 世界模型、Mureka V9.5/O3 音乐模型和 Riemann-1.0 机器人世界模型,明确了世界模型的两条落地路径:虚拟内容实时生成与交互,以及机器人先预测再行动。CEO 方汉将 2026 年称为“世界模型元年”,这一判断背后是模型从“生成画面”向“理解因果和持续…

一句话看懂:昆仑万维集中发布 Matrix-3.5 世界模型、Mureka V9.5/O3 音乐模型和 Riemann-1.0 机器人世界模型,明确了世界模型的两条落地路径:虚拟内容实时生成与交互,以及机器人先预测再行动。CEO 方汉将 2026 年称为“世界模型元年”,这一判断背后是模型从“生成画面”向“理解因果和持续状态”的实质性跨越。

事件核心:发生了什么

昆仑万维近日连续发布三款世界模型产品:Matrix-3.5 面向游戏和交互场景,在约 50 亿参数下实现 720P 实时交互,升级了基于空间信息的 Patch Memory 和动静分离建模,生成时长达到约 1 万小时训练数据覆盖 1200 类场景;Mureka V9.5 与 O3 音乐模型聚焦降低“模型感”,增强停顿、呼吸和情感变化,并将音乐创作从“一句话生成”转向可编辑、可迭代的系统;Riemann-1.0 具身世界模型使用超过 20 万小时人类第一视角及机器人数据训练,在统一架构中同时输出动作序列和未来视觉预测,在厨房整理等复杂任务中成功率超过 90%。

为什么重要

世界模型之前更多停留在研究概念,昆仑万维此次发布将其推入两条清晰的产业路径:一是内容生产路径,要求模型实时、有状态、可交互且维持因果关系,这与传统视频模型“离线生成一段画面”有本质区别,游戏行业可能成为最早被系统性改造的领域;二是物理世界路径,机器人必须学会在行动前推演动作后果,Riemann-1.0 让动作生成和环境预测进入同一模型,形成“预测—执行—修正”闭环。两条路径共同指向一个判断:世界模型正在从“生成什么”走向“如果……会怎样”的状态预测范式。这一转变将重新定义内容制作流程和机器人决策逻辑,而非仅仅提升画面质量。

对用户/开发者/创作者的影响

对内容创作者而言,AI 并未减少判断责任,反而对综合审美提出更高要求。演员王珞丹和导演崔睿均表示,模型提供快速分镜和补拍镜头的能力,但题材、节奏、情感和镜头取舍仍需人主导。音乐创作门槛被大幅降低——传统单曲制作成本可达 20 万至 100 万元,而 AI 模型可将边际成本降至极低水平。对开发者来说,Matrix-3.5 通过蒸馏、量化和采样优化降低了实时推理的硬件门槛,但成宇强调“能否实时运行”是模型从研究走向产业的分界线。爱奇艺数据显示,平台每天收到约 3000 部 AI 作品和上千部 AI 漫画,AI 正在渗透分镜、概念图、补拍、配乐和剪辑等环节,而非一步到位生成完整电影。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

首先,Matrix-3.5 的实时交互能力是否能在中小规模算力条件下稳定运行,将直接影响游戏行业是否将其纳入生产管线;其次,Riemann-1.0 在真实环境中 80%–90% 的成功率距离商业部署仍有一段距离,模型能否在更复杂、更开放的非结构化任务中保持稳定性值得跟踪;第三,爱奇艺等平台已出现大量 AI 供给,用户观看习惯尚未形成稳定规律,内容平台的分发策略和标识机制将影响世界模型生成内容的商业价值。方汉承认模型在可控性和易用性上仍有明显不足,日常环境、微表情和小众场景的“塑料感”问题尚未解决,这也将是后续竞争的关键区分点。

来源:InfoQ CN

celebrityanime
celebrityanime
文章: 15302

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注