昆仑万维押注世界模型的两大产业路径:内容创作实时、可交互,机器人先“预演”再行动

昆仑万维集中发布 Matrix-3.5 世界模型、Mureka V9.5/O3 音乐模型和 Riemann-1.0 机器人世界模型,明确了世界模型的两条落地路径:虚拟内容实时生成与交互,以及机器人先预测再行动。CEO 方汉将 2026 年称为“世界模型元年”,这一判断背后是模型从“生成画面”向“理解因果和持续…

昆仑万维集中发布 Matrix-3.5 世界模型、Mureka V9.5/O3 音乐模型和 Riemann-1.0 机器人世界模型,明确了世界模型的两条落地路径:虚拟内容实时生成与交互,以及机器人先预测再行动。CEO 方汉将 2026 年称为“世界模型元年”,这一判断背后是模型从“生成画面”向“理解因果和持续…

本周AI行业发生多起高关注度事件:DeepSeek因内部会议纪要泄露暂停融资谈判,引发行业对投融资纪律的讨论;AI大神Karpathy疑似从Anthropic离职;美国指控Kimi K3模型蒸馏,但遭开源社区反驳;微信员工因晒317万年终奖被腾讯辞退,凸显科技公司薪资保密高压线。

AI 数据工具公司 Encord 与德国神经科学初创公司 Zander Labs 合作,在机器人训练过程中收集操作员的脑电波信号,试图用“意图”和“误差”等高阶信号弥补物理世界训练数据极度稀缺的短板。这不再是数据管理生意,而是直接制造训练数据的尝试。

开发者卡兹克开源了名为 Leader.skill 的工具,专门帮助用户把模糊的“领导式需求”转化为可执行的 Agent 目标任务书。它基于“目标七问”方法论,强调约束比目标本身更重要,旨在解决长程 Agent 因目标不清而浪费大量 Token(案例中单次浪费 20 亿 Token)的问题。

开发者“向阳乔木”发布了一款基于bento PPT改造的AI Skill,可让用户通过输入主题,由大模型自动生成可直接在线编辑、演示并支持多人协作的HTML幻灯片。该项目已开源,安装指令为 npx skills add joeseesun/qiaomu-bento-ppt ,推荐搭配Kimi K3或Opus…

谷歌在2026年第二季度财报电话会议上确认正在训练Gemini 4,这是其史上最大规模的预训练项目,并承诺将TPU算力优先用于AGI研发。同时Gemini 3.5 Pro延期,但3.x Flash系列已通过迭代提升代码生成和Agent能力,未来谷歌计划以接近每月一版的节奏发布新模型。

谷歌正在Google App beta版中测试Gemini Daily Brief的文本定制功能,允许用户通过文字、语音或预设偏好自由调整早间AI摘要的内容重点,首次作为Pixel 10 Daily Hub的扩展在2026年Google I/O上亮相。这标志着早间信息聚合工具从固定菜单式交互转向真正的个性化。

苹果智能眼镜(代号N50)预计将在2027年WWDC亮相、同年秋季发售,核心差异化卖点是隐私保护——苹果可能采用无摄像头只保留AI交互的方案,或强制禁用拍照录像,并通过边缘AI处理避免用户数据上传。这一策略与Meta等竞品形成鲜明对比,有望重塑AI可穿戴设备的信任基线。

英伟达与韩国互联网巨头Naver联合投资10亿美元(约67.78亿人民币),将现有的DSX AI工厂从当前规模扩建至200兆瓦,并引入Brookfield资产管理公司提供最高90亿美元的资金支持。这是英伟达在亚太地区AI算力布局的又一重要动作,旨在服务韩国及美国AI创新企业的训练与推理需求。

英伟达正与OpenAI商讨一项价值2500亿美元的融资担保协议,帮助后者租赁俄亥俄州一个10吉瓦级的超级数据中心,整体项目投资可能超过500亿美元。这不仅刷新了AI算力设施的规模纪录,更揭示了科技巨头通过“信用包装”重构基建融资模式的新趋势。