一句话看懂:加州 AI 公司 Odyssey 开放世界模型 Odyssey-3 的公开研究预览,用户可通过文本提示实时生成并探索可交互的虚拟环境,开发者还可申请 API 接入。
事件核心:发生了什么
Odyssey 于 2026 年 10 月推出 Odyssey-3 的公开研究预览。该模型基于自回归扩散 Transformer,可根据文本描述逐帧生成视频,并支持第一人称与第三人称视角切换、触发事件和实时响应。免费在线演示运行在轻量版 Odyssey-3 Flash 上,开发者可申请 API 访问。据官方基准提交信息,基础版模型有 140 亿参数,输出 832×480 像素视频;Odyssey-3 Pro 支持 1280×720 像素。创始人 Oliver Cameron 和 Jeff Hawke 曾在 9 月 15 日首次披露该模型,方向覆盖机器人、自动驾驶和电子游戏。
为什么重要
世界模型被视为连接生成式 AI 与物理世界的关键路径。Odyssey-3 不只生成静态画面,而是尝试学习物理因果,让不同系统在模拟环境中获得可预测的动态反馈。这意味着同一模型能通过专用控制器驱动机械臂、无人机和游戏角色,从而降低从模拟训练到真实部署的迁移成本。若 API 和 Benchmark 结果经得起第三方检验,它可能推动 AI 应用从内容生成延伸到具身智能与自动控制。
对用户/开发者/创作者的影响
普通用户可免费体验文本生成交互世界,适合快速验证创意场景。开发者可通过 API 将模型接入机器人训练、自动驾驶仿真或游戏 AI,从而减少数据采集与算力成本。创作者则能借助实时生成环境制作互动内容,但需注意目前演示运行的是 Flash 版本,长篇续写生成的开源与闭源策略尚未明确,商业化使用前应确认授权与稳定性。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
首先,官方自评的物理基准成绩存在方法学局限:66.1 分来自单次测试的筛选结果,标准规则要求四次运行并报告标准差,未经筛选的四次平均为 63.37 分,两项均由 Odyssey 自行提交,需第三方复现。其次,机器人、无人机和 GTA V 控制器的测试仍属公司内部演示,能否在真实硬件上稳定运行是落地关键。最后,API 的收费模式、延迟表现和商用条款将决定开发者生态能走多远。


