一句话看懂:Google 发布了 Gemini Omni 1.1 Flash,将 AI 视频生成价格进一步压低至每秒 3 美分起,同时支持更长的场景延续和外部素材参考,降低了视频生成开发者的试错与生产成本。
事件核心:发生了什么
Google 于 2025 年 8 月 27 日更新了旗下 Gemini Omni Flash 视频生成模型,推出 1.1 版本。这次更新主要聚焦于两个方向:更长的视频理解和更低门槛的生成成本。
在功能层面,Omni 1.1 将场景扩展的参考范围从原来的“最后一秒”提升到“最多分析十秒的已有视频”,开发者可以把现有片段以 10 秒为单位进行续写,最长扩展至 40 秒。同时,开发者可以上传最长 3 秒的外部视频作为风格参考,用于迁移角色或动作特征,并通过设置起始帧与结束帧来生成关键帧之间的镜头运动。
在定价层面,Google 新增了 360p 草稿模式,生成速度比 720p 快最多 60%,价格为每秒 0.03 美元,是 720p 档位(0.10 美元/秒)的三分之一。最终成片可放大至 1080p 或 4K,对应单价分别为每秒 0.15 美元和 0.30 美元。目前该模型已通过 Google AI Studio 和开发者文档开放使用。
为什么重要
这一更新将 AI 视频生成的成本竞争推到了新的档位。0.03 美元/秒的草稿价意味着生成一段 5 秒的测试视频成本不足 1 元人民币,这直接拉低了创作者和开发者在早期试验阶段的资金门槛。
更重要的是,Omni 1.1 引入了“长上下文”视频理解能力——不再是只盯着最后一帧预测下一帧,而是分析最多十秒的完整片段。这让 AI 在生成延续内容时能保持角色形象、场景光影和运动逻辑的一致性,解决了此前 AI 视频“单看一帧不错、连续播放断裂”的常见问题。此外,允许外部素材做风格参考,相当于给了开发者一个轻量级的“角色一致性”控制入口,这在目前市面上的视频生成 API 中属于较稀缺的实用功能。
横向对比来看,Omni 1.1 的 1080p 价格(0.15 美元/秒)介于 Veo 3.1 Lite(0.08 美元)和 Veo 3.1 Fast(0.12 美元)之间,而 4K 档位则与 Veo 3.1 Fast 持平(0.30 美元)。这意味着 Google 正在用同一代模型覆盖从“快速草稿”到“高分辨率成片”的完整价格带,试图在视频生成 API 市场中建立分层定价标准。
对用户/开发者/创作者的影响
对独立创作者而言,360p 草稿模式适合做分镜预演或快速验证创意,待确认效果后再用 1080p 或 4K 正式渲染,能有效控制整体成本。比如一个 10 秒的成片,先花 1.5 美元草稿测试多版方案,再花 1.5 美元出最终 1080p 版本,总成本约 3 美元,较此前动辄数十美元的尝试便宜得多。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对开发者而言,以下几点值得注意:
第一,外部素材(最长 3 秒)可作为风格参考输入,意味着可以搭建“输入参考视频 + 文本指令 = 风格一致的扩展片段”工作流,这对游戏 CG、短视频批量生产、广告素材微调等场景有直接帮助。第二,起始帧/结束帧机制允许通过 API 精确控制镜头起止画面,为自动化剪辑工具提供了更可控的接口。第三,按秒计费的粒度让成本测算变得清晰透明,适合集成到按量付费的 SaaS 产品中。
值得关注的后续
第一,竞品价格是否会跟进。目前 Runway、Luma 等厂商尚未在公开渠道释放同等价位的 360p 草稿模式,Google 这一刀可能迫使市场重新定价。
第二,场景扩展的稳定性在长视频中的实际表现。10 秒参考窗口比 1 秒窗口进步明显,但 40 秒上限在实际项目中是否够用,需要观察后续是否开放更长续写。
第三,外部风格参考的版权边界。允许上传 3 秒他人素材做风格迁移,虽然技术上提供了便利,但使用方需要自行确保素材合规,这一块 Google 尚未公布明确的审核或过滤机制,目前公开信息显示主要依赖开发者自查。


