一句话看懂:Google 将新一代音乐生成模型 Lyria 3.5 直接集成进 Gemini 应用,用户无需单独工具即可生成带人声或纯器乐的音乐片段。此举将 AI 音乐生成从独立产品竞赛拉入大模型应用生态的正面战场。
事件核心:发生了什么
Google 于 2026 年 9 月发布 Lyria 3.5 音乐生成模型,并同步将其接入 Gemini 应用和 API。根据 Google 官方说明,Lyria 3.5 相比前代在人声表现力和编曲丰富度上有明显提升。在 Gemini 应用内,用户可选择音乐风格与流派、切换“带人声/纯器乐”模式,并支持生成短片段或较长曲目。为降低使用门槛,Google 还内置了背景音乐、个性化生日歌曲等模板。
除 Gemini 外,Lyria 3.5 还通过 Google Flow Music(功能更丰富)、Google AI Studio(面向开发者)和 Google Vids 提供访问。Google 特别强调,Lyria 模型仅使用已获授权的内容进行训练,并以此与 Suno 的音乐模型形成区隔。但截至目前,Google 尚未披露实际训练数据集的具体构成。
为什么重要
这次更新的关键不在模型参数或音质本身,而在于分发路径:Google 没有把音乐生成做成独立 App,而是直接用 Gemini 应用作为主入口。这意味着 AI 音乐从一个“尝鲜工具”变成了 Gemini 多模态能力的一部分,用户可以在同一对话界面里完成文本生成、图像理解和音乐创作,而不用切换产品。
对行业竞争格局而言,Google 选择突出“仅用授权内容训练”的合规路径,明显是针对 Suno、Udio 等模型在版权争议上的软肋。若 Google 能在商业化场景(如 YouTube 创作者配乐、Vids 视频背景音乐)中打开闭环,将迫使竞争对手在版权策略和产品集成速度上做出回应。此外,Lyria 3.5 通过 API 和 AI Studio 开放,也为第三方开发者提供了比独立音乐生成平台更易调用的技术栈。
对用户/开发者/创作者的影响
普通用户:在 Gemini 应用里选择风格、时长和是否含人声即可生成音乐,无需学习音乐制作知识,模板设计也降低了启动门槛。对想为短视频或家庭活动快速配乐的用户,这是一个直接可用的轻量方案。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
开发者:Lyria 3.5 提供 API 和 AI Studio 入口,可将其接入现有应用或自动化工作流。但需要注意的是,Google 尚未公布详细的调用价格、并发限制和输出素材的商用授权范围,开发者应基于这些待定条件评估实际接入成本。
创作者:相比通用音乐生成工具,Lyria 3.5 的优势在于与 Google 生态(Vids、Flow Music)的协同:为视频配乐或生成背景音乐可以原生完成,不需要导出文件后再导入编辑工具。创作者可以更快迭代“画面+音乐”的匹配方案。
值得关注的后续
第一,Lyria 3.5 在人声质量上的实际表现是否达到“更具表现力”的宣传口径,需要更多用户测试和第三方盲测对比,建议观察真实作品反馈而非官方样张。
第二,Gemini 应用中音乐生成是否免费、免费层级能生成多少条曲目、API 定价能否低于 Suno 等竞品,将直接影响该功能的渗透速度。
第三,版权叙事是这次发布的核心卖点之一,但“仅使用授权内容训练”缺乏数据集细节支撑。后续若遇到版权方质询或披露更多训练数据来源,将检验这一定位的可持续性。


