Adobe Firefly 新增 AI 音频工具,Google 推出 Gemini Omni Flash

Adobe 将三款 AI 音频生成工具全面开放到 Firefly 平台,同时在平台内接入 Google 的 Gemini Omni Flash 多模态模型。这既是 Adobe 在创作工具链上补齐音频短板,也意味着 Firefly 正在从图像生成平台转向更完整的商业创作工作流。

一句话看懂:Adobe 将三款 AI 音频生成工具全面开放到 Firefly 平台,同时在平台内接入 Google 的 Gemini Omni Flash 多模态模型。这既是 Adobe 在创作工具链上补齐音频短板,也意味着 Firefly 正在从图像生成平台转向更完整的商业创作工作流。

事件核心:发生了什么

8 月 20 日,Adobe 宣布在 Firefly 平台全面推出三款 AI 音频工具:Generate Music 可为视频生成免版税音乐轨道,Generate Speech 能将脚本直接转为配音,Generate Sound Effects 则为单个场景生成匹配的音效。Adobe 声称这三款工具生成的内容均已获得商业使用授权,解决了创作者对版权风险的担忧。

与此同时,Firefly 平台新增了对 Google Gemini Omni Flash 的接入。该模型支持视频、音频、图像与文本提示的混合输入,与 Firefly 已有的 Google、Kling AI、Luma AI、Runway 等第三方模型共同构成多模型选择体系。此外,Firefly 的 AI Assistant 现在提供每日免费生成次数,Adobe 表示 “Create Storyboard”(创建故事板)和 “Create Brand Kit”(创建品牌套件)是使用率最高的两项功能。

为什么重要

这次更新透露出两个信号。第一,Adobe 正把 Firefly 从单一的图像生成工具扩展为覆盖画面、声音、配音的完整创作套件,直接对标短视频、广告和影视制作流程中的多环节需求,而不是停留在单点功能竞争。第二,开放接入 Gemini Omni Flash 表明 Adobe 在模型策略上坚持“多模型并行”,不押注单一闭源模型,而是让创作者按任务选择合适的大模型,这种做法在头部创意软件厂商中相对少见。

对于 AI 应用生态而言,Adobe 愿意在自己的产品中接入第三方模型,意味着底层大模型的竞争已经从技术参数转向实际调用场景。谁能更好地嵌入成熟工具链并满足商业合规要求,谁就能获得更稳定的落地入口。

对用户/开发者/创作者的影响

对视频创作者和内容团队来说,音频生成工具的全面开放意味着可以在一套工作流内完成配乐、配音、音效匹配,省去跨平台切换和版权清理成本。Adobe 承诺的商业使用授权,对面向客户交付的广告、品牌内容制作尤其关键。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对开发者而言,Gemini Omni Flash 的接入提供了更灵活的多模态输入方式,开发者可以在 Firefly 的框架下同时调用文本、图像、视频和音频提示,降低了构建复杂生成流程的难度。免费每日生成次数则降低了个人创作者和小型团队的使用门槛,便于先试用再决定是否付费。

值得关注的后续

目前公开信息显示,Adobe 尚未披露 Gemini Omni Flash 在 Firefly 平台中的具体计费方式和生成额度限制,开发者需要留意后续定价是否与 Adobe 积分体系打通。另一个观察点是音频工具的实际生成质量——在音乐结构连贯性、语音情感表现力和音效对齐精度上是否达到商业可直接使用的水平,还有待创作者实测反馈。此外,Google 的 Gemini 系列模型在其他创意工具中的接入进度也值得跟踪,如果更多平台跟进,多模态模型的调用标准可能会逐步形成。

来源:The Decoder AI News

celebrityanime
celebrityanime
文章: 19367

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注