字节发布 Seedance 2.5:单次生成 30 秒视频,支持多模态参考与精准编辑

字节跳动发布新一代视频生成模型 Seedance 2.5,将单次生成时长从 15 秒提升至 30 秒,并强化多模态参考与时间戳编辑能力。这意味着视频生成正从“生成片段”走向“完成一段创作”,长叙事和可控编辑成为新的竞争焦点。

一句话看懂:字节跳动发布新一代视频生成模型 Seedance 2.5,将单次生成时长从 15 秒提升至 30 秒,并强化多模态参考与时间戳编辑能力。这意味着视频生成正从“生成片段”走向“完成一段创作”,长叙事和可控编辑成为新的竞争焦点。

事件核心:发生了什么

7 月 31 日,字节跳动 Seed 团队正式发布视频创作模型 Seedance 2.5。相比 2.0 版本,该模型最直接的变化是单次生成时长翻倍至 30 秒,并支持多轮延长,官方称可产出数分钟保持主体、场景和叙事连贯的内容。与此同时,模型升级了多模态参考能力,单次输入最多可包含 30 张图片、10 段视频和 10 段音频,支持白模参考、运动参考和创意参考等;编辑层面则新增了时间戳控制,可对指定片段进行定向修改,并强化了绿幕编辑、运镜编辑等能力。目前 Seedance 2.5 已陆续上线即梦 AI、豆包专业版等平台,API 服务将在近期登陆火山方舟。

为什么重要

Seedance 2.5 的发布透露出一个明确的行业信号:视频生成模型的竞争点正在从“单段画质”转向“完整创作流程”。过去一年,多数模型仍停留在生成几秒到十几秒的独立片段,用户需要反复抽卡、拼接才能完成一段叙事。而 Seedance 2.5 通过长叙事、多模态参考和精准编辑的组合,尝试把创作意图的表达与执行压缩到同一个模型内完成。对字节跳动而言,这不仅是模型能力的升级,也是其视频生成产品矩阵(即梦 AI、豆包专业版)拉开体验差异化的关键一步。放在行业语境中,这一动向也与 OpenAI Sora、快手可灵等竞品的迭代方向形成共振:谁能先把“可控的长视频创作”做成稳定可用的产品,谁就有机会在影视、广告、教育等场景抢占先机。

对用户/开发者/创作者的影响

对普通用户来说,Seedance 2.5 意味着可以用更少的提示词操作,生成一个情节完整、镜头连贯的 30 秒短片,不再需要反复拼接多个片段。对创作者和短视频团队而言,多模态参考能力的提升是更实际的变化:创作者可以一次性上传角色图、场景参考、音频素材,让模型同时保持多个人物形象和声音的一致性,这在群像叙事和广告分镜场景中能显著降低前期筹备与后期重拍的成本。时间戳编辑功能则让“改第几秒的画面”成为可能,减少因局部调整而整体重来的概率。对开发者来说,API 即将接入火山方舟意味着可以将视频生成能力嵌入自有应用,但需要关注调用成本、并发限制和生成耗时——目前官方尚未公布 API 价格,这些参数将直接影响开发者是否愿意把长视频生成接入到高频生产流程中。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

有几个观察点值得跟进。第一,API 的实际定价与生成速度:30 秒长视频的推理成本明显高于短视频,火山方舟上线后的计费方式,将在很大程度上决定这项能力是成为专业生产工具,还是停留在尝鲜阶段。第二,多轮延长的稳定性边界:官方示例展示了亮点,但长视频生成中常见的“油腻感”、多主体交互的物理合理性等问题是否真正解决,需要更多真实用户的长测反馈。第三,竞品的跟进节奏:快手可灵、OpenAI Sora 等是否有类似长度的生成能力或更灵活的编辑方案,将影响短视频创作者的工具选择。

来源:字节 Seed:Research Feed(网页内嵌数据)

celebrityanime
celebrityanime
文章: 16198

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注