Seedance 2.5 是什么模型?
Seedance 2.5 是字节跳动已公布但尚未正式上线的视频生成模型,支持 30 秒单次生成、最多 50 个多模态参考、区域级编辑和多语言工作流。
ByteDance Seedance 2.5
Seedance 2.5 是字节跳动 Seed 团队于 2026 年 7 月 31 日正式发布的新一代视频生成模型(6 月 23 日 FORCE 大会首次亮相)。它建立在 Seedance 2.0 基础上,官方定位是把 AI 视频从「生成一个片段」推进到「完成一次完整创作」,升级集中在三处:单次生成时长从 15 秒翻倍到 30 秒并支持多轮延长,一个镜头内即可放下完整起承转合、无需分段拼接;单个项目最多接收 50 份全模态参考素材(30 图 + 10 视频 + 10 音频),解决多主体多场景下的形象与风格一致性;编辑粒度细化到可按时间戳分段控制、对特定角色、动作、台词或运镜定向修改。画面上明显减少过度平滑与饱和度过高等 AI 痕迹。目前在即梦 AI 与豆包专业版逐步开放,火山方舟 API 随后提供。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
Seedance 2.5 是字节跳动 Seed 团队于 2026 年 7 月 31 日正式发布的新一代视频生成模型。它最早在 6 月 23 日的火山引擎 FORCE 大会上首次亮相并预告 7 月上线,最终如期发布。
官方对这一代的定位说得很直白:把 AI 视频从「生成一个片段」推进到「完成一次完整创作」。它建立在 Seedance 2.0 的基础上,升级集中在长叙事、多模态素材参考和视频编辑这三件事上。
最核心的变化是单次生成时长从 15 秒翻倍到 30 秒,并支持多轮延长。这个数字看起来只是翻倍,实际影响却是质变:30 秒足以在一个镜头里放下起承转合,创作者不再需要把一条片子切成若干段分别生成、再想办法拼接——而拼接恰恰是过去 AI 视频最容易露馅的地方(人物走形、光线跳变、风格漂移都发生在接缝处)。
Seedance 2.5 单个项目可同时接收 最多 50 份全模态参考素材:30 张图片 + 10 段视频 + 10 段音频。这套设计针对的是多主体、多场景制作中最难的一致性问题——给足参考后,人物形象和视觉风格在整条片子里更容易保持统一。
这一代把编辑粒度做细了:支持基于时间戳对不同片段分别控制,也支持对特定元素做定向修改,比如只调整某个角色、某个动作、某句台词或某段运镜,而不必整条重新生成。官方还提到画面质感的改善,明显减少了过度平滑、饱和度过高这类典型的 AI 视频痕迹,成片更接近专业影视标准。此外官方介绍中还包含原生音频生成与十种以上语言支持。
模型自发布起在即梦 AI 与豆包专业版上逐步开放,火山方舟(BytePlus ModelArk)的 API 接入随后提供。输入支持文本、图像、音频与视频,输出为视频。
官方给出的应用方向除了短片、短剧、广告这些娱乐内容外,还包括教育、工业制造、机器人和自动驾驶等场景——后几类主要利用的是它按指令生成特定场景视频的能力,用于训练数据合成与方案演示。
Seedance 2.5 是字节跳动已公布但尚未正式上线的视频生成模型,支持 30 秒单次生成、最多 50 个多模态参考、区域级编辑和多语言工作流。
当前官方资料记录其支持文本、图像、视频、音频输入,并生成视频输出。
最大输出为 30秒。未公开或无法确认的规格不做推测。
根据已收录的官方能力标签,它适合多语言相关任务;实际效果应结合具体工作流验证。
代码与模型权重按 不开源 记录;使用前仍应核对官方许可原文。
The publisher has announced the model, but it is not yet listed as generally available.
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
