字节跳动正式发布 Seedance 2.5:单次生成 30 秒,支持 50 个多模态参考
字节跳动于 2026 年 7 月 31 日正式发布新一代视频生成模型 Seedance 2.5,重点升级长视频叙事、多模态参考和局部编辑能力,并开始进入汽车、工业制造与具身智能等生产场景。
2026 年 7 月 31 日,字节跳动正式发布新一代视频生成模型 Seedance 2.5。这次更新延续 Seedance 2.0 的多模态音视频联合生成架构,重点补强长叙事、多素材参考和视频编辑能力。模型正陆续上线即梦 AI、豆包专业版等字节旗下产品,API 服务计划近期通过火山方舟开放。
对创作者和小团队来说,最直接的变化是:一次生成可以覆盖最长 30 秒,参考素材上限增加到 50 个,已经生成的视频还能按时间点和局部区域继续修改。AI 视频的工作重心因此会从“反复抽卡找可用镜头”,逐步转向“先组织素材与镜头,再对结果定向迭代”。
这次更新把长视频控制拆成了三件事
Seedance 2.5 的能力升级集中在时长、参考输入和编辑三个环节。它们并不是互相独立的参数,而是共同决定一条较长视频能否稳定交付。
能力 | 已公布的信息 | 对制作流程的影响 |
|---|---|---|
长叙事 | 单次生成最长 30 秒,并支持多轮延长 | 减少短片段拼接,给完整广告段落和多镜头叙事留出空间 |
多模态参考 | 最多输入 30 张图片、10 段视频和 10 段音频 | 可分别约束人物、商品、动作、镜头与声音节奏 |
局部编辑 | 支持时间戳控制、绿幕编辑、视角编辑和参考编辑 | 修改局部内容时,不必从头重做整段视频 |
多语言 | 原生支持 10 余种语言 | 更适合批量制作面向不同市场的内容版本 |
30 秒的价值在于减少“接缝”
Seedance 2.5 可以单次生成 30 秒视频片段,并继续多轮延长。字节跳动同时优化了镜头衔接、场景过渡、画质、音质和运动质量,目标是在更长时间里维持人物、环境与视听语言的一致性。
30 秒并不只是把短视频拉长一倍。它足以容纳一条简短广告的开场、产品动作、使用场景和收尾,也能让教学演示或剧情片段形成一个完整段落。过去需要分别生成再剪辑的几个镜头,现在可以先尝试在一次生成里完成,减少角色外观、光线和运动方向在拼接处跳变。
不过,最长时长不代表每次都应该直接生成 30 秒。镜头越多、人物关系越复杂,验证成本通常越高。小团队更适合先用短版本确认主体和视觉方向,再扩展到完整长度。
50 个参考素材让输入更接近制作 brief
参考生模式最多支持 30 张图片、10 段视频和 10 段音频。除了常见的人物、商品和场景图片,模型还加强了对白、音效、白模、绿幕、运动与创意参考能力。
这给复杂项目带来更细的分工方式:图片负责锁定角色或商品,视频负责规定动作和运镜,音频负责节奏、对白或环境声,白模则可用于表达空间结构与镜头位置。团队可以把品牌素材和制作要求直接组织进同一个生成任务,而不是只靠一段很长的提示词描述所有细节。
素材数量增加也会带来新的管理问题。如果多个参考互相冲突,模型仍然需要判断优先级。比较稳妥的做法是给每份素材明确一个任务,并在生成前删除重复、低质量或风格矛盾的参考。
局部编辑比“重新生成一次”更接近生产流程
Seedance 2.5 新增更精确的视频局部编辑能力。用户可以用时间戳指定需要修改的片段,并对背景、商品、人物、视角或绿幕区域做定向调整,同时尽量保留原有画面的节奏与其他元素。
这一能力瞄准的是 AI 视频制作中很常见的返工:一个商品外观不对、某个动作需要替换,或者客户只要求修改背景。过去重新生成整段视频,常常会丢掉已经满意的表演、运镜和光线。局部编辑如果能稳定保留未选区域,就能减少返工范围,也更适合广告、电商和客户项目的多轮审稿。
实际效果仍需要按场景测试。尤其是人物遮挡、复杂运动、反射和光影联动等画面,局部变化可能影响周围区域。正式项目应把“修改后主体正确”和“未修改区域保持稳定”分别列入验收标准。
字节开始把视频模型推向实体产业
这次发布不只面向内容创作。徐工集团、小鹏汽车、穹彻智能、微分智飞、灵初智能等企业已确认合作,并在工业培训、产品设计、机器人训练和飞行具身等方向探索 Seedance 系列模型。
- 徐工集团将其用于工业操作培训和工序 SOP 视频,尝试降低实拍与 3D 动画成本。
- 小鹏汽车把相关能力接入内部 AI 设计平台,辅助产品设计阶段的可视化创作。
- 穹彻智能用视频生成扩充具身智能训练数据,降低逐台使用实体机器人采集数据的依赖。
- 微分智飞尝试生成障碍物闪避、室内寻路、目标锁定和复杂镜头运动等飞行机器人数据。
这些应用与广告出片有一个共同点:模型需要理解动作前后关系和场景变化。区别在于,产业场景对物理合理性、数据准确度和可验证性的要求更高。生成视频可以补充罕见路况、极端天气或高成本操作素材,但不能因为画面看起来真实,就直接当成可靠训练数据。筛选、标注、仿真验证与真实数据对照仍然不可少。
小团队最值得先测的两个环节
Seedance 2.5 的公开入口正在陆续铺开,火山方舟 API 尚待近期上线。现阶段不必急着重做全部视频流程,可以先准备两类测试。
- 用同一组品牌素材生成完整 30 秒片段。 记录人物、商品、场景和声音在不同镜头中的一致性,以及可用片段占比。
- 对一个已满意的版本做局部修改。 分别替换商品、背景或某个时间点的动作,检查未修改区域是否漂移,并统计返工次数。
测试时要保留提示词、参考素材版本、生成参数、人工修改时间和最终可用率。只有把这些成本一起记录,才能判断 30 秒直出和局部编辑是否真的缩短了交付周期。
目前,字节跳动尚未在本次正式发布信息中明确完整 API 价格、开放范围和稳定的服务等级。第三方页面提到的原生 4K、10-bit 色深等规格,也缺少同等可信度的官方确认。对准备接入 API 的开发者来说,下一步最值得关注的是火山方舟的正式文档、计费方式、并发限制和内容审核规则。