视频模型

Seedance 2.5 正式发布:单次生成30秒视频,50个参考输入,AI视频从片段走向成片

2026年8月1日3 次阅读
Seedance 2.5 正式发布:单次生成30秒视频,50个参考输入,AI视频从"片段"走向"成片"

Seedance 2.5 正式发布:单次生成30秒视频,50个参考输入,AI视频从"片段"走向"成片"

ByteDance 今日正式发布 Seedance 2.5,将单次视频生成时长从 15 秒翻倍至 30 秒,支持多轮扩展至数分钟,同时大幅升级多模态参考(最多 50 个输入)和精确编辑能力。这不是一次简单的版本迭代——当 AI 视频从"生成一个片段"跨越到"完成一部作品",创作流程本身正在被重写。

30 秒单次生成:从"片段"到"故事"

之前行业主流 AI 视频模型的单次生成时长在 5-15 秒之间。15 秒够展示一个动作、一个场景,但讲不了一个故事。Seedance 2.5 把这个上限推到 30 秒,而且不是简单地把画面拉长——模型在 30 秒内可以组织起"起承转合"的完整叙事。

官方演示中,一段歌手表演的提示词让模型生成了完整的故事线:歌手在后台化妆间调整耳返 → 工作人员提醒上场 → 穿过后台走廊与舞者汇合 → 走上舞台开始演出。这不是一个静态画面的延伸,而是有逻辑推进的多场景叙事。

更关键的是多轮扩展能力。生成完第一个 30 秒后,可以继续追加后续镜头,模型会保持角色外观、场景风格和叙事节奏的一致性。这意味着创作者可以一次产出数分钟的连续视频,不再需要手动拆分、反复拼接、修补转场。

作为对比,同日发布的 MiniMax H3 单次最大生成时长仍为 15 秒。在需要连续叙事的场景——30 秒广告、电影预可视化——Seedance 2.5 有结构性优势。

50 个参考输入:复杂创作终于有了"画板"

Seedance 2.5 将单次参考输入容量提升到 30 张图片 + 10 段视频 + 10 段音频,共 50 个。相比上一代约 12 个参考输入,容量翻了 4 倍多。

这解决了一个实际痛点:之前做多角色场景时,参考素材不够用,模型难以同时保持多个角色的外观和声音一致。现在每个角色可以有独立的参考图,场景有参考视频,声音有参考音频,模型能综合理解所有素材并统一应用到生成结果中。

实际场景举例:一支广告片需要展示 5 个产品、3 个角色、2 个场景,每个都有参考素材——在 Seedance 2.5 里可以一次性输入,模型同时处理;在之前的版本里,只能分批生成再手动对齐。

精确编辑:从"整段重来"到"局部修改"

Seedance 2.5 引入了时间戳级别的编辑控制。创作者可以指定修改视频的哪一秒、哪一部分,而不需要整段重新生成。

具体来说:

  • 时间戳控制:指定"第 8-12 秒的背景换成城市夜景",其余部分不受影响
  • 绿幕编辑:替换背景的同时保持前景主体完整
  • 运镜编辑:调整镜头运动方式,不改变画面内容
  • 参考编辑:用新参考素材替换特定元素(如换一个产品、改一段文字)

这把 AI 视频编辑从"不满意就重来"推进到"不满意就改那一处",对专业制作流程的效率提升是实质性的。

画质与音画同步:减少"AI 味"

AI 生成视频最常被诟病的"假感"——物体纹理不自然、皮肤和眼睛细节缺失、光照色彩过度饱和——Seedance 2.5 做了系统性优化。同时减少了非受控字幕和背景音乐的随机出现,让成片更接近实拍质感。

音画同步方面,Seedance 2.5 延续了 2.0 的音画联合生成架构,音频和视频在同一个推理过程中生成,而非先生成视频再配音频。在 30 秒的时长内,这种原生同步避免了音画漂移的问题。

发布节奏与获取方式

Seedance 2.5 的发布经历了三个阶段:

  • 6 月 23 日:Volcano Engine FORCE 大会发布企业版预览
  • 7 月初:有限公测
  • 7 月 31 日:全量发布

目前即梦 AI 和豆包 Pro 已上线 Seedance 2.5,API 接入即将通过火山引擎 ModelArk 开放。ByteDance 在 6 月大会上透露,企业版 Seedance 平台年化收入已达 20 亿美元,商业化速度在 AI 视频领域位居前列。

行业位置:竞争焦点从"能不能生成"转向"能不能讲完一个故事"

7 月 31 日是 AI 视频的密集发布日。MiniMax H3 同日推出,主打原生 2K 分辨率和 $7.80/分钟的低成本(不到竞品三分之一),但在单次时长和参考容量上不及 Seedance 2.5。

两家选择了不同的竞争方向:MiniMax H3 走"便宜且清晰"的路线,Seedance 2.5 走"长且可控"的路线。这反映出一个行业趋势——AI 视频的竞争焦点正在从"能不能生成一段视频"转向"能不能讲完一个完整的故事"。当单次生成突破 30 秒、参考输入达到 50 个、编辑可以精确到时间戳,AI 视频工具正在从"玩具"变成"工具"。

基于多家媒体转述整理。

参考来源

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...