字节跳动Seedance 2.5发布:30秒一镜到底,AI视频开始会讲故事了
字节跳动正式发布 Seedance 2.5 视频生成模型,将单次视频生成时长从 15 秒翻倍提升至 30 秒。该模型将陆续上线即梦 AI 与豆包专业版,API 服务也将于近期接入火山方舟,面向影视、广告、教育、工业制造乃至自动驾驶等多场景开放。

官方称,Seedance 2.5 延续了统一的多模态音视频联合生成架构,核心突破在于长叙事能力、多模态参考和编辑能力的全面提升。简单来说,AI 视频不再只是生成一个零散片段,而是可以完成一段有起承转合的完整创作。
30 秒内组织多镜头叙事,多轮延长保持一致
在官方展示的示例中,一段歌手一镜到底登台演出的片段完整呈现了叙事逻辑:镜头从红色幕布缝隙推进至暖色后台化妆间,年轻女歌手整理耳机,工作人员提醒登台,随后她穿过通道与舞伴互动、接过麦克风,最终登上舞台——镜头拉远至体育馆全景,观众、灯牌、荧光棒和欢呼声尽收眼底。模型可在 30 秒内组织铺垫、推进、转折、收尾等多个逻辑关联的镜头。
多轮延长能力同样惊艳——模型可在已有视频基础上继续生成 30 秒,并保持人物主体、场景、画面风格乃至声音和音效的一致性。官方示例中小男孩抱着足球跑出地铁车厢、男主追赶并最终抓住小男孩的连续动作一气呵成,毫无跳脱感。
30 张图、10 段视频一起投喂,群像叙事无压力
Seedance 2.5 支持用户单次输入最多 30 张图片、10 段视频、10 段音频作为参考素材。模型可综合理解不同素材中的构图、场景、风格、人物和道具等元素,并按指令精准用于视频生成。在多人同框场景中,它还能同时还原多人形象与声音并保持主体稳定——官方展示的 30 秒音乐会片段采用 16 比 9 横屏、电影感写实风格,参考素材覆盖钢琴家、大提琴、小提琴、主唱、管弦乐队、合唱团和观众席。当 AI 视频从" 特效 玩具"进化到能驾驭完整叙事和群像调度,短视频创作的工具箱恐怕又要重写一回了。
主题:Seedance2.5|AI视频|模型可