登录

Seedance 2.5实测:从「片段」到「叙事」,AI视频的下半场开始了


速读:第二阶段比的不是画面,是叙事。 此外,2.0时代的一个众所周知的痛点是:生成了一段90分的视频,但有一个细节不对——比如背景里有个不该出现的元素,或者商品颜色偏了。
Seedance 2.5 实测:从「片段」到「叙事」,AI 视频的下半场开始了|AI 上新

Seedance 2.5 实测:从「片段」到「叙事」,AI 视频的下半场开始了|AI 上新

2026年08月02日 12:32

极客公园

30 秒视频直出不是参数升级,是创作方式的切换。

5 个月前,我们在体验 Seedance 2.0 那篇「AI 上新」的时候,提到了一个关键判断——「AI 视频第一阶段的比赛,结束了」。

看完之后,我一直在想一个问题:第二阶段是什么?第一阶段比的是谁能生成更好看的画面、更连贯的动作、更稳定的输出。Seedance 2.0 把这条线拉得很高。但「好看」解决了之后呢?

7 月 31 日,字节正式发布了 Seedance 2.5,同步上线即梦、豆包专业版、扣子和小云雀。

我立即重新打开我已经吃灰许久的即梦账号,花重金充值了会员,花了一个下午把它从头到尾跑了一遍,现在可以回答那个问题了:

第二阶段比的不是画面,是叙事 。

01

从 15 秒到 30 秒

先说最直观的变化。Seedance 2.0 单次生成上限是 15 秒,2.5 直接翻倍到了 30 秒。

这个数字看起来只是参数升级,但用过就知道不是。15 秒能做什么?一个镜头,一个动作,一个表情。你可以做出一个很好看的片段,但它只是片段。30 秒能做什么?一个完整的情绪弧线——有起承转合,有铺垫,有高潮,有收束。

实测为例。

提示词:

30 秒电影级短片,黄昏光线。一个科技记者坐在咖啡馆窗边,盯着笔记本电脑屏幕上的空白文档,表情焦虑。他喝了一口咖啡,放下杯子,开始敲键盘,起初很慢,然后越来越快。窗外的光线从暖黄变成深蓝。最后他停下来,盯着屏幕露出一个微笑,合上笔记本。镜头从他的侧脸慢慢拉远,穿过玻璃窗,看到整条街的灯亮起来了。风格克制、安静、有呼吸感,像是枝裕和的日常叙事。钢琴为主的轻配乐。

在这 30 秒里情绪层层递进,BGM 卡着节奏推上去。这在 2.0 时代是不可想象的,那时候想要一个满意的结果,抽卡十几次是常态。

更关键的是延长能力。

30 秒只是单次原生生成的上限, 通过即梦的延长功能,可以把一段视频续到 3 分钟 。内测期间有人做过测试:一个女孩走进便利店、拧开汽水瓶盖、便利店开始融化变成荧光海——整个 3 分钟的叙事里,女孩的驼色大衣和马尾辫没有任何跳变。

再看下面这个例子。

提示词:

20 秒温情短片,室内暖光。一个年轻人推开家门,玄关灯亮,他看到餐桌上摆好了饭菜,厨房里妈妈正在炒最后一道菜。妈妈听到声音回头看了一眼,没说话,笑了一下,继续炒菜。年轻人放下背包,走到厨房门口靠着门框站了一会儿,表情从疲惫变成柔软。固定机位,不运镜,用画面纵深表现两人的距离感。没有对白,只有炒菜的声音和油烟机的嗡嗡声。2000 年代家庭剧质感,暖黄色调,轻微胶片颗粒。

这意味着什么?AI 视频不再是做「素材」的工具了。它开始能讲故事。

此外,Seedance 2.0 支持最多 9 张图片、3 段视频、3 段音频作为参考素材。 2.5 把这个上限拉到了 50 个全模态参考——图片、视频、音频、文字,混着来 。

50 这个数字有多夸张?知乎上有人评论说,「生图天花板的模型也就十来个参考还会崩脸,50 个参考都不崩的话那是天顶星科技」。

提示词:

一镜到底,机场航站楼内部。镜头从候机大厅的落地玻璃窗开始,窗外一架宽体客机正在缓慢滑行。镜头向右平移,经过几排座椅上的等待旅客,穿过免税店的玻璃门,沿着通道持续推进,最后到达登机口,一个穿制服的地勤人员正在扫描登机牌。全程手持跟拍质感,画面微晃,自然光为主,有广播背景音和行李轮拖行的环境声。纪录片风格,像 NHK 的日常观察镜头。

这个能力主要面向两类需求。一类是品牌内容——你需要在一条视频里保持多个演员形象一致、视觉系统统一、场景美术风格稳定。以前这需要逐帧检查、反复重生成,现在一次性把参考素材喂进去就行。

另一类是影视前期制作的概念验证——导演可以把分镜、角色设定、参考镜头、背景音乐一股脑丢进去,直接看效果。

提示词:

让这张照片动起来,保持原图的光线和氛围,15 秒。

同步新增的还有白模和绿幕参考能力。即梦现在支持 Maya 和 Blender 插件唤起,可以用 3D 白模做预演,然后让 Seedance 2.5 把它「填充」成实拍质感的画面。这等于把 AI 视频生成直接接进了专业影视的工业管线。

此外,2.0 时代的一个众所周知的痛点是:生成了一段 90 分的视频,但有一个细节不对——比如背景里有个不该出现的元素,或者商品颜色偏了。你的选项只有两个:要么接受瑕疵,要么整段重新生成,赌下一次能不能更好。

2.5 加了局部编辑。 你可以框选画面的某个区域,只改那一块,其他部分保持不动 。背景不对?换背景。商品颜色偏了?改颜色。人物表情不到位?重新生成那张脸。

这个功能的意义不在于技术本身,在于它改变了创作者和 AI 之间的协作方式。以前是「生成—判断—重来」的循环,现在变成了「生成—微调—完成」的流程。后者的效率高一个量级。

还有一个容易被忽略的升级:文字渲染。2.0 生成的视频里如果出现文字,大概率会变成乱码。2.5 在这方面好了很多。

主题:叙事|AI视频|Seedance2.5实测||AI上新