Seedance 2.5 与短剧:30 秒杀掉接缝,50 个参考位杀掉换脸
每次 AI 视频模型发布,解读方式都一样:数字变大了,所以片子变好了。Seedance 2.5 被普遍写成 「现在能出 30 秒了」——而这个框架,对短剧来说恰好错在一个很有用的地方。
30 秒不等于一集。一条竖屏短剧正片是 60 到 120 秒的多镜头叙事,所以 30 秒上限连半集都不到。 30 秒真正给你的,是一个完整情绪节拍能一镜到底拍完——而拼接片段之间的那道接缝,正是 「一眼看出这是业余 AI 短剧」最稳定的破绽。升级点在这里,不在长度。
本文事实核对时间为 2026 年 7 月 31 日,依据公开报道与厂商通告。这个赛道每月都在重排, 下预算前请先点开引用链接确认。
字节到底宣布了什么
Seedance 2.5 于 2026 年 6 月 23 日在字节跳动火山引擎 FORCE 大会(北京)上发布。已确认的 规格,据 The Next Web 的报道:
| 能力 | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| 原生单镜头时长 | 约 15 秒 | 30 秒 |
| 分辨率 | 原生 4K(10 bit) | 原生 4K(10 bit) |
| 多模态参考输入 | 约 12 个 | 最多 50 个 |
| 音频 | 音视频统一架构 | 与画面在同一潜空间联合处理 |
| 指令遵循 | 基线 | 约提升 20%(厂商口径) |
字节直接跳过了 2.1 到 2.4,从 2.0 一步迈到 2.5,用版本号表示这是代际变化而不是小版本迭代。
接下来是多数报道会一笔带过的部分。截至 2026 年 7 月下旬,Seedance 2.5 对本文大多数读者来说 还不是一个能用的东西:它进入的是企业封闭测试,公开访问被限制在字节自家的国内产品面 ——即梦(Dreamina)、豆包、剪映;公开上线目标从「7 月初」推迟到 7 月 31 日; 官方按秒计费的 API 价格至今未公布。美国市场没有给出任何时间表。
实操准则: 在为一部剧重排制作计划之前,先把「已发布」和「能调用」分开。调不到的规格表 是路线图条目,不是工具。

示意图:DramaSo —— 从短剧约束读 2.0 到 2.5 的差值。
真正被改变的是接缝,不是长度
「30 秒!」的标题跳过了这道算术题。
一个短剧节拍——表白、那记耳光、揭穿总裁其实就是那个外卖员——通常是 15 到 30 秒的连续画面。 在 15 秒上限下,你只能把这个节拍拆成两三条分别生成,再硬接起来。每一处接口都是一个光会跳、 头发会复位、房间混响会断、外套颜色会变的地方。观众说不出哪里不对,他们只是不再相信这场戏。
到了 30 秒,同一个节拍装进一次生成。你做的不是更长的视频,而是每分钟故事里更少的接口。 对一条 90 秒的正片来说,情绪高点上的接缝数从每个节拍两三处,直接降到零。
这个重新框定也会改变你拿到能力后该怎么花它。诱惑是把 30 秒花在一个大气的建立镜头上; 真正的回报是把它花在你以前不得不劈成两半的那段对话上。
实操准则: 把你手上最长的镜头给情绪最重的节拍,而不是画面最美的那个。接缝出现在大远景里 是便宜的,出现在表白中途是致命的。
50 个参考位是「剧集级」的杠杆
如果这次发布你只看一个数字,看这个:参考输入从约 12 个涨到 50 个。
时长是镜头级杠杆——它改善一次生成。参考容量是剧集级杠杆,因为真正杀死 AI 短剧的 从来不是片段长度,而是你的主角到第七集脸就飘了。我们在 短剧 AI 视频模型横评里完整论证过这一点, 而 2.5 是第一个把这个数字往上推的版本。
50 个位置足够把一套真正的制作圣经塞进一次调用:每个主角一整套角色设定图(正面、四分之三侧、 正侧),服装连戏板,两三张场景参考,一张灯光板,加一个风格参考——而且能同时装下不止一个角色。 作为对照,同一篇 TNW 报道提到 Google 的 Veo 3.1 只接受最多 3 张参考图。
这里有一个必须说清的坑,而且它对这个赛道里每个模型都成立:一致性只在一次生成内部成立。 50 个参考位不会让模型下周二在一个全新会话里记得你的主角。跨集的角色锁定是一个工作流能力, 必须住在模型之上的那一层。

截图:DramaSo —— 从第 1 集活到第 40 集的参考资产库。
2.5 没有解决什么
三件事,而且正是决定你能不能把一部剧做完的那三件。
它没给你一集。 30 秒是一个节拍。一条 90 秒正片依然是三到五次生成,它们之间必须在脸、 服装、房间和影调上互相对得上。接缝更少不等于没有接缝。
它什么都不记得。 每个新会话都从零开始。所以你这个月真正在攒的资产不是提示词,而是那套 可以重新喂给任何一个最终胜出的模型的参考库和分镜表。
它没有定价。 字节至今没有公布 2.5 的官方按秒价格。唯一的公开信号是一条外流的即梦积分 口径:30 秒 720p 大约 660 积分,高于现有 Seedance 2.x 的按秒阶梯(按档位约每秒 0.04 到 0.353 美元)。更长的单镜头上限不自动等于更便宜——token 消耗随宽 × 高 × 帧率放大, 所以一条 30 秒 4K 的账单显著高于两条 15 秒 720p。

示意图:DramaSo —— 一条 30 秒 4K 对比两条 15 秒 720p。
实操准则: 预算按「单价 × 秒数 × 每场镜次 × 场数」算。两条镜次就拿下一个节拍的模型, 比需要六条的便宜模型更省;而 30 秒上限会诱惑你用满长镜头去打草稿。
拿到权限之前就该做的准备
上面没有一件事需要等。让 2.5 值钱的准备工作今天就能做,而且如果它的开放时间再一次推迟, 这些准备可以整体平移到 Kling、Veo 或 Runway 上。
- 把分镜表按节拍块重写,而不是按片段时长。 别再写「镜 4:6 秒」,写「节拍 2:表白, 约 24 秒,一镜」。我们的分镜表模板带时长列,就是为这件事准备的—— 按节拍给行定长度,再拿总和去对你手上模型的上限。
- 参考清单按角色整理,不按镜头整理。 三个角度、一张服装板、一张灯光参考。这就是 50 个 输入位真正想吃的东西,也是模型换代后还能留下的东西。
- 先排整部剧,不是单场戏。 用AI 分镜生成器在花掉 第一个生成额度之前先定死机位和走位,再用AI 剧集生成器 让第 40 集看起来还像第 1 集。
最后一点就是全文的论点。裸模型给你镜头;短剧是一整季——一个前提、一套演员、一个视觉世界、 几周后才回收的悬念。DramaSo 就站在这个制作层上:从一个前提排出整季,每个角色锁一次, 让形象、服装和指定音色带进后面每一集,拿到词级唇形同步和安全区字幕,导出带字幕的原生竖屏 9:16。可以从AI 短剧生成器开始;如果你还在挑工作流, 先读如何用 AI 做抖音/TikTok 短剧—— 工作流具体了,选模型就变简单了。

示意图:DramaSo —— 镜头选模型,剧集选制作层。
实操准则: 花在参考纪律上的每小时都与模型无关;花在某一家提示词语法上的每小时, 都会在他们下个版本作废。
常见问题
现在能用上 Seedance 2.5 吗?
在多数市场还不能。它在 2026 年 6 月 23 日发布后进入企业封闭测试,上线初期的公开访问仅限字节 自家的国内产品面——即梦、豆包和剪映。公开上线目标从 7 月初挪到了 2026 年 7 月 31 日, 美国市场尚未公布任何开放时间表。
30 秒单镜头意味着能一次生成一整集吗?
不能。竖屏短剧正片通常是 60 到 120 秒的多镜头叙事,30 秒不到半集。真正的收益是:一个情绪节拍 ——通常 15 到 30 秒——现在能一镜到底拍完,而不必由两三条片段拼起来。
Seedance 2.5 多少钱?
截至 2026 年 7 月 31 日,字节没有公布官方按秒价格。唯一公开信号是外流的即梦口径:30 秒 720p 约 660 积分;现有 Seedance 2.x 的按秒阶梯按档位约为每秒 0.04 到 0.353 美元。你在别处看到的 任何确定数字,都请当成估算。
做短剧,Seedance 2.5 比 Veo 3.1 更好吗?
两者胜在不同的轴上。Seedance 2.5 的招牌优势是 30 秒原生单镜头和最多 50 个多模态参考位 (Veo 3.1 是 3 个);Veo 3.1 的优势是已经普遍可用,并且能生成 48kHz 同步对白。对以台词为 生命线的品类,「能用 + 唇形质量」往往比参考容量更重要——详见我们的 模型横评。
50 个参考位能让主角跨集保持一致吗?
只在一次生成内部有效。更多参考位让单次调用可控得多,但目前没有任何模型能在下周一个全新会话里 记得你的主角。跨集一致性是工作流能力——制作层的角色锁定——不是裸模型能力。
等开放的这段时间该做什么?
攒与模型无关的资产:一份按节拍块而不是固定片长写的分镜表,以及一份按角色整理的参考清单 (三个角度、服装板、灯光参考)。两者都能直接平移到你最终用上的任何模型,而且正是 50 个输入位 被设计来消费的东西。