用 Seedance 2.5 做 30 秒 AI 视频怎么做
Seedance 2.5 能出 30 秒单镜。怎么搭提示词、用 50 个参考锁住一致性、以及怎么走 API 调用,一步步讲清。

TL;DR
- 提示词分三段:铺场、动作或揭示、收尾帧。Seedance 2.5 跟场景结构比跟一长串流水描述更靠谱。
- 每个主体一张参考图:每个角色、产品、道具都给一张。图比文字更能在 30 秒里锁住外观。
- 一条运动弧,不是五条:单一的镜头或叙事动作("走到窗边、镜头收紧")。用这个长度做慢动作,不是做混乱。
- 用局部重绘修:只改那个错的元素,别整条重生成、把对的也丢了。
- 注意上限:2.5 首发 720p。原生 4K 在路上、还没到。
Seedance 2.5 是第一个真能一镜出 30 秒、不用拼接的模型。这个长度很强,也很容易浪费。喂它一段含糊的话,你得到 30 秒的漂移。喂它一份结构化的 brief,你得到一个连贯的场景。下面讲怎么做后者。
一镜 30 秒为什么改变了你写提示词的方式?
因为你现在是在导一个场景,不是描述一帧。老模型的片短到一句话就盖住了。30 秒长到能装下开头、中间、结尾,所以模型需要一个开头、中间、结尾去瞄准。给它一段平铺的描述,它就乱走,因为没有东西告诉它镜头该怎么随时间演进。
这就是思路的转变。你写的是一份分镜表,不是一句配文。这篇剩下的部分,就是怎么写那份分镜表、让 Seedance 2.5 真照着走。
怎么把 30 秒切成三段?
每段大约十秒,一段一个活。第一段铺场、引入主体。第二段干真正的活:动作、产品揭示、故事的转折。第三段收尾——一个最后的动作或一个停留,让片子有个结束,而不是硬切。
每条片都得正好三段吗?不,但三段是 30 秒的甜点。两段在这个长度上会显得单薄,五段又把它变成模型抓不住的混乱蒙太奇。让一个地点和一条运动弧贯穿三段,这样这几段像一个场景里的时刻,而不是拼起来的独立片段。这个结构,就是让一条长单镜读起来是刻意的、而不是凑数的。

用 Seedance 2.5 做一条 30 秒视频怎么做?
按顺序走这些步骤,第一次渲染就能清掉大部分漂移:
- 把片子拆成三段。 铺场,然后动作或产品揭示,然后收尾帧。Seedance 2.5 跟这种结构化架构比跟一段连续描述更靠谱。
- 每个主体加一张参考图。 每个角色、产品、关键道具各一张。视觉参考在整整 30 秒里锁外观,纯文字会漂。
- 选一条运动弧。 一个演进的单一动作,比如角色穿过房间、镜头慢慢推进。用这个时长做慢而有意的运动。
- 锁住调性。 定一个光照和色彩情绪,并守住它。互相矛盾的指令会把片子搞坏。
- 正式渲染前先预览。 用 3D whitebox 预可视化 pass 检查运镜和运动,再来真渲染。
- 用局部重绘修。 某个元素错了,只重画那一处,别整条重生成、把已经对的部分也赌上。
提示词怎么写?
用导演式框架,每次都按同一顺序填:Subject + Action → Environment → Look → Camera → Audio,段与段之间用明确的 cut 标签。这个顺序重要,因为它把模型最先锁定的东西(谁、在干什么)排在造型之前。
这是那个骨架,填成一条产品片:
[Beat 1 - 铺场] 一个穿藏青大衣的女人站在明亮的极简厨房里,晨光。
镜头:缓慢推进。
[Beat 2 - 揭示] 她把一台哑光黑咖啡机放到台面、按下顶部按钮;蒸汽升起。
镜头:收紧到产品。
[Beat 3 - 收尾] 她抿一口、微笑、看向画外。镜头:停住。
Look:温暖、干净、商业感。Audio:轻柔的厨房环境声,无对白。注意它做了什么。每一段都点出一个主体和一个动作,然后是环境,然后给整条片一个 look、一个音频方向。cut 标签给了模型结构。它读起来像个 storyboard,因为那正是 Seedance 2.5 会响应的。
文生视频还是图生视频?
Seedance 2.5 两个都做,而选对入口能省你后面的仗。文生视频从你的提示词把整个场景造出来,适合什么都还不存在、你想让模型发明这个 look 的时候。图生视频给你已有的一张静图加上运动,适合你手里就有那一帧——一张产品照、一个品牌主视觉——只需要它动起来的时候。
对品牌和产品活,图生视频通常赢。你从真实的产品照起手,所以那个物体本来就对,模型是围着它做动画,而不是猜它的形状。从一帧锁死的画面起手,是让一条 30 秒片守住品牌最稳的办法之一。原创场景用文生视频,锚点已经存在就用图生视频。
怎么保持角色和产品一致?
靠参考,别靠形容词。Seedance 2.5 吃最多 50 个多模态输入,大约 30 图、10 视频、10 音频,而这正是那个预算发挥价值的地方。把你提示词里点名的每个角色和产品,都上传一张干净的图。模型对着图去匹配,远比对着"一台哑光黑咖啡机"这种文字描述靠谱——否则它每一秒都会重新发明它。
对反复出现的角色,给它几个角度:正面、四分之三、侧面。对产品,给它主图和一张细节图。模型能看到的越多,它猜的就越少,而猜正是产生那种"漂移的脸"、一眼就是 AI 的东西。在一条 30 秒片上,一致性主要是个参考问题,而 Seedance 2.5 有空间去解它。
怎么走 API 调 Seedance 2.5?
视频生成是个异步任务:你提交请求、轮询状态、就绪后下载结果。走一个 OpenAI 兼容网关(比如 Velokey),形状大致是这样:
import requests, time
BASE = "https://api.velokey.ai/v1"
headers = {"Authorization": "Bearer $VELOKEY_API_KEY"}
# 1. 提交任务
job = requests.post(f"{BASE}/videos/generations", headers=headers, json={
"model": "seedance-2.5",
"prompt": "<你的三段式提示词>",
"references": ["https://.../character.png", "https://.../product.png"],
"duration": 30,
}).json()
# 2. 轮询到完成
while True:
r = requests.get(f"{BASE}/tasks/{job['id']}", headers=headers).json()
if r["status"] == "completed":
print(r["results"][0]) # 视频 URL
break
time.sleep(5)这是模式,不是最终参数表——确切字段会随模型铺开而变。当前的请求 schema、响应格式、每条价,跟我们的 Seedance 2.5 API 指南,它跟踪实时细节。网关在这儿的好处是,换到 Veo 或 Kling 做另一个镜头,是同一个调用换个模型名。
分辨率呢?那个 720p 的坑
渲染前先把预期摆好:Seedance 2.5 首发封顶 720p。它规格表上的原生 4K、10-bit 色深在路线图上,首发还没上线。对社交、手机、网页,720p 够用、你根本不会注意。对一条今天就得在大屏上清晰的片,这是实打实的限制,而 Seedance 2.0 在它更高档位上仍能给 1080p 和 4K。按视频最终会在哪播放,来规划分辨率。
怎么迭代才不烧渲染?
先修最便宜的,最贵的留最后。一次完整的 30 秒渲染最贵,所以你不想每次有点不对就上它。先用预可视化:在 whitebox pass 里抓住运镜和运动的问题,再去付一条成片的钱。然后再渲染。
成片里某个细节错了?局部重绘它。重画那一个元素、保住已经对的一切,而不是整条重滚、赌上好的部分。整条重生成留给整个概念都错的时候,不是给一件夹克颜色不对的时候。按这个顺序干——预可视化、然后局部重绘、然后整条重渲染只当最后手段——你花的 credits 会是那种"什么都重滚"习惯烧掉的一小部分。
完整实操例:一条 30 秒产品广告
把整个循环走一遍。假设你在做一条咖啡机的 30 秒广告。第一步,收集参考:产品主图、一张细节图、你出镜人的一张照片。第二步,写三段式提示词——厨房铺场、产品揭示和冲泡、收尾抿一口,配一个温暖的商业 look 和厨房环境声。第三步,跑 whitebox 预可视化,检查镜头是不是真的在揭示那一刻才收紧到产品,而不是提前。
有不对的?就地修。如果出镜人的夹克颜色出错了,局部重绘那件夹克、把已经批准的冲泡镜头留着不动。渲染 720p 出社交版。如果客户今天就要 4K 母版,把那一个镜头在 Seedance 2.0 上生成当过渡,直到 2.5 的 4K 到来。这就是一整套生产流程,全程不用从头重生成。
常见错误有哪些?
三个错误毁掉多数 30 秒尝试,而这三个一旦知道都好避:
- 塞太多。 一条 30 秒片里多个地点加一堆角色,超过模型能兜住的量。如果你的点子有三个场景、四个人,拆成独立片段、在剪辑器里拼。一次生成一个连贯场景。
- 指令自相矛盾。 互相打架的指令,比如同一条提示词里"暗黑压抑的 noir 光"和"明亮干净的商业感",会产出不连贯的东西。选一个情绪。选一个色板。让变化由段落来承载,不是靠打架的形容词。
- 没有运动弧。 30 秒静止就是 30 秒无聊。如果什么都不演进,片子就像一张冻住的渲染被拖太久。给它一个动作——一个推进、一个横摇、一个角色穿过——让这个长度读起来是刻意的,而不是凑的。
把这三个做对,提示词分段、每个主体都给参考,Seedance 2.5 的 30 秒就从赌博变成一个大致可复现的结果。
常见问题
Seedance 2.5 的视频能有多长?
一次原生生成最长 30 秒,是 Seedance 2.0 那 15 的两倍。整条片一次渲染,所以能含场景切换和一个叙事弧,不用拼接独立片段。那个单镜 30 秒是这个模型的招牌能力。
怎么写一条好的 Seedance 2.5 提示词?
把它分成三段——铺场、动作、收尾——并用导演框架:Subject + Action,然后 Environment、Look、Camera、Audio,段间加 cut 标签。每个主体加一张参考图。整条片保持一个光照情绪、一条运动弧。
Seedance 2.5 能做 4K 视频吗?
首发不能。Seedance 2.5 今天封顶 720p,原生 4K 在路线图上、留待后续铺开。如果你现在就要 4K,Seedance 2.0 在它更高档位上能给。对社交和手机输出,720p 首发分辨率通常够用。
怎么让一个角色在整条 Seedance 片里保持一致?
用参考图,别用文字。上传角色的几个角度——正面、四分之三、侧面——Seedance 2.5 对着这些匹配,比对着描述靠谱得多。它 50 个参考的预算正是为这个造的,所以长片上的一致性主要是好参考的问题。
怎么只修 Seedance 2.5 视频的一部分?
用局部重绘。它让你只重画一个元素——衣服、背景、或一个产品——而表演、运动、光照锁住不动。这比整条重生成好,后者有丢掉已经对的部分的风险。它是迭代一个细节最快的办法。
怎么走 API 调 Seedance 2.5?
提交一个带提示词和参考 URL 的异步任务,轮询任务到完成,再下载视频。走一个 OpenAI 兼容端点(比如 Velokey),就是一个请求、模型设成 Seedance 2.5,换到另一个视频模型是同一个调用换个名字。
Seedance 2.5 该用文生视频还是图生视频?
你已经有确切那一帧时用图生视频,比如一张产品照或品牌视觉,让模型给一个正确的物体做动画,而不是发明一个。原创、从零搭的场景用文生视频。对品牌和产品片,从一张真实图起手,是在整整 30 秒里保持一致更靠谱的路。


