Как создавать 30-секундные AI-видео с Seedance 2.5
Seedance 2.5 создает 30-секундные клипы одним кадром. Как структурировать промпт, сохранять консистентность на 50 референсах и вызывать это через API, шаг за шагом.

TL;DR
- Структурируйте промпт в три такта: завязка, действие или раскрытие, завершающий кадр. Seedance 2.5 лучше следует сценической архитектуре, чем одному длинному сбивчивому описанию.
- Одно референсное изображение на каждый объект: кадр каждого персонажа, продукта или реквизита. Изображения сохраняют внешний вид на протяжении 30 seconds гораздо лучше, чем слова.
- Одна дуга движения, а не пять: одно движение камеры или сюжетное действие ("walks to the window as the camera tightens"). Используйте длительность для замедленного движения, а не для хаоса.
- Исправляйте через редактирование области: измените один неправильный элемент вместо повторной генерации с потерей удачных частей.
- Помните об ограничении: 2.5 запускается в 720p. Нативное 4K уже на подходе, но пока недоступно.
Seedance 2.5 — первая модель, которая создает настоящий 30-секундный клип за один раз, без склейки. Такая длительность дает большие возможности, и ее легко потратить впустую. Дайте ей расплывчатый абзац — и получите 30 seconds блуждания. Дайте ей структурированный бриф — и получите связную сцену. Вот как добиться второго.
Почему один дубль на 30 секунд меняет подход к промптингу?
Потому что теперь вы режиссируете сцену, а не описываете кадр. Старые модели создавали настолько короткие клипы, что для них хватало одного предложения. Тридцать секунд достаточно, чтобы вместить начало, середину и конец, поэтому модели нужны начало, середина и конец, на которые она будет ориентироваться. Дайте ей одно плоское описание, и она начнет блуждать, потому что ничто не подсказывает ей, как кадр должен развиваться со временем.
В этом и состоит сдвиг мышления. Вы пишете шот-лист, а не подпись. Остальная часть этого руководства посвящена тому, как написать такой шот-лист, чтобы Seedance 2.5 действительно ему следовала.
Как разделить 30 секунд на три бита?
Примерно по десять секунд на каждый, одна задача на бит. Первый бит задает сцену и представляет объект. Второй делает основную работу: действие, показ продукта, поворот в истории. Третий завершает ролик: финальный жест или пауза, которая дает клипу концовку вместо резкой остановки.
Нужны ли каждому клипу ровно три? Нет, но три — оптимальный вариант для 30 секунд. Два бита могут ощущаться слишком тонко для такой длительности, а пять превращают ролик в хаотичный монтаж, который модель не может удержать. Сохраняйте одну локацию и одну дугу движения под всеми тремя битами, чтобы они ощущались как моменты одной сцены, а не как отдельные склеенные клипы. Именно такая структура заставляет длинный единый кадр считываться как продуманный.

Как создать 30-секундное видео с Seedance 2.5?
Выполняйте эти шаги по порядку, и вы устраните большую часть смещений уже на первом рендере:
- Разбейте клип на три смысловых блока. Завязка, затем действие или раскрытие продукта, затем финальный кадр. Seedance 2.5 надежнее следует такой структурированной архитектуре, чем одному непрерывному описанию.
- Добавьте референсное изображение для каждого объекта. По одному кадру для каждого персонажа, продукта и ключевого реквизита. Визуальные референсы сохраняют внешний вид на протяжении всех 30 секунд там, где один только текст начинает смещаться.
- Выберите одну дугу движения. Одно развивающееся движение, например персонаж пересекает комнату, пока камера медленно наезжает. Используйте хронометраж для медленного, продуманного движения.
- Зафиксируйте визуальный стиль. Укажите одно настроение освещения и цвета и придерживайтесь его. Противоречивые указания ломают клип.
- Просмотрите перед финальным запуском. Используйте 3D whitebox previz pass, чтобы проверить камеру и движение, затем выполните настоящий рендер.
- Исправляйте с помощью редактирования области. Когда один элемент выглядит неправильно, перерисуйте только его, не генерируйте весь клип заново и не рискуйте теми частями, которые уже получились.
Как написать промпт?
Используйте режиссерский фреймворк и заполняйте его каждый раз в одном и том же порядке: Объект + Действие → Окружение → Визуальный стиль → Камера → Аудио, с явными метками склеек между битами. Этот порядок важен, потому что он сначала выводит на передний план то, за что модель цепляется в первую очередь (кто и что происходит), а уже затем стилизацию.
Вот структура, заполненная для продуктового клипа:
[Beat 1 - setup] A woman in a navy coat stands in a bright minimalist kitchen,
morning light. Camera: slow push-in.
[Beat 2 - reveal] She lifts a matte-black coffee maker onto the counter and
presses the top button; steam rises. Camera: tighten to the product.
[Beat 3 - close] She takes a sip, smiles, looks off-frame. Camera: hold.
Look: warm, clean, commercial. Audio: soft ambient kitchen, no dialogue.Обратите внимание, что это делает. Каждый бит называет объект и действие, затем окружение, затем одно указание по визуальному стилю и одно указание по аудио для всего клипа. Метки склеек дают модели структуру. Это читается как сториборд, потому что именно на это реагирует Seedance 2.5.
Text-to-video или image-to-video?
Seedance 2.5 умеет и то и другое, а правильный выбор точки входа избавит вас от лишних проблем позже. Text-to-video строит всю сцену по вашему промпту, и это правильный ход, когда еще ничего нет и вы хотите, чтобы модель сама придумала визуальный стиль. Image-to-video анимирует уже имеющийся у вас статичный кадр: это подход, когда у вас есть точный кадр, фото продукта, ключевой визуал бренда, и нужно лишь заставить его двигаться.
Для брендовых и продуктовых задач обычно выигрывает image-to-video. Вы начинаете с реального снимка продукта, так что объект уже выглядит правильно, а модель анимирует сцену вокруг него, вместо того чтобы угадывать его форму. Старт с зафиксированного кадра — один из самых надежных способов сохранить 30-секундный клип в рамках бренда. Используйте text-to-video для оригинальных сцен, image-to-video — когда опорный визуал уже существует.
Как сохранять согласованность персонажей и продуктов?
Опирайтесь на референсы, а не на прилагательные. Seedance 2.5 принимает до 50 мультимодальных входных материалов: примерно 30 изображений, 10 видеоклипов и 10 аудиоклипов, и именно здесь этот лимит начинает по-настоящему окупаться. Загрузите четкий снимок каждого персонажа и продукта, которые вы называете в промпте. Модель сопоставляет результат с изображением гораздо надежнее, чем с текстовым описанием вроде "a matte-black coffee maker", которое иначе она будет заново изобретать каждую секунду.
Для повторяющегося персонажа дайте несколько ракурсов: анфас, три четверти, профиль. Для продукта дайте главный кадр и снимок детали. Чем больше модель видит, тем меньше она додумывает, а именно додумывание создает тот эффект «плывущего лица», который сразу кричит об AI. В 30-секундном клипе согласованность в основном сводится к проблеме референсов, и у Seedance 2.5 есть достаточно пространства, чтобы ее решить.
Как вызвать Seedance 2.5 из API?
Генерация видео выполняется как асинхронная задача: вы отправляете запрос, опрашиваете статус, затем скачиваете результат, когда он готов. Через OpenAI-совместимый шлюз вроде Velokey это выглядит так:
import requests, time
BASE = "https://api.velokey.ai/v1"
headers = {"Authorization": "Bearer $VELOKEY_API_KEY"}
# 1. submit the job
job = requests.post(f"{BASE}/videos/generations", headers=headers, json={
"model": "seedance-2.5",
"prompt": "<your three-beat prompt>",
"references": ["https://.../character.png", "https://.../product.png"],
"duration": 30,
}).json()
# 2. poll until it's done
while True:
r = requests.get(f"{BASE}/tasks/{job['id']}", headers=headers).json()
if r["status"] == "completed":
print(r["results"][0]) # video URL
break
time.sleep(5)Это шаблон, а не окончательный список параметров, поскольку точные поля меняются по мере развертывания модели. Актуальную схему запроса, формат ответа и стоимость за видео смотрите в нашем руководстве по API Seedance 2.5, где отслеживаются текущие детали. Преимущество шлюза здесь в том, что переключение на Veo или Kling для другого кадра выполняется тем же вызовом с другим именем модели.
Как насчет аудио в Seedance 2.5?
Новое в 2.5: модель генерирует синхронизированное аудио за тот же проход, так что звук можно задавать прямо в промпте. Делайте это просто. Указывайте одно звуковое намерение на клип, например "soft ambient kitchen, no dialogue" или "upbeat background music," и пусть оно работает под визуальным рядом. Ambient и music — это то, где аудио Seedance сильнее всего.
С плотными диалогами история другая. Если ваш клип держится на том, чтобы реплика прозвучала идеально синхронно, Veo 3.1 все еще лидирует по диалогам 48kHz, и ради этой задачи стоит смириться с более коротким клипом. Но для большинства 30-секундных продуктовых и сюжетных работ ambient-звук и music в Seedance достаточны, а генерация за один проход лучше, чем прикручивать аудио на постпродакшене.
Что насчет разрешения? Нюанс с 720p
Задайте ожидания до рендера: Seedance 2.5 запускается с ограничением в 720p. Нативные 4K и 10-битный цвет в его спецификации есть в планах, но недоступны на старте. Для соцсетей, мобильных устройств и веба 720p достаточно, и вы ничего не заметите. Для клипа, который уже сегодня должен выглядеть четко на большом экране, это реальное ограничение, а Seedance 2.0 по-прежнему выдает 1080p и 4K на более высоких тарифах. Планируйте разрешение исходя из того, где видео действительно будет воспроизводиться.
Как итерировать, не сжигая рендеры?
Сначала самый дешевый способ исправления, самый дорогой — в последнюю очередь. Полный 30-секундный рендер стоит дороже всего, так что не стоит хвататься за него каждый раз, когда что-то слегка не так. Начните с превиза: поймайте проблемы с камерой и движением на whitebox-проходе, прежде чем платить за готовый клип. Потом рендерьте.
Неверная деталь в финале? Отредактируйте область. Перерисуйте один элемент и сохраните все, что уже сработало, вместо того чтобы заново прогонять весь клип и рисковать удачными частями. Полную регенерацию оставьте для случаев, когда не работает вся концепция, а не когда куртка неправильного цвета. Работайте в таком порядке: превиз, затем редактирование области, затем полный повторный рендер только в крайнем случае, и вы потратите лишь малую долю кредитов по сравнению с привычкой перегенерировать все целиком.
Рабочий пример: 30-секундная реклама продукта
Вот весь цикл на одном клипе. Допустим, вы делаете 30-секундную рекламу кофеварки. Сначала соберите референсы: главный продуктовый кадр, детальный кадр и фото вашего ведущего. Затем напишите промпт из трех частей: сцена на кухне, показ продукта и приготовление кофе, финальный глоток, с единым теплым рекламным визуальным стилем и фоновым кухонным звуком. В-третьих, запустите whitebox-превиз и проверьте, что камера действительно приближается к продукту в момент показа, а не раньше.
Что-то не так? Исправьте это на месте. Если куртка ведущего получилась неправильного цвета, отредактируйте область с курткой и оставьте утвержденный кадр приготовления кофе нетронутым. Рендерьте в 720p для версии под соцсети. Если клиенту сегодня нужен мастер в 4K, сгенерируйте этот один кадр на Seedance 2.0 как временное решение, пока не появится 4K в 2.5. Это полноценный производственный проход без необходимости заново генерировать все с нуля.
Каковы распространенные ошибки?
Три ошибки портят большинство попыток на 30 секунд, и всех трех легко избежать, когда вы о них знаете:
- Слишком много всего сразу. Несколько локаций и толпа персонажей в одном 30-секундном клипе — это больше, чем модель способна удержать вместе. Если в вашей идее три места действия и четыре человека, разделите ее на отдельные клипы и соберите их в редакторе. Одна связная сцена на одну генерацию.
- Противоречивое направление. Подсказки, которые конфликтуют друг с другом, например "dark moody noir lighting" и "bright clean commercial look" в одном prompt, дают нечто несвязное. Выберите одно настроение. Выберите одну палитру. Пусть изменение несут биты, а не конфликтующие прилагательные.
- Нет дуги движения. Тридцать статичных секунд — это тридцать скучных секунд. Если ничего не меняется, клип ощущается как застывший render, который держат слишком долго. Добавьте одно движение: push-in, панораму, проход персонажа, чтобы длительность воспринималась как намеренная, а не растянутая.
Если правильно выполнить эти три пункта, структурировать prompt по битам и упомянуть каждый subject, 30 секунд Seedance 2.5 превратятся из лотереи в довольно воспроизводимый результат.
Часто задаваемые вопросы
Какой длины может быть видео Seedance 2.5?
До 30 секунд в одной нативной генерации, вдвое больше 15 секунд Seedance 2.0. Весь клип рендерится за один проход, поэтому он может включать смены сцен и повествовательную дугу без склеивания отдельных клипов. Эти 30 секунд одним дублем — главная возможность модели.
Как написать хороший промпт для Seedance 2.5?
Структурируйте его в три части: завязка, действие и завершение, и используйте режиссерский фреймворк: Subject + Action, затем Environment, Look, Camera и Audio, с метками склеек между частями. Добавьте референсное изображение для каждого объекта. Сохраняйте одно настроение освещения и одну дугу движения на протяжении всего клипа.
Может ли Seedance 2.5 создавать видео в 4K?
Не на запуске. Сегодня Seedance 2.5 ограничена 720p, а нативная 4K есть в дорожной карте для более позднего развертывания. Если вам нужна 4K прямо сейчас, Seedance 2.0 предоставляет ее на более высоких тарифах. Для соцсетей и мобильного вывода стартового разрешения 720p обычно достаточно.
Как сохранить персонажа согласованным на протяжении клипа Seedance?
Используйте референсные изображения, а не текст. Загрузите несколько ракурсов персонажа: анфас, три четверти и профиль, и Seedance 2.5 будет сопоставлять их гораздо надежнее, чем описание. Ее лимит в 50 референсов создан именно для этого, поэтому согласованность в длинном клипе в основном зависит от хороших референсов.
Как исправить одну часть видео Seedance 2.5?
Используйте редактирование области. Оно позволяет перерисовать один элемент, например одежду, фон или продукт, при этом исполнение, движение и освещение остаются зафиксированными. Это лучше, чем перегенерировать весь клип с риском потерять части, которые уже получились правильно. Это самый быстрый способ доработать деталь.
Как вызвать Seedance 2.5 через API?
Отправьте асинхронную задачу с вашим промптом и URL-адресами референсов, опрашивайте задачу до завершения, затем скачайте видео. Через OpenAI-совместимую конечную точку, такую как Velokey, это один запрос с моделью, установленной на Seedance 2.5, а переключение на другую видеомодель — тот же вызов с другим именем.
Стоит ли использовать text-to-video или image-to-video в Seedance 2.5?
Используйте image-to-video, когда у вас уже есть точный кадр, например фото продукта или брендовый визуал, чтобы модель анимировала правильный объект, а не придумывала его. Используйте text-to-video для оригинальных сцен, созданных с нуля. Для брендовых и продуктовых клипов старт с реального изображения — более надежный путь к согласованности на протяжении всех 30 секунд.


