Velokey
Руководства

Как создавать 30-секундные AI-видео с Seedance 2.5

Seedance 2.5 создает 30-секундные клипы одним кадром. Как структурировать промпт, сохранять консистентность на 50 референсах и вызывать это через API, шаг за шагом.

Как создавать 30-секундные AI-видео с Seedance 2.5

TL;DR

  • Структурируйте промпт в три такта: завязка, действие или раскрытие, завершающий кадр. Seedance 2.5 лучше следует сценической архитектуре, чем одному длинному сбивчивому описанию.
  • Одно референсное изображение на каждый объект: кадр каждого персонажа, продукта или реквизита. Изображения сохраняют внешний вид на протяжении 30 seconds гораздо лучше, чем слова.
  • Одна дуга движения, а не пять: одно движение камеры или сюжетное действие ("walks to the window as the camera tightens"). Используйте длительность для замедленного движения, а не для хаоса.
  • Исправляйте через редактирование области: измените один неправильный элемент вместо повторной генерации с потерей удачных частей.
  • Помните об ограничении: 2.5 запускается в 720p. Нативное 4K уже на подходе, но пока недоступно.

Seedance 2.5 — первая модель, которая создает настоящий 30-секундный клип за один раз, без склейки. Такая длительность дает большие возможности, и ее легко потратить впустую. Дайте ей расплывчатый абзац — и получите 30 seconds блуждания. Дайте ей структурированный бриф — и получите связную сцену. Вот как добиться второго.

Почему один дубль на 30 секунд меняет подход к промптингу?

Потому что теперь вы режиссируете сцену, а не описываете кадр. Старые модели создавали настолько короткие клипы, что для них хватало одного предложения. Тридцать секунд достаточно, чтобы вместить начало, середину и конец, поэтому модели нужны начало, середина и конец, на которые она будет ориентироваться. Дайте ей одно плоское описание, и она начнет блуждать, потому что ничто не подсказывает ей, как кадр должен развиваться со временем.

В этом и состоит сдвиг мышления. Вы пишете шот-лист, а не подпись. Остальная часть этого руководства посвящена тому, как написать такой шот-лист, чтобы Seedance 2.5 действительно ему следовала.

Как разделить 30 секунд на три бита?

Примерно по десять секунд на каждый, одна задача на бит. Первый бит задает сцену и представляет объект. Второй делает основную работу: действие, показ продукта, поворот в истории. Третий завершает ролик: финальный жест или пауза, которая дает клипу концовку вместо резкой остановки.

Нужны ли каждому клипу ровно три? Нет, но три — оптимальный вариант для 30 секунд. Два бита могут ощущаться слишком тонко для такой длительности, а пять превращают ролик в хаотичный монтаж, который модель не может удержать. Сохраняйте одну локацию и одну дугу движения под всеми тремя битами, чтобы они ощущались как моменты одной сцены, а не как отдельные склеенные клипы. Именно такая структура заставляет длинный единый кадр считываться как продуманный.

Структурируйте 30-секундный клип Seedance 2.5 в три бита: завязка, действие, завершение

Как создать 30-секундное видео с Seedance 2.5?

Выполняйте эти шаги по порядку, и вы устраните большую часть смещений уже на первом рендере:

  1. Разбейте клип на три смысловых блока. Завязка, затем действие или раскрытие продукта, затем финальный кадр. Seedance 2.5 надежнее следует такой структурированной архитектуре, чем одному непрерывному описанию.
  2. Добавьте референсное изображение для каждого объекта. По одному кадру для каждого персонажа, продукта и ключевого реквизита. Визуальные референсы сохраняют внешний вид на протяжении всех 30 секунд там, где один только текст начинает смещаться.
  3. Выберите одну дугу движения. Одно развивающееся движение, например персонаж пересекает комнату, пока камера медленно наезжает. Используйте хронометраж для медленного, продуманного движения.
  4. Зафиксируйте визуальный стиль. Укажите одно настроение освещения и цвета и придерживайтесь его. Противоречивые указания ломают клип.
  5. Просмотрите перед финальным запуском. Используйте 3D whitebox previz pass, чтобы проверить камеру и движение, затем выполните настоящий рендер.
  6. Исправляйте с помощью редактирования области. Когда один элемент выглядит неправильно, перерисуйте только его, не генерируйте весь клип заново и не рискуйте теми частями, которые уже получились.

Как написать промпт?

Используйте режиссерский фреймворк и заполняйте его каждый раз в одном и том же порядке: Объект + Действие → Окружение → Визуальный стиль → Камера → Аудио, с явными метками склеек между битами. Этот порядок важен, потому что он сначала выводит на передний план то, за что модель цепляется в первую очередь (кто и что происходит), а уже затем стилизацию.

Вот структура, заполненная для продуктового клипа:

[Beat 1 - setup] A woman in a navy coat stands in a bright minimalist kitchen,
morning light. Camera: slow push-in.
[Beat 2 - reveal] She lifts a matte-black coffee maker onto the counter and
presses the top button; steam rises. Camera: tighten to the product.
[Beat 3 - close] She takes a sip, smiles, looks off-frame. Camera: hold.
Look: warm, clean, commercial. Audio: soft ambient kitchen, no dialogue.

Обратите внимание, что это делает. Каждый бит называет объект и действие, затем окружение, затем одно указание по визуальному стилю и одно указание по аудио для всего клипа. Метки склеек дают модели структуру. Это читается как сториборд, потому что именно на это реагирует Seedance 2.5.

Text-to-video или image-to-video?

Seedance 2.5 умеет и то и другое, а правильный выбор точки входа избавит вас от лишних проблем позже. Text-to-video строит всю сцену по вашему промпту, и это правильный ход, когда еще ничего нет и вы хотите, чтобы модель сама придумала визуальный стиль. Image-to-video анимирует уже имеющийся у вас статичный кадр: это подход, когда у вас есть точный кадр, фото продукта, ключевой визуал бренда, и нужно лишь заставить его двигаться.

Для брендовых и продуктовых задач обычно выигрывает image-to-video. Вы начинаете с реального снимка продукта, так что объект уже выглядит правильно, а модель анимирует сцену вокруг него, вместо того чтобы угадывать его форму. Старт с зафиксированного кадра — один из самых надежных способов сохранить 30-секундный клип в рамках бренда. Используйте text-to-video для оригинальных сцен, image-to-video — когда опорный визуал уже существует.

Как сохранять согласованность персонажей и продуктов?

Опирайтесь на референсы, а не на прилагательные. Seedance 2.5 принимает до 50 мультимодальных входных материалов: примерно 30 изображений, 10 видеоклипов и 10 аудиоклипов, и именно здесь этот лимит начинает по-настоящему окупаться. Загрузите четкий снимок каждого персонажа и продукта, которые вы называете в промпте. Модель сопоставляет результат с изображением гораздо надежнее, чем с текстовым описанием вроде "a matte-black coffee maker", которое иначе она будет заново изобретать каждую секунду.

Для повторяющегося персонажа дайте несколько ракурсов: анфас, три четверти, профиль. Для продукта дайте главный кадр и снимок детали. Чем больше модель видит, тем меньше она додумывает, а именно додумывание создает тот эффект «плывущего лица», который сразу кричит об AI. В 30-секундном клипе согласованность в основном сводится к проблеме референсов, и у Seedance 2.5 есть достаточно пространства, чтобы ее решить.

Как вызвать Seedance 2.5 из API?

Генерация видео выполняется как асинхронная задача: вы отправляете запрос, опрашиваете статус, затем скачиваете результат, когда он готов. Через OpenAI-совместимый шлюз вроде Velokey это выглядит так:

import requests, time

BASE = "https://api.velokey.ai/v1"
headers = {"Authorization": "Bearer $VELOKEY_API_KEY"}

# 1. submit the job
job = requests.post(f"{BASE}/videos/generations", headers=headers, json={
    "model": "seedance-2.5",
    "prompt": "<your three-beat prompt>",
    "references": ["https://.../character.png", "https://.../product.png"],
    "duration": 30,
}).json()

# 2. poll until it's done
while True:
    r = requests.get(f"{BASE}/tasks/{job['id']}", headers=headers).json()
    if r["status"] == "completed":
        print(r["results"][0])   # video URL
        break
    time.sleep(5)

Это шаблон, а не окончательный список параметров, поскольку точные поля меняются по мере развертывания модели. Актуальную схему запроса, формат ответа и стоимость за видео смотрите в нашем руководстве по API Seedance 2.5, где отслеживаются текущие детали. Преимущество шлюза здесь в том, что переключение на Veo или Kling для другого кадра выполняется тем же вызовом с другим именем модели.

Как насчет аудио в Seedance 2.5?

Новое в 2.5: модель генерирует синхронизированное аудио за тот же проход, так что звук можно задавать прямо в промпте. Делайте это просто. Указывайте одно звуковое намерение на клип, например "soft ambient kitchen, no dialogue" или "upbeat background music," и пусть оно работает под визуальным рядом. Ambient и music — это то, где аудио Seedance сильнее всего.

С плотными диалогами история другая. Если ваш клип держится на том, чтобы реплика прозвучала идеально синхронно, Veo 3.1 все еще лидирует по диалогам 48kHz, и ради этой задачи стоит смириться с более коротким клипом. Но для большинства 30-секундных продуктовых и сюжетных работ ambient-звук и music в Seedance достаточны, а генерация за один проход лучше, чем прикручивать аудио на постпродакшене.

Что насчет разрешения? Нюанс с 720p

Задайте ожидания до рендера: Seedance 2.5 запускается с ограничением в 720p. Нативные 4K и 10-битный цвет в его спецификации есть в планах, но недоступны на старте. Для соцсетей, мобильных устройств и веба 720p достаточно, и вы ничего не заметите. Для клипа, который уже сегодня должен выглядеть четко на большом экране, это реальное ограничение, а Seedance 2.0 по-прежнему выдает 1080p и 4K на более высоких тарифах. Планируйте разрешение исходя из того, где видео действительно будет воспроизводиться.

Как итерировать, не сжигая рендеры?

Сначала самый дешевый способ исправления, самый дорогой — в последнюю очередь. Полный 30-секундный рендер стоит дороже всего, так что не стоит хвататься за него каждый раз, когда что-то слегка не так. Начните с превиза: поймайте проблемы с камерой и движением на whitebox-проходе, прежде чем платить за готовый клип. Потом рендерьте.

Неверная деталь в финале? Отредактируйте область. Перерисуйте один элемент и сохраните все, что уже сработало, вместо того чтобы заново прогонять весь клип и рисковать удачными частями. Полную регенерацию оставьте для случаев, когда не работает вся концепция, а не когда куртка неправильного цвета. Работайте в таком порядке: превиз, затем редактирование области, затем полный повторный рендер только в крайнем случае, и вы потратите лишь малую долю кредитов по сравнению с привычкой перегенерировать все целиком.

Рабочий пример: 30-секундная реклама продукта

Вот весь цикл на одном клипе. Допустим, вы делаете 30-секундную рекламу кофеварки. Сначала соберите референсы: главный продуктовый кадр, детальный кадр и фото вашего ведущего. Затем напишите промпт из трех частей: сцена на кухне, показ продукта и приготовление кофе, финальный глоток, с единым теплым рекламным визуальным стилем и фоновым кухонным звуком. В-третьих, запустите whitebox-превиз и проверьте, что камера действительно приближается к продукту в момент показа, а не раньше.

Что-то не так? Исправьте это на месте. Если куртка ведущего получилась неправильного цвета, отредактируйте область с курткой и оставьте утвержденный кадр приготовления кофе нетронутым. Рендерьте в 720p для версии под соцсети. Если клиенту сегодня нужен мастер в 4K, сгенерируйте этот один кадр на Seedance 2.0 как временное решение, пока не появится 4K в 2.5. Это полноценный производственный проход без необходимости заново генерировать все с нуля.

Каковы распространенные ошибки?

Три ошибки портят большинство попыток на 30 секунд, и всех трех легко избежать, когда вы о них знаете:

  • Слишком много всего сразу. Несколько локаций и толпа персонажей в одном 30-секундном клипе — это больше, чем модель способна удержать вместе. Если в вашей идее три места действия и четыре человека, разделите ее на отдельные клипы и соберите их в редакторе. Одна связная сцена на одну генерацию.
  • Противоречивое направление. Подсказки, которые конфликтуют друг с другом, например "dark moody noir lighting" и "bright clean commercial look" в одном prompt, дают нечто несвязное. Выберите одно настроение. Выберите одну палитру. Пусть изменение несут биты, а не конфликтующие прилагательные.
  • Нет дуги движения. Тридцать статичных секунд — это тридцать скучных секунд. Если ничего не меняется, клип ощущается как застывший render, который держат слишком долго. Добавьте одно движение: push-in, панораму, проход персонажа, чтобы длительность воспринималась как намеренная, а не растянутая.

Если правильно выполнить эти три пункта, структурировать prompt по битам и упомянуть каждый subject, 30 секунд Seedance 2.5 превратятся из лотереи в довольно воспроизводимый результат.

Часто задаваемые вопросы

Какой длины может быть видео Seedance 2.5?

До 30 секунд в одной нативной генерации, вдвое больше 15 секунд Seedance 2.0. Весь клип рендерится за один проход, поэтому он может включать смены сцен и повествовательную дугу без склеивания отдельных клипов. Эти 30 секунд одним дублем — главная возможность модели.

Как написать хороший промпт для Seedance 2.5?

Структурируйте его в три части: завязка, действие и завершение, и используйте режиссерский фреймворк: Subject + Action, затем Environment, Look, Camera и Audio, с метками склеек между частями. Добавьте референсное изображение для каждого объекта. Сохраняйте одно настроение освещения и одну дугу движения на протяжении всего клипа.

Может ли Seedance 2.5 создавать видео в 4K?

Не на запуске. Сегодня Seedance 2.5 ограничена 720p, а нативная 4K есть в дорожной карте для более позднего развертывания. Если вам нужна 4K прямо сейчас, Seedance 2.0 предоставляет ее на более высоких тарифах. Для соцсетей и мобильного вывода стартового разрешения 720p обычно достаточно.

Как сохранить персонажа согласованным на протяжении клипа Seedance?

Используйте референсные изображения, а не текст. Загрузите несколько ракурсов персонажа: анфас, три четверти и профиль, и Seedance 2.5 будет сопоставлять их гораздо надежнее, чем описание. Ее лимит в 50 референсов создан именно для этого, поэтому согласованность в длинном клипе в основном зависит от хороших референсов.

Как исправить одну часть видео Seedance 2.5?

Используйте редактирование области. Оно позволяет перерисовать один элемент, например одежду, фон или продукт, при этом исполнение, движение и освещение остаются зафиксированными. Это лучше, чем перегенерировать весь клип с риском потерять части, которые уже получились правильно. Это самый быстрый способ доработать деталь.

Как вызвать Seedance 2.5 через API?

Отправьте асинхронную задачу с вашим промптом и URL-адресами референсов, опрашивайте задачу до завершения, затем скачайте видео. Через OpenAI-совместимую конечную точку, такую как Velokey, это один запрос с моделью, установленной на Seedance 2.5, а переключение на другую видеомодель — тот же вызов с другим именем.

Стоит ли использовать text-to-video или image-to-video в Seedance 2.5?

Используйте image-to-video, когда у вас уже есть точный кадр, например фото продукта или брендовый визуал, чтобы модель анимировала правильный объект, а не придумывала его. Используйте text-to-video для оригинальных сцен, созданных с нуля. Для брендовых и продуктовых клипов старт с реального изображения — более надежный путь к согласованности на протяжении всех 30 секунд.