So erstellst du 30-sekündige KI-Videos mit Seedance 2.5
Seedance 2.5 erstellt 30-sekündige Single-Shot-Clips. Wie man den Prompt strukturiert, die Konsistenz über 50 Referenzen hinweg beibehält und es Schritt für Schritt per API aufruft.

TL;DR
- Strukturiere den Prompt in drei Akte: Aufbau, Handlung oder Enthüllung, abschließender Rahmen. Seedance 2.5 folgt Szenenarchitektur besser als einer langen, ausufernden Beschreibung.
- Ein Referenzbild pro Motiv: eine Aufnahme jeder Figur, jedes Produkts oder Requisits. Bilder bewahren das Erscheinungsbild über 30 Sekunden hinweg deutlich besser als Worte.
- Ein Bewegungsbogen, nicht fünf: eine einzelne Kamera- oder Storybewegung ("walks to the window as the camera tightens"). Nutze die Länge für langsame Bewegung, nicht für Chaos.
- Mit Region Editing korrigieren: ändere das eine falsche Element, statt neu zu generieren und die guten Teile zu verlieren.
- Beachte die Obergrenze: 2.5 startet mit 720p. Native 4K kommt, ist aber noch nicht live.
Seedance 2.5 ist das erste Modell, das einen echten 30-sekündigen Clip in einem Durchgang erstellt, ohne Stitching. Diese Länge ist mächtig und leicht zu verschwenden. Gib ihm einen vagen Absatz, und du bekommst 30 Sekunden Abschweifen. Gib ihm ein strukturiertes Briefing, und du bekommst eine kohärente Szene. So machst du Letzteres.
Warum verändert One-Shot mit 30 Sekunden, wie du promptest?
Weil du jetzt eine Szene inszenierst, nicht ein einzelnes Bild beschreibst. Ältere Modelle erzeugten Clips, die so kurz waren, dass ein einzelner Satz sie abdeckte. Dreißig Sekunden sind lang genug, um einen Anfang, eine Mitte und ein Ende zu tragen, also braucht das Modell einen Anfang, eine Mitte und ein Ende, auf die es hinarbeiten kann. Gib ihm eine flache Beschreibung und es schweift ab, weil ihm nichts sagt, wie sich die Einstellung über die Zeit entwickeln soll.
Das ist der mentale Wechsel. Du schreibst eine Shotlist, keine Bildunterschrift. Der Rest dieses Leitfadens zeigt, wie du diese Shotlist so schreibst, dass Seedance 2.5 ihr tatsächlich folgt.
Wie teilt man 30 Sekunden in drei Beats auf?
Ungefähr zehn Sekunden pro Beat, eine Aufgabe pro Beat. Beat eins setzt die Szene und führt das Motiv ein. Beat zwei erledigt die eigentliche Arbeit: die Handlung, die Produktenthüllung, die Wendung in der Geschichte. Beat drei bringt es zum Abschluss, eine letzte Geste oder ein Innehalten, das dem Clip ein Ende gibt statt eines abrupten Stopps.
Braucht jeder Clip genau drei? Nein, aber drei ist der Sweet Spot für 30 Sekunden. Zwei Beats können über diese Länge dünn wirken, und fünf machen daraus eine chaotische Montage, die das Modell nicht halten kann. Behalte einen Schauplatz und einen Bewegungsbogen bei, der unter allen drei weiterläuft, damit sich die Beats wie Momente in einer einzigen Szene anfühlen, nicht wie separate Clips, die zusammengeklebt wurden. Diese Struktur sorgt dafür, dass eine lange einzelne Aufnahme absichtlich wirkt.

Wie erstellt man ein 30-second video mit Seedance 2.5?
Arbeite diese Schritte der Reihe nach ab, und du vermeidest den meisten Drift schon beim ersten Rendern:
- Teile den Clip in drei Beats auf. Setup, dann Action oder Produktenthüllung, dann ein Schlussbild. Seedance 2.5 folgt dieser strukturierten Architektur zuverlässiger als einer einzigen durchgehenden Beschreibung.
- Füge für jedes Motiv ein Referenzbild hinzu. Eine Aufnahme pro Figur, Produkt und wichtigem Requisit. Visuelle Referenzen bewahren das Aussehen über die vollen 30 seconds hinweg, wo Text allein driftet.
- Wähle einen Bewegungsbogen. Eine einzelne, sich entwickelnde Bewegung, etwa eine Figur, die den Raum durchquert, während die Kamera langsam heranfährt. Nutze die Laufzeit für langsame, bewusste Bewegung.
- Fixiere den Look. Gib eine Licht- und Farbstimmung an und bleib dabei. Widersprüchliche Hinweise brechen den Clip.
- Vorschau ansehen, bevor du dich festlegst. Nutze den 3D whitebox previz pass, um Kamera und Bewegung zu prüfen, und rendere dann final.
- Mit region editing korrigieren. Wenn ein Element falsch ist, zeichne nur dieses neu; regeneriere nicht den ganzen Clip und riskiere damit die Teile, die bereits funktioniert haben.
Wie schreibst du den Prompt?
Verwende ein Regie-Framework und fülle es jedes Mal in derselben Reihenfolge aus: Subjekt + Handlung → Umgebung → Look → Kamera → Audio, mit expliziten Schnitt-Labels zwischen den Beats. Diese Reihenfolge ist wichtig, weil sie das nach vorn stellt, worauf sich das Modell zuerst festlegt (wer und was passiert), bevor das Styling kommt.
Hier ist die Struktur, ausgefüllt für einen Produktclip:
[Beat 1 - setup] A woman in a navy coat stands in a bright minimalist kitchen,
morning light. Camera: slow push-in.
[Beat 2 - reveal] She lifts a matte-black coffee maker onto the counter and
presses the top button; steam rises. Camera: tighten to the product.
[Beat 3 - close] She takes a sip, smiles, looks off-frame. Camera: hold.
Look: warm, clean, commercial. Audio: soft ambient kitchen, no dialogue.Achte darauf, was es macht. Jeder Beat benennt ein Subjekt und eine Handlung, dann die Umgebung, dann eine Look- und eine Audio-Anweisung für den gesamten Clip. Die Schnitt-Labels geben dem Modell seine Struktur. Das liest sich wie ein Storyboard, weil Seedance 2.5 genau darauf reagiert.
Text-zu-Video oder Bild-zu-Video?
Seedance 2.5 beherrscht beides, und den richtigen Einstiegspunkt zu wählen, erspart dir später Reibereien. Text-zu-Video baut die gesamte Szene aus deinem Prompt auf; das ist der richtige Schritt, wenn noch nichts existiert und du möchtest, dass das Modell den Look erfindet. Bild-zu-Video animiert ein Standbild, das du bereits hast; das ist der richtige Schritt, wenn du den exakten Frame, ein Produktfoto oder ein Brand Key Visual besitzt und es nur in Bewegung bringen musst.
Für Brand- und Produktarbeit gewinnt meist Bild-zu-Video. Du startest mit der echten Produktaufnahme, also ist das Objekt bereits korrekt und das Modell animiert darum herum, statt seine Form zu erraten. Von einem festgelegten Frame auszugehen, ist eine der sichersten Methoden, um einen 30-sekündigen Clip markenkonform zu halten. Nutze Text-zu-Video für originale Szenen und Bild-zu-Video, wenn der Anker bereits existiert.
Wie hältst du Charaktere und Produkte konsistent?
Setze auf Referenzen, nicht auf Adjektive. Seedance 2.5 akzeptiert bis zu 50 multimodale Eingaben, ungefähr 30 Bilder, 10 Videoclips und 10 Audioclips, und genau hier macht sich dieses Kontingent bezahlt. Lade eine saubere Aufnahme jedes Charakters und Produkts hoch, das du im Prompt nennst. Das Modell gleicht sich deutlich zuverlässiger mit dem Bild ab als mit einer Textbeschreibung wie "a matte-black coffee maker", die es sonst jede Sekunde neu erfinden würde.
Für einen wiederkehrenden Charakter gib ihm ein paar Blickwinkel: frontal, Dreiviertelansicht, Profil. Für ein Produkt gib ihm das Hero-Shot und eine Detailaufnahme. Je mehr das Modell sehen kann, desto weniger rät es, und Raten ist das, was den wandernden Gesichts-Look erzeugt, der nach AI schreit. Bei einem 30-sekündigen Clip ist Konsistenz größtenteils ein Referenzproblem, und Seedance 2.5 hat den Spielraum, es zu lösen.
Wie rufst du Seedance 2.5 über die API auf?
Die Videogenerierung läuft als asynchroner Job: Du sendest eine Anfrage, fragst den Status ab und lädst das Ergebnis herunter, sobald es bereit ist. Über ein OpenAI-kompatibles Gateway wie Velokey sieht die Struktur so aus:
import requests, time
BASE = "https://api.velokey.ai/v1"
headers = {"Authorization": "Bearer $VELOKEY_API_KEY"}
# 1. submit the job
job = requests.post(f"{BASE}/videos/generations", headers=headers, json={
"model": "seedance-2.5",
"prompt": "<your three-beat prompt>",
"references": ["https://.../character.png", "https://.../product.png"],
"duration": 30,
}).json()
# 2. poll until it's done
while True:
r = requests.get(f"{BASE}/tasks/{job['id']}", headers=headers).json()
if r["status"] == "completed":
print(r["results"][0]) # video URL
break
time.sleep(5)Das ist das Muster, nicht die endgültige Parameterliste, da sich genaue Felder während der Einführung des Modells ändern können. Für das aktuelle Anfrage-Schema, das Antwortformat und die Preise pro Video folge unserem Seedance 2.5 API-Leitfaden, der die Live-Details nachverfolgt. Der Vorteil eines Gateways ist hier, dass der Wechsel zu Veo oder Kling für eine andere Aufnahme derselbe Aufruf mit einem anderen Modellnamen ist.
Was ist mit Audio in Seedance 2.5?
Neu in 2.5: Das Modell erzeugt synchronisiertes Audio im selben Durchlauf, sodass du Sound direkt im Prompt steuern kannst. Halte es einfach. Benenne pro Clip eine Audio-Absicht, wie "soft ambient kitchen, no dialogue" oder "upbeat background music," und lass sie unter den Bildern liegen. Ambient-Sound und Musik sind die Bereiche, in denen Seedance-Audio am stärksten ist.
Intensiver Dialog ist eine andere Geschichte. Wenn dein Clip davon lebt oder stirbt, dass eine gesprochene Zeile perfekt synchron sitzt, liegt Veo 3.1 bei 48kHz-Dialog weiterhin vorn, und für diesen einen Job lohnt sich der kürzere Clip. Für die meisten 30-sekündigen Produkt- und Story-Arbeiten reichen Seedances Ambient-Sound und Musik jedoch aus, und sie im selben Durchlauf zu erzeugen, ist besser, als Audio in der Postproduktion anzuflanschen.
Was ist mit der Auflösung? Der 720p-Haken
Setzen Sie Erwartungen, bevor Sie rendern: Seedance 2.5 startet mit einer Begrenzung auf 720p. Das native 4K und die 10-bit color im Datenblatt stehen auf der Roadmap, sind zum Launch aber noch nicht verfügbar. Für Social, Mobile und Web ist 720p in Ordnung, und Sie werden es kaum bemerken. Für einen Clip, der heute auf einem großen Bildschirm scharf aussehen muss, ist das eine echte Einschränkung, und Seedance 2.0 liefert in seinen höheren Tiers weiterhin 1080p und 4K. Planen Sie die Auflösung danach, wo das Video tatsächlich abgespielt wird.
Wie iteriert man, ohne Renderings zu verbrennen?
Günstigste Korrektur zuerst, teuerste Korrektur zuletzt. Ein vollständiges 30-sekündiges Rendering kostet am meisten, deshalb willst du nicht jedes Mal dazu greifen, wenn etwas leicht danebenliegt. Beginne mit Previz: Fange Kamera- und Bewegungsprobleme im Whitebox-Pass ab, bevor du für einen fertigen Clip bezahlst. Dann rendern.
Falsches Detail im finalen Ergebnis? Bearbeite die Region. Zeichne das eine Element neu und behalte alles, was bereits funktioniert hat, statt den ganzen Clip neu zu würfeln und die guten Teile aufs Spiel zu setzen. Hebe eine vollständige Neugenerierung für den Fall auf, dass das ganze Konzept danebenliegt, nicht wenn eine Jacke die falsche Farbe hat. Arbeite in dieser Reihenfolge: Previz, dann Region-Edit, dann ein vollständiges Re-Rendering nur als letzten Ausweg, und du wirst nur einen Bruchteil der Credits ausgeben, die eine Alles-neu-würfeln-Gewohnheit verbrennt.
Ein ausgearbeitetes Beispiel: eine 30-Sekunden-Produktanzeige
Hier ist der ganze Ablauf an einem Clip. Angenommen, du erstellst eine 30-Sekunden-Anzeige für eine Kaffeemaschine. Sammle zuerst Referenzen: die Hero-Aufnahme des Produkts, eine Detailaufnahme und ein Foto deines Präsentators. Schreibe zweitens den Drei-Beat-Prompt: Setup in der Küche, Produktenthüllung und Brühvorgang, abschließender Schluck, mit einem warmen Werbe-Look und atmosphärischem Küchenton. Führe drittens die Whitebox-Previz aus und prüfe, ob die Kamera beim Reveal tatsächlich auf das Produkt enger wird, nicht vorher.
Stimmt etwas nicht? Korrigiere es direkt an Ort und Stelle. Wenn die Jacke des Präsentators in der falschen Farbe herauskam, bearbeite die Jacke regional und lasse die freigegebene Brühaufnahme unangetastet. Rendere in 720p für den Social Cut. Wenn der Kunde heute einen 4K-Master braucht, generiere diese eine Aufnahme auf Seedance 2.0 als Übergangslösung, bis 2.5s 4K verfügbar ist. Das ist ein vollständiger Produktionsdurchlauf, ohne jemals von Grund auf neu zu generieren.
Was sind die häufigsten Fehler?
Drei Fehler ruinieren die meisten 30-Sekunden-Versuche, und alle drei lassen sich leicht vermeiden, sobald man sie kennt:
- Zu viel hineinstopfen. Mehrere Schauplätze und eine Menge von Figuren in einem 30-Sekunden-Clip sind mehr, als das Modell zusammenhalten kann. Wenn deine Idee drei Schauplätze und vier Personen hat, teile sie in separate Clips auf und setze sie in einem Editor zusammen. Eine kohärente Szene pro Generierung.
- Widersprüchliche Regieanweisungen. Hinweise, die einander widersprechen, wie "dark moody noir lighting" und "bright clean commercial look" im selben Prompt, erzeugen etwas Inkohärentes. Wähle eine Stimmung. Wähle eine Palette. Lass die Beats die Veränderung tragen, nicht widersprüchliche Adjektive.
- Kein Bewegungsbogen. Dreißig statische Sekunden sind dreißig langweilige Sekunden. Wenn sich nichts entwickelt, fühlt sich der Clip wie ein eingefrorenes Rendering an, das zu lange gehalten wird. Gib ihm eine Bewegung, einen Push-in, einen Schwenk, eine Figur, die durchs Bild geht, damit die Länge absichtlich wirkt statt gestreckt.
Wenn du diese drei Punkte richtig machst, den Prompt in Beats strukturierst und jedes Subjekt referenzierst, werden die 30 Sekunden von Seedance 2.5 von einem Glücksspiel zu einem ziemlich wiederholbaren Ergebnis.
Häufig gestellte Fragen
Wie lang kann ein Seedance 2.5 Video sein?
Bis zu 30 Sekunden in einer einzigen nativen Generierung, doppelt so lang wie Seedance 2.0's 15. Der gesamte Clip rendert in einem Durchlauf, sodass er Szenenwechsel und einen erzählerischen Bogen enthalten kann, ohne separate Clips zusammenzufügen. Diese 30 Sekunden in einem einzigen Shot sind die Kernfähigkeit des Modells.
Wie schreibt man einen guten Seedance 2.5 Prompt?
Strukturiere ihn in drei Beats: Setup, Action und Abschluss, und nutze ein Regie-Framework: Subject + Action, dann Environment, Look, Camera und Audio, mit Schnitt-Labels zwischen den Beats. Füge für jedes Subject ein Referenzbild hinzu. Behalte über den gesamten Clip hinweg eine Lichtstimmung und einen Bewegungsbogen bei.
Kann Seedance 2.5 4K Video erstellen?
Nicht zum Start. Seedance 2.5 ist derzeit auf 720p begrenzt, mit nativem 4K auf der Roadmap für einen späteren Rollout. Wenn du jetzt 4K brauchst, liefert Seedance 2.0 es in den höheren Tiers. Für Social- und Mobile-Ausgaben ist die 720p Startauflösung normalerweise ausreichend.
Wie hält man einen Charakter über einen Seedance Clip hinweg konsistent?
Nutze Referenzbilder, keinen Text. Lade mehrere Winkel des Charakters hoch: frontal, Dreiviertelansicht und Profil, und Seedance 2.5 gleicht diese deutlich zuverlässiger ab als eine Beschreibung. Sein Budget von 50 Referenzen ist genau dafür gedacht, weshalb Konsistenz in einem langen Clip vor allem eine Frage guter Referenzen ist.
Wie korrigiert man einen Teil eines Seedance 2.5 Videos?
Nutze Region Editing. Damit kannst du ein einzelnes Element neu zeichnen, etwa Kleidung, einen Hintergrund oder ein Produkt, während Performance, Bewegung und Beleuchtung fixiert bleiben. Das ist besser, als den gesamten Clip neu zu generieren, wobei die Teile verloren gehen könnten, die bereits richtig gelungen sind. Es ist der schnellste Weg, ein Detail zu iterieren.
Wie ruft man Seedance 2.5 über eine API auf?
Reiche einen asynchronen Job mit deinem Prompt und Referenz-URLs ein, frage die Aufgabe ab, bis sie abgeschlossen ist, und lade dann das Video herunter. Über einen OpenAI-kompatiblen Endpoint wie Velokey ist es eine Anfrage mit dem auf Seedance 2.5 gesetzten Modell, und der Wechsel zu einem anderen Videomodell ist derselbe Aufruf mit einem anderen Namen.
Sollte man in Seedance 2.5 Text-to-Video oder Image-to-Video verwenden?
Nutze Image-to-Video, wenn du bereits den exakten Frame hast, etwa ein Produktfoto oder ein Brand-Visual, damit das Modell ein korrektes Objekt animiert, statt eines zu erfinden. Nutze Text-to-Video für originale Szenen, die von Grund auf erstellt werden. Für Brand- und Produktclips ist der Start mit einem echten Bild der zuverlässigere Weg zu Konsistenz über die vollen 30 Sekunden hinweg.


