Seedance 2.5 meistern: Der ultimative Leitfaden für KI-generierte Kurzserien

@fuji_ai_
JAPANISCH10. Aug. 2026
142K
149
13
3
326

TL;DR

Ein umfassender Leitfaden zur Nutzung von Seedance 2.5 von ByteDance für die KI-Videoproduktion, mit Fokus auf die Erstellung von 30-sekündigen vertikalen Dramen mit konsistenten Charakteren und synchronisiertem Audio durch strukturierte Prompts.

Ehrlich gesagt, ich musste zweimal hinsehen.

Heutzutage, wenn du TikTok oder YouTube öffnest, strömen ständig vertikale Kurzdramen.

Jetzt können sie mit einem einzigen Prompt erstellt werden.

Dialog, Soundeffekte, BGM – alles inklusive.

Kein Dreh. Keine Schauspieler. Kein Schnitt.

Die Kosten lagen bei etwa 1.400 Yen pro Video.

Viele Leute gehen wahrscheinlich daran vorbei und denken: „Ich habe gehört, das sei beeindruckend.“ Dieses Gefühl kenne ich nur zu gut.

Zuerst dachte ich: „Das ist wahrscheinlich nur ein paar Sekunden CG-Video.“

Aber was tatsächlich herauskam, war ein 30-Sekunden-Stück, bei dem die Lippenbewegungen des Schauspielers passten und das sogar Schnitte enthielt, die ich nicht vorgegeben hatte.

Es war nicht nur, dass „ein Video erstellt wurde“, sondern dass „ein Kunstwerk entstanden ist“.

Deshalb habe ich diesen Artikel geschrieben.

Ich habe den vollständigen Prompt beigefügt, den du kopieren und sofort verwenden kannst.

Außerdem – egal ob du das vor oder nach diesem Artikel liest – ich betreibe einen LINE-Open-Chat, in dem ich Geschichten über die Nutzung von KI teile, die nicht in Artikel passen. Dort verschenke ich „32 Luxus-KI-Strategie-Boni“ kostenlos. Die Teilnahme ist kostenlos, also schau gerne vorbei.

▼ Open Chat „Fuji AI [Aktuelle Informationen]“

Du kannst über den Link in meinem Profil beitreten.

Lass uns loslegen.

◾️ Was ist Seedance 2.5?

Seedance 2.5 ist ein KI-Videogenerierungsmodell der nächsten Generation, das von ByteDance entwickelt wurde. Aus Eingaben wie Text, Bildern, Audio und Video kann es in einer einzigen Generierung ein geschichtengetragenes Video von bis zu 30 Sekunden mit Ton erzeugen.

Es wurde von ByteDance entwickelt, dem Mutterkonzern von TikTok. Veröffentlicht wurde es am 31. Juli 2026.

Du musst dir nur drei Hauptfunktionen merken:

① 30 Sekunden in einer Generierung, mit Ton

Die Vorgängergeneration 2.0 schaffte 15 Sekunden. Das hat sich also exakt verdoppelt. Außerdem übernimmt das Modell die Schnitte selbst. Auch ohne Vorgaben wechselt es automatisch von Totalen zu Nahaufnahmen.

② Bis zu 50 Referenzmaterialien können bereitgestellt werden

Die Aufteilung: 30 Bilder, 10 Videos und 10 Audiodateien. Du kannst Gesicht, Kostüm, Ort und sogar die Stimme festlegen. Dieses „Stimmen-Fixing“ wird später sehr effektiv.

③ Gleichzeitige Erstellung von Video und Ton

Es erstellt nicht zuerst das Video und fügt den Ton später hinzu, sondern generiert beides von Anfang an gemeinsam. Dadurch geraten Lippenbewegungen und Stimme nicht aus dem Takt.

Das waren die Grundlagen von Seedance 2.5. Zuerst aber eine Warnung.

Das ist kein Modell, das einfach nur die Bildqualität „erhöht“ hat.

Der offizielle Blog erwähnt die Auflösung kein einziges Mal. Im eigentlichen Dienst kannst du nur zwischen 480P und 720P wählen. Eine 1080P-Option gibt es nicht einmal. Manche Internetartikel behaupten, eine „tolle 4K-Version“ sei veröffentlicht worden, aber das widerspricht der offiziellen Preisliste.

Es ist ein Modell, das auf Länge und Konsistenz ausgelegt ist. Das ist das richtige Verständnis.

◾️ Der eine Grund, warum es die einzige Wahl für vertikale Dramen ist

Der Grund, warum ich es gewählt habe, war einfach: Länge.

Egal wie hoch die Leistung von Googles Video-KI ist, sie kann nur 10 Sekunden am Stück erzeugen. Das ist grundsätzlich inkompatibel mit vertikalen Dramen. Die Struktur eines vertikalen Dramas ist „Hook → Aufbau → Wendung → Pointe.“ Das dauert genau 30 Sekunden. Wenn du das in drei 10-Sekunden-Segmente aufteilst und später zusammenfügst, verändert sich das Gesicht an den Schnitten. Die Atmosphäre wechselt. Der Protagonist im dritten Schnitt wird zu einer anderen Person als im ersten. Seedance ist derzeit das einzige Modell, das 30 Sekunden am Stück schafft. Deshalb wählst du für vertikale Dramen das hier gegenüber Google.

◾️ Probieren wir es aus (Einfach kopieren und einfügen)

Es ist nicht schwierig. Wenn du die Schritte befolgst, schaffst du es garantiert.

[Schritt 1: Dreamina öffnen]

藤原弘人@AI起業家 - inline image

Der Zugang zu Seedance 2.5 aus Japan führt über einen Dienst namens Dreamina. Er gehört wie CapCut zum selben ByteDance-Dach, und die Oberfläche ist vollständig lokalisiert.

[Schritt 2: Anmelden]

藤原弘人@AI起業家 - inline image

Du kannst aus fünf Anmeldemethoden wählen: Google, TikTok, Facebook, E-Mail oder CapCut Mobile. Am schnellsten geht es mit Google.

[Schritt 3: Das Modell auf Seedance 2.5 umstellen]

藤原弘人@AI起業家 - inline image

Klicke unten links auf „KI-Video“, um die Modellliste zu sehen. Wähle „Dreamina Seedance 2.5.“ Nur 2.5 kann 30 Sekunden am Stück ausgeben.

[Schritt 4: Drei Einstellungen anpassen]

Stelle die Schaltflächen rechts neben dem Modell wie folgt ein:

  • Generierungsmodus: Omni-reference (Standard ist in Ordnung)
  • Seitenverhältnis und Auflösung: 9:16 / 720P
  • Dauer: 30 Sekunden

Entscheidend: Der Credit-Verbrauch wird links neben dem Generieren-Button angezeigt. Jede Generierung kostet Geld, also gewöhne dir an, diese Zahl zu prüfen.

[Schritt 5: Kopiere, füge ein und sende Folgendes]

Du musst nichts ändern.

▼ Kopiere und füge alles unten ein ▼

text
1Bitte erstelle ein 30-sekündiges vertikales Kurzdrama (9:16). Verwende ein Tempo ähnlich wie bei chinesischen vertikalen Kurzdramen, mit starken Emotionen und einer Struktur, in der sich das Machtverhältnis am Ende komplett umkehrt.
2[Charakterdefinitionen]
3Person 1 = Japanischer Mann in seinen 40ern. Kurze Haare, schwarze Schürze, der Ladenleiter.
4Person 2 = Japanischer Mann in seinen späten 20ern. Schwarze Haare, grauer Hoodie, mit Rucksack.
5Person 3 = Japanische Frau in ihren 30ern. Marineblauer Anzug, hält einen Umschlag.
6Verwende ab jetzt immer diese Bezeichnungen.
7[Szenenaufbau]
8Einstellung 1 (0–3s)
9- Kamera: Feste Halbnahaufnahme von Person 1
10- Aktion: Person 1 verschränkt die Arme, grinst und schaut herab.
11- Ton: (Keine Musik, nur Ladengeräusche) / Sagt auf Japanisch {Wir brauchen keine Kunden, die nicht einmal wissen, wie man sich anstellt.}
12Einstellung 2 (3–9s)
13- Kamera: Langsamer Zoom auf das Gesicht von Person 2
14- Aktion: Person 2 schaut nach unten und stellt langsam seinen Rucksackgurt ein.
15- Ton: Sagt auf Japanisch {...Es tut mir leid} / <Leises Klirren von Geschirr>
16Einstellung 3 (9–16s)
17- Kamera: Feste Halbtotale des Ladens
18- Aktion: Mehrere umstehende Kunden schauen verlegen weg.
19- Ton: (Ein einzelner tiefer Ton) / <Geräusch der sich leise öffnenden Schiebetür>
20Einstellung 4 (16–22s)
21- Kamera: Langsame Bewegung vom Eingang in den Laden
22- Aktion: Person 3 kommt herein und überreicht Person 2 mit beiden Händen einen Umschlag und einen Schlüssel.
23- Ton: (Streicher setzen kraftvoll ein) / Person 3 sagt auf Japanisch {Ich komme von der Zentrale. Das sind die Unterlagen für den Managerwechsel ab morgen.}
24Einstellung 5 (22–27s)
25- Kamera: Feste Nahaufnahme der Hände von Person 2
26- Aktion: Person 2 nimmt ruhig den Schlüssel entgegen. Person 1 hält mit halb geöffnetem Mund inne.
27- Ton: Person 2 sagt auf Japanisch {Ich wollte erst entscheiden, nachdem ich den Ort selbst gesehen habe} / Person 1 sagt auf Japanisch {Hä?}
28Einstellung 6 (27–30s)
29- Kamera: Feste Halbtotale aller drei
30- Aktion: Person 1 macht einen halben Schritt zurück. Person 2 kontert nach einer Pause. Person 3 wendet ihr Gesicht leicht ab.
31- Ton: (Die Musik wird plötzlich leichter) / Person 2 sagt auf Japanisch {Kannst du mir ab morgen beibringen, wie man sich anstellt?} / Person 3 sagt leise auf Japanisch {Chef, das ist der neue Chef.}
32[Regie]
33- Live-Action / Hyperrealistisch / Natürliche japanische Schauspieler
34- Kleiner Ramen-Laden bei Nacht. Warmes Licht, geringe Sättigung.
35- Starkes emotionales Schauspiel. Nur Person 1 erhebt die Stimme.
36- 9:16, hohe Qualität, stabiles Bild, keine Unschärfe, kein Wackeln
37[Konsistenzvorgaben]
38Dieselbe Person, konsistente Kleidung, unveränderte Frisur. Behalte Aussehen und Kleidung in allen Einstellungen bei. Zeige nicht zwei oder mehr Personen mit identischem Aussehen/Kleidung (kein Zwillings-Effekt).
39[Verbotsregeln]
40- Keine Untertitel, Einblendungen, Logos, Wasserzeichen oder Texte im Bild
41- Keine echten Personen oder echten Markenlogos
42- Kein lesbarer Text auf Schildern, Speisekarten oder Dokumenten
43- Kein Sprinten, keine großen Sprünge, keine heftigen Drehungen
44[Abschluss]
45Vermittle die Befriedigung des Moments, in dem die Person, die auf andere herabgeschaut hat, durch ein einziges Dokument ihre Position verliert. Nur Person 1 sollte laut sein; der Protagonist bleibt bis zum Ende ruhig. Gestalte es durch Mimik, Schauspiel und Kameraführung so, dass die Handlung auch ohne Untertitel verständlich ist.

◾️ 6 Dinge, die die offizielle Doku verbietet

藤原弘人@AI起業家 - inline image

1. Keine Charakter-Turnaround-Blätter bereitstellen

Im Gegensatz zu Anime führt die Bereitstellung von Vorder-, Seiten- und Rückansicht dazu, dass das Modell denkt, es seien drei verschiedene Personen, was das Gesicht auseinanderfallen lässt. Verwende ein einziges neutrales Porträtfoto.

2. Referenzmaterial nicht bis zum Limit ausreizen

Du kannst 50 hinzufügen, aber die Empfehlung liegt bei 4–5. Zu viele führen dazu, dass das Modell die Priorität verliert.

3. Nicht mehrere Kamerabewegungen in einer Einstellung angeben

„Langsames Zoomen während man schwenkt und umkreist“ führt dazu, dass das Bild zusammenbricht. Eine Einstellung = eine Kamerabewegung.

4. Das Drehbuch nicht direkt in den Prompt einfügen

Redundanter Text verwirrt das Modell. Verwende ein strukturiertes Format wie den Prompt oben.

5. Nicht versuchen, den Seed zu fixieren

Seed-Fixing funktioniert bei der Seedance-2.0-Serie nicht. Konsistenz wird über Referenzbilder und Subjektdefinitionen erzeugt.

6. Keine gewalttätigen Aktionen beschreiben

Vermeide Sprinten oder Springen. Bevorzuge langsame, kontinuierliche kleine Bewegungen.

◾️ Japanischer Dialog bekommt einen Akzent, wenn du das nicht schreibst

藤原弘人@AI起業家 - inline image

Für japanische Dialoge musst du immer den Sprachnamen angeben.

× „Sorry, ich kann es doch nicht machen“

○ Sagt auf Japanisch {Sorry, ich kann es doch nicht machen}

Ohne das könnte es einen chinesischen Akzent haben oder anfangen, Englisch zu sprechen. Verwende außerdem die Klammern korrekt: () für Musik, <> für Soundeffekte, {} für Dialog und 【】 für Untertitel.

◾️ Wenn du es für deine eigene Geschichte umschreibst, verwende diese Reihenfolge

藤原弘人@AI起業家 - inline image

Präzise Person + Aktionsdetails + Ort/Umgebung + Licht/Stimmung + Kameraführung + Videostil + Qualität + Einschränkungen

Betrachte es als technische Spezifikation, nicht als Poesie.

Du kannst sogar die Stimme festlegen

Du kannst Emotion, Tonfall und Sprechgeschwindigkeit im Text angeben:

Sagt auf Japanisch {Dialog} mit der Emotion [Emotion], im Ton [Ton], mit dem Sprechtempo [Sprechtempo].

◾️ So behebst du es, wenn der erste Versuch fehlschlägt

藤原弘人@AI起業家 - inline image

Der Fix besteht nicht darin, „Wörter hinzuzufügen“, sondern „Fluchtwege zu schließen“.

  1. Entferne alle mehrdeutigen Wörter wie „wenn möglich“ oder „so viel wie möglich“.
  2. Schreibe nicht zwei Anweisungen in eine Zeile.
  3. Schreibe in den Abschluss, „wie du es gesehen haben möchtest“.

◾️ Es gibt eine Vorlage für erfolgreiche 30-Sekunden-Videos

藤原弘人@AI起業家 - inline image
  • 0–2s: Hook (Unbehagen oder Überraschung)
  • 2–18s: Konflikt (Herabgeschaut werden)
  • 18–26s: Wendung (Zeige es mit einem Objekt wie einem Schlüssel oder Dokument)
  • 26–30s: Twist/Auflösung

◾️ Für Fortsetzungen einfach das erste Video bereitstellen

Um eine Serie zu machen, legst du das erste Video in die Referenzmaterialien und gibst es im Prompt als @Video1 an. So bleiben Gesicht, Kleidung und Laden erhalten.

◾️ Zwei Dinge, die ich nicht der KI überlasse

  1. Audio: Ich verlasse mich nicht vollständig darauf. Für hohe Qualität generiere ein stummes Video und synchronisiere es später.
  1. Vertikale Generierung: Im offiziellen FAQ wird erwähnt, dass die Generierung in 9:16 ein höheres Risiko für unerwünschte Untertitel birgt. In 16:9 zu generieren und auf vertikal zu croppen ist für die Massenproduktion sicherer.

◾️ Die ehrliche Wahrheit über „1.400 Yen pro Video“

Das ist der Preis, wenn du auf Anhieb Erfolg hast. In Wirklichkeit liegt es mit Retries eher bei 8.000 bis 10.000 Yen pro Folge. Trotzdem, verglichen mit dem Marktpreis von 160.000 Yen für real gedrehte Kurzfilme, ist das eine andere Liga.

◾️ Kann man damit Geld verdienen?

In China sind 95 % der vertikalen Dramen bereits KI-produziert. Die Einnahmen pro 10.000 Aufrufe sind um 90 % gesunken. Die Einstiegshürde ist gesunken, was bedeutet, dass der Wettbewerb explodiert ist. KI garantiert keinen Gewinn; sie garantiert die Fähigkeit, viele Ideen günstig zu testen. Japan steht noch am Anfang dieser Phase.

◾️ Zusammenfassung

  • Seedance 2.5 ist für Länge (30s) und Konsistenz gedacht, nicht für 4K-Auflösung.
  • Verwende spezifische Klammern und „Auf Japanisch“ für Dialoge.
  • Füge keine Wörter hinzu, um Fehler zu beheben; sei absolut in den Verboten.
  • KI erhöht die „Erfolgsquote“ nicht, senkt aber die „Kosten des Ausprobierens“ erheblich.

◾️ Wenn du heute nur eine Sache tust

Öffne Dreamina und füge den Prompt aus diesem Artikel einmal ein. Lies nicht nur und sei überzeugt; werde aktiv und erlebe diesen Moment der Überraschung.

Zum Schluss

Damit du nicht nur „das Lesen beendest“, verschenke ich 32 Luxus-Boni – darunter Anleitungen für ChatGPT, Claude und KI-Nebengeschäfte.

藤原弘人@AI起業家 - inline image

Tritt hier bei.

In YouMind remixen

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Für Creator

Verwandle dein Markdown in einen sauberen 𝕏-Artikel

Wenn du eigene Langtexte veröffentlichst, wird die 𝕏-Formatierung von Bildern, Tabellen und Codeblöcken mühsam. YouMind macht aus einem ganzen Markdown-Entwurf einen sauberen, sofort postbaren 𝕏-Artikel.

Markdown zu 𝕏 testen

Mehr Muster zum Entschlüsseln

Aktuelle virale Artikel

Mehr virale Artikel entdecken