← Zurück zum Blog

KI-Bild-zu-Video-Workflow: vom Standbild zur Bewegung

Warum Produktion mit einem Standbild beginnt, und die Kette in 4 Schritten auf 8frame (Nano Banana Pro, Seedance 2.0, Kling v3, Download) mit echten Kosten: zwei Standbilder, ein Hero-Clip und fünf Varianten für 580 Credits, etwa 5,80 US-Dollar.

Die Bild-zu-Video-Kette ist der am besten steuerbare Weg vom Briefing zum brauchbaren Clip. Du beginnst mit einem freigegebenen Standbild und bringst genau dieses Standbild dann in Bewegung. Diese Reihenfolge zählt. Gehst du direkt von Text zu Video, muss das Videomodell alles erfinden: Komposition, Produktfarbe, Licht, Tiefe, und seine Vermutungen sind nicht deine Marke. Startest du von einem freigegebenen Bild, muss das Videomodell nur Bewegung hinzufügen und übernimmt Farbe, Etikett und Komposition, die du schon abgenommen hast.

Kurzfassung

Warum mit einem Standbild beginnen

Promptest du ein Videomodell nur mit Text, muss es jedes visuelle Element selbst entscheiden: den genauen Farbton des Produkts, wo das Etikett sitzt, wie das Licht fällt, was im Hintergrund ist. Es trifft vernünftige Annahmen. Vernünftige Annahmen sind nicht deine Marke.

Bild-zu-Video nimmt ihm die meisten dieser Entscheidungen ab. Du lieferst das freigegebene Standbild mit der richtigen Produktfarbe, Etikettenposition und Umgebung, und die Aufgabe des Videomodells schrumpft darauf, dieses Standbild in Bewegung zu setzen.

Deshalb führt die Pipeline für Produkt-Hero-Shots, Workflow 1 in 10 AI video workflows every brand should have (auf Englisch), von Nano Banana Pro in Seedance, statt direkt per Text in Seedance zu gehen. Das Zwischenbild ist kein Mehraufwand. Es ist die Kontrollebene, die alles danach vorhersehbar macht.

Auch die Rechnung profitiert. Ein freigegebenes Standbild kann eine langsame Kamerafahrt nach vorn, eine Drehung und eine Enthüllung speisen, alle vom selben Referenzframe aus. Jede Variante fügt eine Bewegungsrichtung hinzu; keine erfindet das Produkt neu.

Die Bild-zu-Video-Kette in 4 Schritten

Schritt 1. Master-Standbilder mit Nano Banana Pro

Nano Banana Pro erzeugt das Referenzbild: 21 Credits in 1K oder 2K, 42 in 4K. Auf 8frame liegt die mediane Generierungszeit bei 37 Sekunden (p90 77 Sekunden). Die Parameter, auf die es ankommt:

Was du nach Schritt 1 hast: ein freigegebenes Master-Standbild pro Format, mit festgelegter Produktfarbe, Etikett und Komposition.

Schritt 2. Hero-Clip mit Seedance 2.0

Seedance 2.0 nimmt das Standbild als Referenz und animiert es. Auf dem Canvas akzeptiert es bis zu 9 Referenzbilder, läuft 4 bis 15 Sekunden und erzeugt Ton. Ein 5-Sekunden-Clip kostet 108 Credits in 720p und 48 in 480p; der Preis ist mit und ohne Referenzen gleich. Die mediane Generierungszeit auf 8frame liegt bei etwa 3 Minuten für einen Clip von 6 Sekunden oder weniger in 720p (197 Sekunden, p90 413).

Prompts für diesen Schritt, jeweils eine Bewegung:

Beschränke jeden Prompt auf eine Aktion und eine Angabe zum Bildausschnitt. Die Anleitung Seedance 2.0 prompts for product demos (auf Englisch) hat weitere Beispiele. Seedance 2.5, die Voreinstellung des Seedance-Tools, kostet 157 Credits für 5 Sekunden in 720p; die Unterschiede stehen in Seedance 2.5 vs Seedance 2.0.

Was du nach Schritt 2 hast: einen Hero-Clip, der die visuellen Entscheidungen des Master-Standbilds übernimmt.

Schritt 3. Varianten mit Kling v3

Hat der Hero-Clip die Abnahme bestanden, erzeugt Kling v3 Standard die Varianten: andere Bewegungsrichtungen aus denselben Standbildern. Ein 5-Sekunden-Clip kostet 86 Credits mit Ton und 57 ohne Ton und kommt in 720p zurück. Die mediane Generierungszeit auf 8frame liegt bei etwa 1 Minute für einen 5-Sekunden-Clip (60 Sekunden, p90 156). Ein Kling-v3-Clip ohne Ton kostet etwa halb so viel wie ein Seedance-2.0-Clip in 720p.

Aus einem horizontalen und einem vertikalen Standbild kannst du zum Beispiel erzeugen:

Jeder Tarif kann bis zu 10 Aufgaben gleichzeitig ausführen, fünf Varianten laufen also parallel statt nacheinander.

Was du nach Schritt 3 hast: mehrere Bewegungsvarianten, alle an dieselben freigegebenen Standbilder gebunden.

Schritt 4. Herunterladen und benennen

8frame kodiert Videos nicht neu: Die Datei, die du herunterlädst, ist die, die das Modell zurückgegeben hat, nach unseren Messungen H.264 in MP4 mit 24 Bildern pro Sekunde. Nichts auf dem Canvas gibt 4K aus, und es gibt keinen Video-Upscaler, die Auflösung, in der du generierst, ist also die Auflösung, die du lieferst (siehe KI-Video-Auflösung pro Modell).

Benenne Dateien, bevor sie das Board verlassen, zum Beispiel [project]-[aspect-ratio]-[motion]-[date] (skincare-launch-16x9-push-in-20261001.mp4). Ein gut benannter Ordner ist der Unterschied zwischen einer sauberen Übergabe und 30 Minuten Datei-Archäologie.

Was die Kette auf 8frame kostet

Credits aus der Tool-Registry von 8frame; ein Credit kostet im Paket etwa 0,01 US-Dollar.

Schritt Modell und Einstellung Credits
Zwei Master-Standbilder (16:9 und 9:16) Nano Banana Pro, 2K, je 21 42
Hero-Clip Seedance 2.0, 720p, 5 s mit Ton 108
Fünf Varianten Kling v3 Standard, 5 s mit Ton, je 86 430
Gesamt 580

Mit Varianten ohne Ton (je 57) liegt die Summe bei 435. Liefert der Kunde freigegebene Produktfotos, fallen die Standbilder weg: 538 mit Ton, 393 ohne Ton. Mit den 1.000 monatlichen Credits des Starter-Tarifs bleibt Platz für ein komplettes Set plus Entwürfe; den Preis pro Sekunde für jedes Modell findest du in KI-Video: Preis pro Sekunde.

Fallstricke

Detailverlust bei der Übergabe vom Standbild zur Bewegung

Der häufigste Fehler. Das Videomodell bringt Farbverschiebungen, verschmierte Etiketten oder geometrische Verzerrungen hinein, wenn es das Standbild bewegt. Kleingedrucktes und feine Muster trifft es meistens.

Abhilfe: Häng das Referenzbild in voller Größe an und halte kleinen Text so groß im Bild, wie die Einstellung es erlaubt. Wir haben nicht kontrolliert getestet, welches Modell Etiketten am besten hält, also probiere den Hero-Shot auf zwei Modellen aus, bevor du die Varianten festlegst.

Drift der Bewegungsrichtung

Das Modell beginnt in eine Richtung und ändert mitten im Clip den Kurs: Aus einer Kamerafahrt nach vorn wird ein Schwenk, eine Drehung bekommt eine Neigung.

Abhilfe: Beschränke den Bewegungsprompt auf eine klare Richtung und halte den Clip kurz. Brauchst du einen Richtungswechsel (heranfahren, halten, zurückfahren), erzeuge zwei Clips und schneide sie zusammen.

Größenschwankungen

Das Produkt scheint während des Clips seine Größe zu ändern, am deutlichsten bei Drehungen und Orbits. Das Modell leitet aus einem flachen Bild ein 3D-Objekt ab, und die abgeleitete Geometrie trifft die echten Proportionen selten genau.

Abhilfe: Nimm ein Standbild mit neutralen Tiefenhinweisen. Dramatische Perspektive, harte Schatten und Weitwinkelverzerrung geben dem Modell mehr Geometrie zum Raten; flaches Studiolicht gibt ihm weniger.

Zwei Hinweise für Leserinnen und Leser aus dem deutschsprachigen Raum: Die Preise von 8frame sind in US-Dollar, und die App-Oberfläche gibt es auf Deutsch. Ist dein Browser auf Deutsch eingestellt, öffnet sich die App auf Deutsch.

Häufige Fragen

Kann ich ein vorhandenes Produktfoto des Kunden verwenden, statt mit Nano Banana Pro zu generieren?

Ja. In Schritt 1 geht es um ein freigegebenes Referenzbild. Ein echtes Foto zeigt das tatsächliche Produkt, wenn es eins gibt, nimm es also; Nano Banana Pro ist für den Fall, dass du das Standbild erst erzeugen musst. Achte darauf, dass du eins in jedem Format hast, das du animieren willst.

Was kostet eine Bild-zu-Video-Kette auf 8frame?

Zwei Standbilder mit Nano Banana Pro, ein 5-Sekunden-Hero-Clip mit Seedance 2.0 in 720p und fünf 5-Sekunden-Varianten mit Kling v3 mit Ton kommen auf 580 Credits, etwa 5,80 US-Dollar zum Paketpreis; 435 mit Varianten ohne Ton.

Wie lange dauert die Kette?

Auf 8frame braucht ein Standbild mit Nano Banana Pro im Median 37 Sekunden, ein Seedance-2.0-Clip in 720p etwa 3 Minuten und ein 5-Sekunden-Clip mit Kling v3 etwa 1 Minute. Varianten können parallel laufen, bis zu 10 Aufgaben pro Konto.

Kann ich mit Kling aus einem Standbild eine vertikale und eine horizontale Variante machen?

Nein. Startest du von einem Bild, folgt Kling dem Format des Bildes. Erzeuge ein vertikales und ein horizontales Standbild, oder nutze die festen Formate von Seedance.

Wie halte ich die Varianten konsistent, wenn Kling jede einzeln generiert?

Die Konsistenz kommt vom Referenzbild, nicht aus einem Gedächtnis des Modells. Jede Variante nutzt dasselbe freigegebene Standbild als Startbild, der visuelle Anker ist also gemeinsam, und die Bewegungsrichtung ist die einzige Variable.

Quellen


Fertige Boards zum Loslegen findest du unter 8frame-Workflows.

Probier es ohne Anmeldung aus: Du landest direkt auf einem echten Board. Der 8frame-Canvas ist kostenlos und unbegrenzt; die Generierung ist kostenpflichtig ab 19 US-Dollar im Monat.

Verwandte Artikel

Prompt-RatgeberKI-Prompt-Längenlimits pro Modell 2026: Kling, Seedance, Wan, Hailuo, MidjourneyVergleichDer beste KI-Videogenerator für Facebook-Anzeigen 2026VergleichDer beste KI-Videogenerator für Instagram Reels 2026

Make it
move.

Stay in the loop

Be the first to hear about our launch and get product updates