SCHREIBEN SIE BEWEGUNG, KEIN BILD
So funktioniert der Video-zu-Prompt Generator
Ein Bildprompt beschreibt ein eingefrorenes Einzelbild. Ein Video-Prompt muss Veränderung beschreiben: was das Motiv in den nächsten acht Sekunden tut, wie sich die Kamera bewegt, wie sich das Licht verhält und wann jeder Moment passiert. Dieses Tool liest diese Veränderung aus einem Clip heraus oder leitet sie aus einem einzelnen Bild ab und schreibt sie dann in der Syntax, auf die Ihr Video-Modell reagiert.
Was der Prompt aus Ihren Einzelbildern liest
Einzelbilder werden in zeitlicher Reihenfolge abgetastet, sodass das Tool sie vergleichen kann: Ein Motiv, das zwischen den Bildern schrumpft, deutet auf eine Rückwärtsbewegung hin, ein kippender Horizont deutet auf eine Handkamera-Bewegung hin, eine Lichtquelle, die über ein Gesicht streicht, deutet auf ein vorbeifahrendes Auto oder einen sich drehenden Kopf hin. Es benennt die Einstellungsgröße, Kamerahöhe und -winkel, die Handlung des Motivs und ihren Verlauf, den Schauplatz, die Tageszeit und das Wetter, die Lichtrichtung und -qualität sowie die Palette und den Stil.
Dann schreibt es den Prompt als Bewegung. Jeder Satz sagt, was sich bewegt, einschließlich der Kamera. Der Stil wird bewahrt statt aufgewertet: körniges Handyvideo bleibt körniges Handyvideo, sofern Sie nichts anderes verlangen, denn genau das ist meist der Sinn, den Prompt zu extrahieren.
Bild-zu-Video-Prompt: ein Standbild zum Leben erwecken
Bei einem einzelnen Bild gibt es keine Bewegung zu lesen, daher leitet das Tool eine plausible aus dem Bild ab: Ein Porträt erhält einen langsamen Push-in und eine kleine Geste, ein Produkt erhält einen Orbit und ein bewegtes Element, eine Landschaft erhält eine Drift und Wetter. Ihre Anweisung überschreibt all das. „Sie schaut auf und lächelt“ oder „statische Kamera, nur das Wasser bewegt sich“ sind die Sätze, die einen Bild-zu-Video-Prompt zu Ihrem eigenen machen.
Der Prompt behält bei, was das Bild bereits festgelegt hat. Motiv, Bildausschnitt, Licht und Palette werden so beschrieben, dass das erste Einzelbild des Video-Modells zu Ihrem Bild passt – genau das, was die Bild-zu-Video-Modi von Sora, Veo, Kling und Runway brauchen, um der Referenz treu zu bleiben.
Sora 2, Veo 3, Kling und Runway lesen Prompts unterschiedlich
Dieselbe Idee muss auf fünf Arten geschrieben werden. Sora 2 und Veo 3 erzeugen Ton, daher enden ihre Prompts mit einer Audio-Zeile; Kling gewichtet das Motiv und eine einzelne klare Bewegung; Runway will die Kamerabewegung zuerst, in seinen eigenen Worten. Wählen Sie das Modell im Tool, und der Prompt folgt diesen Regeln.
| Video-Modell | Wie der Prompt geschrieben wird | Audio | Länge |
|---|
| Sora 2 | Einfacher Fließtext; eine kurze Einstellungsliste mit Timings bei mehreren Beats | Ja, natives Audio: endet mit einer Ton- oder Dialogzeile | Unter ~180 Wörtern |
|---|
| Veo 3 | Ein kinoreifer Absatz: Einstellung, Handlung, Umgebung, Licht, Stil | Ja: fügt einen Sound-Design-Satz hinzu, Dialog in Anführungszeichen | Unter ~160 Wörtern |
|---|
| Kling | Motiv → Bewegung → Szene → Kamera → Licht, eine klare Hauptbewegung | Nein | 60–110 Wörter |
|---|
| Runway Gen-4 | Kamerabewegung zuerst (Push-in, Orbit, Tracking, Kran), dann Motivbewegung | Nein | Unter ~80 Wörtern |
|---|
| Allgemein | Modellübergreifender Fließtext: Einstellung und Kamera, Motivbewegung, Schauplatz, Stil, Dauer | Optional | 90–160 Wörter |
|---|
Wer einen Video-Prompt-Generator nutzt
Kreative und Marketer verwandeln ein Produktfoto oder ein Kampagnen-Standbild in einen kurzen Hero-Clip, ohne Kamerasprache von Grund auf zu schreiben. Filmemacher und Editoren extrahieren den Prompt aus einer Referenzaufnahme, um deren Bewegung und Licht in Sora oder Veo nachzubilden. Social-Teams reproduzieren das Tempo eines gut performenden Clips mit einem neuen Motiv. Prompt-Engineers nutzen die modellspezifischen Formate als Ausgangspunkt und vergleichen, wie Sora 2, Veo 3 und Kling dieselbe Einstellung interpretieren.
Datenschutz, Limits und Kosten
Ihr Video wird nicht hochgeladen. Vier Einzelbilder werden von Ihrem Browser in reduzierter Größe abgetastet, und nur diese Einzelbilder werden analysiert; nichts, was Sie einreichen, wird der Galerie hinzugefügt oder jemand anderem gezeigt. Clips sind auf 60 Sekunden und 60 MB begrenzt, was für eine einzelne Aufnahme ausreicht und die Analyse schnell hält. Ein Durchlauf kostet 2 Credits, doppelt so viel wie die Bildtools, da mehrere Einzelbilder gelesen und ein längerer, zeitlich getakteter Prompt geschrieben werden.
Brauchen Sie stattdessen den Prompt hinter einem Standbild? Nutzen Sie Image to Prompt. Starten Sie von Worten? Text to Prompt erweitert sie, und die Image Prompt Gallery zeigt fertige Prompts nach Stil.
COMMON QUESTIONS
Video to prompt FAQ
Was ist ein Video-zu-Prompt-Generator?
Er liest ein kurzes Video oder ein Standbild und schreibt den Text-Prompt, der diese Aufnahme in einem KI-Video-Generator nachbilden würde. Der Prompt beschreibt, was sich bewegt: die Handlung des Motivs, die Kamerabewegung, das Licht, das Tempo und die Dauer, im Format, das Sora, Veo, Kling oder Runway am besten liest.
Wie extrahiere ich einen Prompt aus einem Video?
Laden Sie einen MP4-, WebM- oder MOV-Clip von bis zu 60 Sekunden hoch. Vier Einzelbilder werden über den Clip verteilt in Ihrem Browser abgetastet und zur Analyse gesendet; die Videodatei selbst verlässt niemals Ihr Gerät. Wählen Sie das Video-Modell und die Zieldauer, fügen Sie optional eine Anweisung hinzu und klicken Sie auf Generieren. Schneiden Sie lange Videos auf die eine Aufnahme zu, für die Sie einen Prompt wollen.
Kann ich stattdessen einen Video-Prompt aus einem Bild generieren?
Ja. Fügen Sie ein Bild hinzu, und das Tool schreibt einen Bild-zu-Video-Prompt: Es behält Motiv, Bildausschnitt, Licht und Stil des Bildes bei und fügt die Bewegung, Kamerafahrt und das Timing hinzu, die ein Video-Modell zum Animieren braucht. Das ist die richtige Eingabe für die Bild-zu-Video-Modi von Sora, Veo, Kling und Runway.
Schreibt es Sora-2-Prompts?
Ja. Wählen Sie Sora 2, und der Prompt wird als einfacher Fließtext geschrieben, mit einer kurzen Einstellungsliste, wenn die Bewegung mehrere Beats hat, jeweils mit Timing in Sekunden, und einer Abschlusszeile für Audio, da Sora 2 synchronisierten Ton erzeugt.
Was ist mit Veo 3, Kling und Runway?
Jedes hat seine eigene Option. Veo 3 erhält einen kinoreifen Absatz mit einer Audio-Zeile; Kling erhält einen kompakten Prompt in der Reihenfolge Motiv, Bewegung, Szene, Kamera, Licht; Runway Gen-4 erhält einen kurzen Prompt, der mit Kamerabewegung in Runways eigenem Vokabular beginnt. Wählen Sie Allgemein für einen Prompt, der modellübergreifend funktioniert.
Kann es den exakten Prompt hinter einem KI-Video rekonstruieren?
Kein Tool kann den verborgenen Prompt aus einem fertigen Video auslesen. Was es tut, ist die sichtbare Bewegung, Kamera, Licht und Stil so präzise zu beschreiben, dass das erneute Ausführen des Prompts dieselbe Art von Aufnahme erzeugt.
Ist das Video-zu-Prompt-Tool kostenlos?
Sie können es innerhalb des täglichen kostenlosen Kontingents ohne Konto ausprobieren. Jeder Durchlauf kostet 2 Credits auf einem Plan, da mehrere Einzelbilder gelesen und ein längerer Prompt geschrieben werden als bei den Bildtools.
Welche Videodateien funktionieren?
MP4, WebM und MOV bis 60 MB und 60 Sekunden, sowie JPG-, PNG- und WEBP-Bilder. Da Einzelbilder in Ihrem Browser gelesen werden, unterstützen sehr alte Browser möglicherweise nicht jeden Codec; wenn ein Clip nicht geladen werden kann, exportieren Sie ihn als MP4 (H.264) und versuchen Sie es erneut.