SCRIVI IL MOVIMENTO, NON UN'IMMAGINE
Come funziona il generatore da video a prompt
Un prompt per immagini descrive un fotogramma fermo. Un prompt video deve descrivere il cambiamento: cosa fa il soggetto negli otto secondi successivi, come si muove la camera, come si comporta la luce e quando accade ogni momento. Questo strumento legge quel cambiamento da una clip o lo deduce da una singola immagine, poi lo scrive nella sintassi a cui il tuo modello video risponde.
Cosa legge il prompt dai tuoi fotogrammi
I fotogrammi vengono campionati in ordine temporale, così lo strumento può confrontarli: un soggetto che si rimpicciolisce tra i fotogrammi implica un allontanamento della camera, un orizzonte che si inclina implica un movimento a mano libera, una fonte di luce che spazza un volto implica un'auto di passaggio o una testa che si gira. Nomina la dimensione dell'inquadratura, l'altezza e l'angolazione della camera, l'azione del soggetto e come progredisce, l'ambientazione, il momento della giornata e il meteo, la direzione e la qualità dell'illuminazione, e la firma di palette e stile.
Poi scrive il prompt come movimento. Ogni frase dice cosa si muove, camera inclusa. Lo stile viene preservato invece che migliorato: un filmato granuloso da telefono resta un filmato granuloso da telefono a meno che tu non chieda qualcos'altro, perché di solito è proprio quello il punto di estrarre il prompt.
Prompt da immagine a video: animare un fermo immagine
Con una singola immagine non c'è movimento da leggere, quindi lo strumento ne deduce uno plausibile dall'immagine: un ritratto riceve un lento avvicinamento e un piccolo gesto, un prodotto riceve un'orbita e un elemento in movimento, un paesaggio riceve una deriva e del meteo. La tua direzione ha la precedenza su tutto questo. "Alza lo sguardo e sorride" oppure "camera statica, si muove solo l'acqua" sono le frasi che rendono tuo un prompt da immagine a video.
Il prompt mantiene ciò che l'immagine ha già deciso. Soggetto, inquadratura, luce e palette sono descritti in modo che il primo fotogramma del modello video corrisponda alla tua immagine, che è ciò di cui le modalità immagine-a-video di Sora, Veo, Kling e Runway hanno bisogno per restare fedeli al riferimento.
Sora 2, Veo 3, Kling e Runway leggono i prompt in modo diverso
La stessa idea deve essere scritta in cinque modi diversi. Sora 2 e Veo 3 generano audio, quindi i loro prompt terminano con una riga audio; Kling dà peso al soggetto e a un unico movimento chiaro; Runway vuole prima il movimento di camera, nel proprio linguaggio. Scegli il modello nello strumento e il prompt seguirà queste regole.
| Modello video | Come è scritto il prompt | Audio | Lunghezza |
|---|
| Sora 2 | Testo semplice; una breve lista di inquadrature con tempistiche quando ci sono più momenti | Sì, audio nativo: termina con una riga di suono o dialogo | Sotto le ~180 parole |
|---|
| Veo 3 | Un paragrafo cinematografico unico: inquadratura, azione, ambiente, luce, stile | Sì: aggiungi una frase di sound design, dialogo tra virgolette | Sotto le ~160 parole |
|---|
| Kling | Soggetto → movimento → scena → camera → luce, un unico movimento primario chiaro | No | 60–110 parole |
|---|
| Runway Gen-4 | Prima il movimento di camera (avvicinamento, orbita, tracking, gru), poi il movimento del soggetto | No | Sotto le ~80 parole |
|---|
| Generale | Testo trasversale ai modelli: inquadratura e camera, movimento del soggetto, ambientazione, stile, durata | Facoltativo | 90–160 parole |
|---|
Chi usa un generatore di prompt video
Creator e marketer trasformano una foto di prodotto o un'immagine di campagna in una breve clip in primo piano senza scrivere da zero il linguaggio della camera. Filmmaker ed editor estraggono il prompt da un'inquadratura di riferimento per ricrearne il movimento e la luce in Sora o Veo. I team social riproducono il ritmo di una clip che ha avuto successo con un nuovo soggetto. I prompt engineer usano i formati specifici per modello come punto di partenza e confrontano come Sora 2, Veo 3 e Kling interpretano la stessa inquadratura.
Privacy, limiti e costi
Il tuo video non viene caricato. Quattro fotogrammi vengono campionati dal tuo browser a dimensione ridotta e solo quei fotogrammi vengono analizzati; nulla di ciò che invii viene aggiunto alla Galleria o mostrato a chiunque altro. Le clip sono limitate a 60 secondi e 60 MB, il che è sufficiente per una singola inquadratura e mantiene l'analisi rapida. Un'esecuzione costa 2 crediti, il doppio del prezzo degli strumenti per immagini, perché legge più fotogrammi e scrive un prompt più lungo e con tempistiche.
Ti serve il prompt dietro un'immagine ferma invece? Usa Da Immagine a Prompt. Parti dalle parole? Da Testo a Prompt le espande, e la Galleria dei Prompt per Immagini mostra prompt finiti per stile.
COMMON QUESTIONS
Video to prompt FAQ
Cos'è un generatore da video a prompt?
Legge un breve video, o un'immagine ferma, e scrive il prompt testuale che ricreerebbe quell'inquadratura in un generatore video AI. Il prompt descrive cosa si muove: l'azione del soggetto, il movimento della camera, la luce, il ritmo e la durata, nel formato che Sora, Veo, Kling o Runway leggono meglio.
Come estraggo un prompt da un video?
Carica una clip MP4, WebM o MOV fino a 60 secondi. Quattro fotogrammi vengono campionati lungo la clip nel tuo browser e inviati per l'analisi; il file video stesso non lascia mai il tuo dispositivo. Scegli il modello video e la durata desiderata, aggiungi una direzione facoltativa e clicca su Genera. Taglia i video lunghi alla singola inquadratura per cui vuoi un prompt.
Posso generare un prompt video da un'immagine invece?
Sì. Aggiungi un'immagine e lo strumento scrive un prompt da immagine a video: mantiene il soggetto, l'inquadratura, la luce e lo stile della foto e aggiunge il movimento, il movimento di camera e le tempistiche di cui un modello video ha bisogno per animarla. Questo è l'input giusto per le modalità immagine-a-video di Sora, Veo, Kling e Runway.
Scrive prompt per Sora 2?
Sì. Scegli Sora 2 e il prompt viene scritto come testo semplice con una breve lista di inquadrature quando il movimento ha più momenti, ciascuno con tempistiche in secondi, e una riga finale per l'audio, perché Sora 2 genera suono sincronizzato.
E Veo 3, Kling e Runway?
Ognuno ha la propria opzione. Veo 3 riceve un unico paragrafo cinematografico con una riga audio; Kling riceve un prompt compatto ordinato in soggetto, movimento, scena, camera, luce; Runway Gen-4 riceve un breve prompt che inizia con il movimento di camera nel vocabolario proprio di Runway. Scegli Generale per un prompt che funziona su tutti i modelli.
Può recuperare il prompt esatto dietro un video AI?
Nessuno strumento può leggere il prompt nascosto da un video finito. Ciò che fa è descrivere il movimento visibile, la camera, la luce e lo stile in modo abbastanza preciso da far sì che eseguire di nuovo il prompt produca lo stesso tipo di inquadratura.
Lo strumento da video a prompt è gratuito?
Puoi provarlo senza un account entro l'indennità giornaliera gratuita. Ogni esecuzione costa 2 crediti su un piano, perché legge più fotogrammi e scrive un prompt più lungo rispetto agli strumenti per immagini.
Quali file video funzionano?
MP4, WebM e MOV fino a 60 MB e 60 secondi, oltre a immagini JPG, PNG e WEBP. Poiché i fotogrammi vengono letti nel tuo browser, i browser molto datati potrebbero non supportare tutti i codec; se una clip non si carica, esportala come MP4 (H.264) e riprova.