ESCREVA MOVIMENTO, NÃO UMA IMAGEM
Como o gerador de Vídeo para Prompt funciona
Um prompt de imagem descreve um fotograma congelado. Um prompt de vídeo tem de descrever a mudança: o que o sujeito faz nos oito segundos seguintes, como a câmara se move, como a luz se comporta e quando acontece cada momento. Esta ferramenta lê essa mudança a partir de um vídeo ou infere-a a partir de uma única imagem, escrevendo-a depois na sintaxe a que o seu modelo de vídeo responde.
O que o prompt lê a partir dos seus fotogramas
Os fotogramas são amostrados por ordem temporal, para que a ferramenta os possa comparar: um sujeito que encolhe entre fotogramas sugere um afastamento da câmara, um horizonte inclinado sugere um movimento de câmara à mão, uma fonte de luz que varre um rosto sugere um carro a passar ou uma cabeça a virar-se. A ferramenta identifica o tamanho do plano, a altura e o ângulo da câmara, a ação do sujeito e a forma como esta evolui, o cenário, a hora do dia e o clima, a direção e a qualidade da luz, e a paleta e a assinatura de estilo.
Depois, escreve o prompt como movimento. Cada frase diz o que se move, incluindo a câmara. O estilo é preservado em vez de melhorado: um vídeo granulado feito com telemóvel continua a ser um vídeo granulado feito com telemóvel, a menos que peça algo diferente, porque esse costuma ser o objetivo de extrair o prompt.
Prompt de imagem para vídeo: animar uma imagem fixa
Com uma única imagem não há movimento para ler, por isso a ferramenta infere um movimento plausível a partir da imagem: um retrato recebe uma aproximação lenta e um pequeno gesto, um produto recebe uma órbita e um elemento em movimento, uma paisagem recebe uma deriva e clima. A sua indicação substitui tudo isso. “Ela olha para cima e sorri” ou “câmara estática, só a água se move” são as frases que tornam um prompt de imagem para vídeo verdadeiramente seu.
O prompt mantém aquilo que a imagem já decidiu. O sujeito, o enquadramento, a luz e a paleta são descritos para que o primeiro fotograma do modelo de vídeo corresponda à sua imagem, que é o que os modos de imagem para vídeo do Sora, Veo, Kling e Runway precisam para se manterem fiéis à referência.
Sora 2, Veo 3, Kling e Runway leem os prompts de forma diferente
A mesma ideia tem de ser escrita de cinco formas diferentes. O Sora 2 e o Veo 3 geram som, por isso os seus prompts terminam com uma linha de áudio; o Kling dá peso ao sujeito e a um único movimento claro; o Runway quer o movimento de câmara em primeiro lugar, nas suas próprias palavras. Escolha o modelo na ferramenta e o prompt segue estas regras.
| Modelo de vídeo | Como o prompt é escrito | Áudio | Duração |
|---|
| Sora 2 | Texto corrido simples; uma pequena lista de planos com tempos quando há vários momentos | Sim, áudio nativo: termine com uma linha de som ou diálogo | Menos de ~180 palavras |
|---|
| Veo 3 | Um parágrafo cinematográfico: plano, ação, ambiente, luz, estilo | Sim: acrescente uma frase de desenho de som, diálogo entre aspas | Menos de ~160 palavras |
|---|
| Kling | Sujeito → movimento → cena → câmara → luz, um único movimento principal claro | Não | 60–110 palavras |
|---|
| Runway Gen-4 | Movimento de câmara em primeiro lugar (aproximação, órbita, travelling, grua), depois o movimento do sujeito | Não | Menos de ~80 palavras |
|---|
| Geral | Texto corrido multimodelo: plano e câmara, movimento do sujeito, cenário, estilo, duração | Opcional | 90–160 palavras |
|---|
Quem utiliza um gerador de prompts de vídeo
Criadores e profissionais de marketing transformam uma fotografia de produto ou uma imagem de campanha num pequeno vídeo de destaque sem terem de escrever linguagem de câmara do zero. Cineastas e editores extraem o prompt de um plano de referência para recriar o seu movimento e luz no Sora ou no Veo. Equipas de redes sociais reproduzem o ritmo de um vídeo que teve bom desempenho com um novo sujeito. Engenheiros de prompt usam os formatos específicos de cada modelo como ponto de partida e comparam como o Sora 2, o Veo 3 e o Kling interpretam o mesmo plano.
Privacidade, limites e custo
O seu vídeo não é carregado. Quatro fotogramas são amostrados pelo seu navegador em tamanho reduzido e apenas esses fotogramas são analisados; nada do que submete é adicionado à Galeria nem mostrado a mais ninguém. Os vídeos estão limitados a 60 segundos e 60 MB, o que é suficiente para um único plano e mantém a análise rápida. Cada execução custa 2 créditos, o dobro do preço das ferramentas de imagem, porque lê vários fotogramas e escreve um prompt mais longo e temporizado.
Precisa antes do prompt por trás de uma imagem fixa? Use o Imagem para Prompt. A começar a partir de palavras? O Texto para Prompt expande-as, e a Galeria de Prompts mostra prompts concluídos por estilo.
COMMON QUESTIONS
Video to prompt FAQ
O que é um gerador de vídeo para prompt?
Lê um vídeo curto, ou uma imagem fixa, e escreve o prompt de texto que recriaria esse plano num gerador de vídeo com IA. O prompt descreve o que se move: a ação do sujeito, o movimento de câmara, a luz, o ritmo e a duração, no formato que o Sora, o Veo, o Kling ou o Runway melhor interpretam.
Como extraio um prompt a partir de um vídeo?
Carregue um vídeo MP4, WebM ou MOV com até 60 segundos. Quatro fotogramas são amostrados ao longo do vídeo no seu navegador e enviados para análise; o próprio ficheiro de vídeo nunca sai do seu dispositivo. Escolha o modelo de vídeo e a duração pretendida, adicione uma indicação opcional e clique em Gerar. Corte vídeos longos para o único plano para o qual pretende um prompt.
Posso gerar um prompt de vídeo a partir de uma imagem?
Sim. Adicione uma imagem e a ferramenta escreve um prompt de imagem para vídeo: mantém o sujeito, o enquadramento, a luz e o estilo da imagem e acrescenta o movimento, o movimento de câmara e os tempos de que um modelo de vídeo precisa para a animar. Esta é a entrada certa para os modos de imagem para vídeo do Sora, Veo, Kling e Runway.
Escreve prompts para o Sora 2?
Sim. Escolha Sora 2 e o prompt é escrito em texto corrido simples, com uma pequena lista de planos quando o movimento tem vários momentos, cada um com o respetivo tempo em segundos, e uma linha final para o áudio, porque o Sora 2 gera som sincronizado.
E o Veo 3, o Kling e o Runway?
Cada um tem a sua própria opção. O Veo 3 recebe um parágrafo cinematográfico com uma linha de áudio; o Kling recebe um prompt compacto ordenado por sujeito, movimento, cena, câmara, luz; o Runway Gen-4 recebe um prompt curto que começa pelo movimento de câmara, no vocabulário próprio do Runway. Escolha Geral para um prompt que funcione em todos os modelos.
Consegue recuperar o prompt exato por trás de um vídeo de IA?
Nenhuma ferramenta consegue ler o prompt oculto a partir de um vídeo já concluído. O que esta ferramenta faz é descrever o movimento, a câmara, a luz e o estilo visíveis com precisão suficiente para que, ao executar o prompt novamente, se obtenha o mesmo tipo de plano.
A ferramenta de vídeo para prompt é gratuita?
Pode experimentá-la sem conta, dentro do limite diário gratuito. Cada execução custa 2 créditos num plano, porque lê vários fotogramas e escreve um prompt mais longo do que as ferramentas de imagem.
Que ficheiros de vídeo funcionam?
MP4, WebM e MOV até 60 MB e 60 segundos, além de imagens JPG, PNG e WEBP. Como os fotogramas são lidos no seu navegador, navegadores muito antigos podem não suportar todos os codecs; se um vídeo não carregar, exporte-o como MP4 (H.264) e tente novamente.