← Guias

Como Escrever Prompts de Vídeo com IA Que Realmente Funcionam

MyDreamVid · 2026-09-12

A diferença entre um clipe de IA genérico e um que parece intencional quase nunca está no modelo — está no prompt. Prompts de vídeo exigem uma habilidade diferente da dos prompts de imagem: você está descrevendo mudança ao longo do tempo, não uma cena congelada. Esta é a fórmula que funciona, com exemplos que você pode adaptar.

A fórmula em cinco partes

Monte o prompt nesta ordem — sujeito, ação, câmera, luz, estilo:

Um barquinho de papel desce por uma sarjeta cheia de chuva (sujeito), girando devagar enquanto a correnteza o puxa em direção a um bueiro (ação), plano baixo acompanhando ao nível da água (câmera), luz cinzenta de tarde com reflexos de neon (luz), cinematográfico, profundidade de campo rasa (estilo).

Você não precisa de todas as partes sempre, mas a ordem importa: os modelos dão mais peso ao começo do prompt, então comece pelo que o vídeo é, e não por palavras de estilo.

Descreva movimento, não um quadro pintado

O erro mais comum de iniciante é escrever um prompt de imagem — só substantivos e adjetivos, nenhum verbo. Um modelo de vídeo precisa saber o que acontece:

  • Fraco: "uma bela floresta antiga, névoa mística, épico"
  • Forte: "a névoa avança entre árvores antigas enquanto a câmera desliza para frente em ritmo de caminhada; um cervo levanta a cabeça e se vira para a lente"

Uma ação clara por clipe vale mais que cinco ações vagas. Se a sua ideia precisa de várias ações, então ela precisa de vários planos — o espaço de trabalho de filme existe exatamente para isso.

Vocabulário de câmera que os modelos entendem

Vocabulário simples de cinema funciona: aproximação lenta, plano acompanhando, câmera na mão, plano de drone subindo e se afastando, quadro fixo travado, whip pan, close, plano geral de estabelecimento. Escolha um movimento de câmera por clipe. Instruções contraditórias ("plano fixo, a câmera orbita o sujeito") produzem uma papa visual.

Diálogo e som também moram no prompt

Coloque as palavras faladas entre aspas e elas são ditas em voz alta, com uma entonação que você dirige na prosa em volta — "ela sussurra: 'chegamos tarde demais.'" A ambiência acompanha a cena automaticamente. Os detalhes, incluindo o truque testado para fazer animais falarem sem criar lábios humanos, estão no guia de áudio.

Iterar sem torrar créditos

Toda geração mostra o preço exato em créditos antes de você começar, e gerações com falha são reembolsadas — então o custo de iterar é o custo dos rascunhos. O ciclo barato: rascunhe em 480p ou 720p no Seedance 2.0 Mini, mude uma coisa por tentativa para aprender o que cada palavra faz e depois gere de novo o prompt vencedor no 2.5 para a estética final. Um rascunho de 5 segundos em 720p no Mini custa cerca de 54 créditos — mais ou menos $0,54 (preços).

Se o prompt for recusado

A revisão de conteúdo cobre as mesmas categorias em todos os modelos, mas o Seedance 2.5 lê prompts com mais rigor que a família 2.0 — um prompt recusado no 2.5 às vezes passa no 2.0, e reescrever a ideia sinalizada em linguagem mais simples costuma resolver. Prompts que citam pessoas reais são recusados por princípio.

Perguntas frequentes

Qual deve ser o tamanho de um prompt de vídeo?

De duas a quatro frases é o ponto ideal. Longo o bastante para cobrir sujeito, ação, câmera e luz — curto o bastante para que nenhuma instrução contradiga a outra. Passando de ~100 palavras, o detalhe extra em geral é ignorado.

Por que o mesmo prompt me dá um vídeo diferente?

A geração é intencionalmente não determinística — o mesmo prompt produz uma família de interpretações. Encare isso como variedade de graça: gere duas ou três tomadas de um plano importante e fique com a melhor.

Prompts negativos funcionam?

Formule o que você quer, não o que você teme: "rua vazia" funciona melhor que "sem pessoas". Se algo indesejado insiste em aparecer, descreva o quadro de forma mais completa, para que não sobre brecha para ele preencher.

O idioma do prompt faz diferença?

Prompts em inglês são interpretados de forma mais confiável, mas os modelos entendem bem os principais idiomas. O diálogo entre aspas é falado no idioma em que você o escrever.

Crie seu primeiro vídeo