Neste guia você vai fazer um vídeo vertical de 30 segundos, com uma personagem que fala em português, no estilo que você escolher. Você não precisa saber nada de IA e não vai pagar nada. Precisa de um celular ou computador, de uma conta do Google (a mesma do Gmail) e de uma tarde livre.
Todo mundo que segue este guia faz o mesmo vídeo, e isso é de propósito. Fazendo um vídeo guiado do começo ao fim, você aprende o caminho inteiro sem precisar inventar nada. No final do guia, você aprende a criar as suas próprias histórias, pra fazer o vídeo que quiser.
Uma menina de 19 anos mora na periferia e trabalha o dia inteiro. O dinheiro mal dá pro mês, e a faculdade vai ficando pra depois porque não sobra nada pra pagar a mensalidade. Só que agora a faculdade vai ser de graça, e com 19 anos essa menina finalmente pode começar a estudar.
São 3 cenas de 10 segundos. Em cada uma ela fala sozinha, no clima daquelas novelas de frutas falantes.
Cena
Onde
O que ela fala
1
no trabalho, atrás do balcão
"Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
2
no quarto, contando o dinheiro
"O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
3
no quarto, olhando o celular
"Peraí... a faculdade vai ser de graça? Com dezenove anos, eu vou começar a estudar!"
Essas falas são uma sugestão. Se quiser, escreva com as suas palavras, do jeito que você fala. Só mantenha a história e a ordem, porque é isso que faz o vídeo dar certo no final: na cena 1 ela está cansada depois de um dia inteiro de trabalho, na cena 2 percebe que o dinheiro não dá pra faculdade e na cena 3 descobre que a faculdade vai ser de graça e comemora. Cada fala precisa ser curta, com uma ou duas frases, pra caber nos 10 segundos. E se você mudar uma fala, troque também dentro do prompt do vídeo daquela cena, no trecho entre aspas.
criar a personagem e as cenas com o Nano Banana, o gerador de imagem do Google
imagem ilimitada, baixa em 2K sem gastar crédito e sai sem marca d'água
Gemini ou ChatGPT
mudar os prompts, se você quiser, e criar as suas próprias histórias no final
grátis
Dola
transformar as imagens em vídeo com fala
6 pontos por dia, cada vídeo de 10 segundos gasta 2, e o vídeo sai sem marca d'água
CapCut
juntar os vídeos e colocar legenda
grátis
O aplicativo do Gemini também gera imagem com o Nano Banana, só que coloca uma marquinha no canto. Por isso as imagens daqui são feitas no Flow, o app do Google onde fica o Veo 3. Ele usa o mesmo gerador e entrega a imagem limpa. Lá dentro aparecem 50 créditos por dia, mas eles só são gastos quando você faz vídeo com o Veo 3. Pra gerar imagem e baixar em 2K você não gasta nada, então pode refazer quantas vezes quiser.
Os 6 pontos do Dola dão exatamente as 3 cenas. Se alguma sair errada, você refaz no dia seguinte, quando os pontos voltam. Esses limites são aproximados e podem mudar.
A ferramenta é a parte técnica, e você vai aprender a mexer nela hoje mesmo. O que faz alguém assistir um vídeo até o fim vem antes dela: o objetivo, o sentimento, as referências e os elementos que você tem. Pro vídeo deste guia, as respostas já estão prontas:
Objetivo: mostrar a virada na vida da menina.
Sentimento: aperto no começo, alívio e alegria no final.
Referências: vídeos de frutas falantes em clima de novela e uma imagem do estilo que você vai escolher no Passo 1. Procure "novela das frutas" no TikTok e assista dois ou três, só pra sentir o clima.
Elementos: uma personagem, dois lugares (a lanchonete e o quarto) e um celular.
Quando você for criar a sua própria história, vai responder perguntas parecidas, no final do guia.
Prompt é o pedido que você escreve pra IA. Neste guia, cada prompt aparece duas vezes: primeiro na língua que a ferramenta entende melhor, pronto pra copiar, e embaixo em português, linha por linha igual, pra você saber exatamente o que está pedindo.
No Flow, o prompt vem em inglês. É só copiar e colar.
No Dola, o prompt vem em chinês, porque o Seedance 2.0, que faz os vídeos, é uma ferramenta chinesa e entende melhor pedido em chinês. Também é só copiar e colar, sem traduzir nada.
Se quiser mudar alguma coisa, como a cor do uniforme, mude na versão em português e peça pra IA traduzir, sempre dizendo em qual ferramenta o prompt vai ser usado.
Style: handmade plush doll made of soft cotton fabric, visible stitches, felt details.
Estilo: boneco artesanal de pelúcia feito de tecido de algodão macio, costuras aparentes, detalhes em feltro.
Sua própria foto
Style: realistic photo.
Estilo: foto realista.
Se você escolheu 3D, 2D, cartum ou algodão
Abra o Pinterest (pinterest.com ou o aplicativo).
Pesquise o termo do seu estilo, que está na primeira tabela.
Escolha uma imagem de personagem que tenha o traço que você quer.
Abra a imagem, toque nos três pontinhos e escolha baixar imagem.
Guarde com o nome referencia.
A referência serve só pra mostrar o estilo. A personagem que você vai criar no Passo 2 é nova, sua, com o traço daquela imagem.
Se você escolheu a sua própria foto
Tire uma foto de frente, com luz de janela no rosto e fundo simples.
Pegue do peito pra cima ou o corpo inteiro, sem óculos escuros e sem nada cobrindo o rosto.
Guarde com o nome minhafoto.
Um aviso importante: o Dola, que faz os vídeos no Passo 4, costuma recusar rosto de pessoa real em foto realista. O caminho mais seguro é usar a sua foto como base e transformar você num dos outros estilos (3D, 2D, cartum ou algodão). Você continua reconhecível, e as chances de o Dola aceitar aumentam. Pra isso, no Passo 2, use a linha do estilo que você quer em vez da linha de foto realista.
Aqui você cria uma folha com a personagem de frente, de lado e de costas. Essa folha é o que garante o mesmo rosto nas 3 cenas.
Entre em flow.google.com com a sua conta do Google e clique em + Novo projeto.
Clique no botão do modelo, no canto da caixa de texto. Confira se está em imagem, com o Nano Banana 2, e escolha o formato 16:9, deitado, pra caber as três vistas lado a lado.
Anexe a sua imagem pelo botão de + ou arrastando pra caixa de texto. Pode ser a referencia do Pinterest ou a minhafoto.
Copie o prompt em inglês do seu caminho, troque a linha entre colchetes pela linha de estilo que você guardou no Passo 1 e envie.
Quando gostar do resultado, clique nos três pontinhos da imagem, escolha baixar em 2K e guarde com o nome personagem.
Caminho A: com a referência do Pinterest
Em inglês:
Use image 1 only as a reference for the art style. Create a new original character, different from the one in image 1.
Character: a 19-year-old Brazilian girl with curly dark hair tied in a bun, big expressive eyes, wearing a simple red fast-food attendant uniform and cap.
Make a character reference sheet on a plain white background, showing her full body from three angles side by side: front, side and back.
Same face, same clothes and same proportions in all views.
[cole aqui a linha de estilo em inglês]
No text, no watermark.
Em português:
Use a imagem 1 só como referência do estilo artístico. Crie uma personagem nova e original, diferente da que está na imagem 1.
Personagem: uma menina brasileira de 19 anos, com cabelo escuro cacheado preso em um coque, olhos grandes e expressivos, usando um uniforme simples vermelho de atendente de lanchonete e boné.
Faça uma folha de referência da personagem em um fundo branco liso, mostrando o corpo inteiro dela em três ângulos lado a lado: frente, perfil e costas.
Mesmo rosto, mesmas roupas e mesmas proporções em todas as vistas.
[cole aqui a linha de estilo em português]
Sem texto, sem marca-d'água.
Caminho B: com a sua foto
Em inglês:
Use image 1 as the reference for the person's face and hair. Keep the face recognizable as the same person.
Turn this person into the character of this video, wearing a simple red fast-food attendant uniform and cap.
Make a character reference sheet on a plain white background, showing the full body from three angles side by side: front, side and back.
Same face, same clothes and same proportions in all views.
[cole aqui a linha de estilo em inglês]
No text, no watermark.
Em português:
Use a imagem 1 como referência do rosto e do cabelo da pessoa. Mantenha o rosto reconhecível como o da mesma pessoa.
Transforme essa pessoa na personagem deste vídeo, usando um uniforme simples vermelho de atendente de lanchonete e boné.
Faça uma folha de referência da personagem em um fundo branco liso, mostrando o corpo inteiro em três ângulos lado a lado: frente, perfil e costas.
Mesmo rosto, mesmas roupas e mesmas proporções em todas as vistas.
[cole aqui a linha de estilo em português]
Sem texto, sem marca-d'água.
Se o resultado não ficar bom, escreva o ajuste no fim do prompt, por exemplo "deixe o cabelo mais volumoso" ou "deixe o rosto mais parecido com a foto", e envie de novo. Na primeira tentativa é normal sair uma mão com seis dedos, e tentar outra vez resolve. Imagem não gasta crédito, então refaça quantas vezes precisar.
Agora você coloca a personagem em cada lugar da história. Os prompts das cenas já pedem o mesmo estilo da sua folha, então servem pra qualquer estilo que você escolheu. Repita isto pra cada cena:
No mesmo projeto do Flow, troque o formato pra 9:16, em pé.
Anexe a imagem personagem.
Cole o prompt em inglês da cena e envie.
Baixe em 2K e guarde com o nome cena1, cena2 ou cena3.
Cena 1
Em inglês:
Use image 1 as the character reference. Keep the face, hair, skin tone and uniform exactly the same.
Vertical 9:16 image.
Scene: the character stands behind the counter of a small fast-food shop at the end of the day, tired but calm, resting both arms on the counter, looking at the camera with a thoughtful expression.
Setting: a simple shop in a neighborhood on the outskirts of a Brazilian city, a cash register and a few cups on the counter, warm light.
Camera: medium shot, eye level.
Style: the same art style as image 1, dramatic soap opera mood.
Keep the character in the center and upper part of the image, leave the bottom 20% clean. No text.
Em português:
Use a imagem 1 como referência da personagem. Mantenha o rosto, o cabelo, o tom de pele e o uniforme exatamente iguais.
Imagem vertical 9:16.
Cena: a personagem está em pé atrás do balcão de uma lanchonete pequena no fim do dia, cansada mas tranquila, com os dois braços apoiados no balcão, olhando para a câmera com uma expressão pensativa.
Cenário: uma lanchonete simples em um bairro da periferia de uma cidade brasileira, uma caixa registradora e alguns copos no balcão, luz quente.
Câmera: plano médio, na altura dos olhos.
Estilo: o mesmo estilo artístico da imagem 1, clima dramático de novela.
Mantenha a personagem no centro e na parte de cima da imagem, deixe os 20% de baixo livres. Sem texto.
Cena 2
Em inglês:
Use image 1 as the character reference. Keep the face, hair and skin tone exactly the same. The character now wears a simple gray t-shirt.
Vertical 9:16 image.
Scene: at night in a small bedroom, the character sits on the bed counting a few coins and bills, holding a college tuition bill in the other hand, with a worried expression.
Setting: a simple bedroom in a house on the outskirts of the city, bare brick wall, a small window, a lamp with warm light.
Camera: medium close-up, slightly from above.
Style: the same art style as image 1, dramatic soap opera mood.
Keep the character in the center and upper part of the image, leave the bottom 20% clean. No text.
Em português:
Use a imagem 1 como referência da personagem. Mantenha o rosto, o cabelo e o tom de pele exatamente iguais. Agora a personagem usa uma camiseta cinza simples.
Imagem vertical 9:16.
Cena: à noite, em um quarto pequeno, a personagem está sentada na cama contando algumas moedas e notas, segurando um boleto da mensalidade da faculdade na outra mão, com uma expressão preocupada.
Cenário: um quarto simples em uma casa da periferia, parede de tijolo aparente, uma janela pequena, um abajur com luz quente.
Câmera: plano médio fechado, um pouco de cima.
Estilo: o mesmo estilo artístico da imagem 1, clima dramático de novela.
Mantenha a personagem no centro e na parte de cima da imagem, deixe os 20% de baixo livres. Sem texto.
Cena 3
Em inglês:
Use image 1 as the character reference. Keep the face, hair and skin tone exactly the same. The character wears a simple gray t-shirt.
Vertical 9:16 image.
Scene: sitting on the bed, the character holds the phone with both hands and looks at the screen with wide eyes and a huge surprised smile, full of joy.
Setting: the same simple bedroom with a bare brick wall, now lit by the morning sun coming through the small window.
Camera: close-up, eye level.
Style: the same art style as image 1, dramatic soap opera mood.
Keep the character in the center and upper part of the image, leave the bottom 20% clean. No text.
Em português:
Use a imagem 1 como referência da personagem. Mantenha o rosto, o cabelo e o tom de pele exatamente iguais. A personagem usa uma camiseta cinza simples.
Imagem vertical 9:16.
Cena: sentada na cama, a personagem segura o celular com as duas mãos e olha para a tela com os olhos arregalados e um sorriso enorme de surpresa, cheia de alegria.
Cenário: o mesmo quarto simples com parede de tijolo aparente, agora iluminado pelo sol da manhã entrando pela janela pequena.
Câmera: close, na altura dos olhos.
Estilo: o mesmo estilo artístico da imagem 1, clima dramático de novela.
Mantenha a personagem no centro e na parte de cima da imagem, deixe os 20% de baixo livres. Sem texto.
Antes de seguir, olhe as 3 imagens com calma. O rosto é o mesmo da folha? O estilo é o mesmo nas três? As mãos estão certas? Se alguma sair estranha, peça outra.
Os prompts dos vídeos já vêm em chinês, porque o Seedance 2.0 é uma ferramenta chinesa e entende melhor pedido em chinês. É só copiar e colar. Embaixo de cada um tem a versão em português, linha por linha igual, pra você saber o que está pedindo. A fala da personagem fica em português mesmo, entre aspas, no meio do chinês, porque é exatamente essa frase que ela vai falar.
Como gerar o vídeo no Dola
Entre em dola.com ou no aplicativo Dola, com a sua conta do Google.
Vá na parte de criar vídeo e escolha o Seedance 2.0.
Anexe a imagem da cena (cena1, cena2 ou cena3) como imagem de referência.
Escolha a duração de 10 segundos.
Copie o prompt em chinês do vídeo, cole e gere.
Baixe o vídeo e guarde com o nome video1, video2 ou video3.
Se você usou a sua foto no Passo 2 e for um menino, a história vale do mesmo jeito. Só troque 年轻女声 por 年轻男声 no prompt em chinês. Esses caracteres ficam logo antes da fala: o primeiro quer dizer voz feminina jovem e o segundo, voz masculina jovem.
Vídeo 1
Em chinês:
使用上传的图片作为首帧。
角色双臂撑在柜台上,深吸一口气,看着镜头,用疲惫但平静的声音自言自语。
台词(巴西葡萄牙语,年轻女声):"Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
镜头:缓慢推近到脸部。
声音:轻柔的肥皂剧风格戏剧配乐,远处的街道噪音。
时长:10秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
A personagem apoia os dois braços no balcão, respira fundo e fala sozinha com uma voz cansada mas tranquila, olhando para a câmera.
Fala em português do Brasil, voz feminina jovem: "Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
Câmera: aproximação lenta em direção ao rosto.
Som: música dramática suave de novela, barulho de rua ao longe.
Duração: 10 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Vídeo 2
Em chinês:
使用上传的图片作为首帧。
角色数着硬币,看了看账单,摇摇头,用悲伤的声音自言自语。
台词(巴西葡萄牙语,年轻女声):"O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
镜头:固定机位,带轻微的手持晃动。
声音:安静的房间,时钟滴答作响,轻柔的悲伤音乐。
时长:10秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
A personagem conta as moedas, olha para o boleto, balança a cabeça e fala sozinha com uma voz triste.
Fala em português do Brasil, voz feminina jovem: "O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
Câmera: parada, com um leve movimento de câmera na mão.
Som: quarto silencioso, um relógio fazendo tique-taque, música triste suave.
Duração: 10 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Vídeo 3
Em chinês:
使用上传的图片作为首帧。
角色看着手机,睁大眼睛,露出大大的笑容,自言自语,先是不敢相信,然后非常开心。
台词(巴西葡萄牙语,年轻女声):"Peraí... a faculdade vai ser de graça? Com dezenove anos, eu vou começar a estudar!"
镜头:缓慢推近,直到脸部特写。
声音:悲伤的音乐转变为欢快又感人的肥皂剧主题曲。
时长:10秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
A personagem lê o celular, arregala os olhos, abre um sorriso grande e fala sozinha, primeiro sem acreditar e depois muito feliz.
Fala em português do Brasil, voz feminina jovem: "Peraí... a faculdade vai ser de graça? Com dezenove anos, eu vou começar a estudar!"
Câmera: aproximação lenta até um close do rosto.
Som: a música triste vira um tema de novela alegre e emocionante.
Duração: 10 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Se os pontos acabarem no meio, os vídeos que faltam ficam pro dia seguinte.
Um aviso antes de começar: no CapCut grátis, dá pra gerar a legenda automática e ver ela na tela, mas ela não vai pro vídeo final e também não dá pra baixar, porque é um recurso pago. Então a automática entra só pra você pegar o texto e o tempo de cada frase, e depois você refaz a legenda com texto normal, que é grátis. Dá um pouquinho de trabalho, mas são só 3 falas curtas.
Abra o CapCut e crie um projeto novo.
Coloque video1, video2 e video3, nessa ordem.
Assista uma vez. Se algum vídeo tiver um pedaço parado no começo ou no fim, corte.
Se quiser, dá pra colocar um som de ambiente por baixo dos vídeos, pra dar mais cara de lugar de verdade. A pasta abaixo tem 15 sons de ambiente, como rua de periferia, praia, shopping, escritório e baile funk. Pra história da menina, a rua de periferia combina com a lanchonete. Baixe o som, adicione em Áudio e deixe o volume baixinho, pra não cobrir a fala.
Toque em Legendas e escolha as legendas automáticas. Elas aparecem numa faixa própria na linha do tempo, cada frase num bloquinho.
Pra cada bloquinho, toque em Texto e depois em Adicionar texto. Escreva a mesma frase que aparece nele. Depois arraste e estique o texto novo na linha do tempo até ele começar e terminar junto com o bloquinho.
Deixe os textos no meio da tela, longe da parte de baixo, porque é ali que o aplicativo coloca os botões.
Quando todas as frases estiverem em texto normal, apague os bloquinhos da legenda automática.
Se aparecer no final um trecho com a logo do CapCut, apague esse trecho.
Exporte em 1080 x 1920.
Se na hora de exportar o CapCut pedir assinatura, quase sempre é porque sobrou algum bloquinho da legenda automática. Apague e exporte de novo.
Pronto. Você tem um vídeo de 30 segundos feito com IA, do começo ao fim, sem pagar nada e sem marca d'água.
Você acabou de aprender a parte técnica: criar a personagem, fazer as cenas, transformar em vídeo e juntar tudo. Falta a parte que deixa o vídeo com a sua cara, que é a história. E pra ela você também pode usar uma IA de graça.
1. Escreva a sua história em poucas linhas
Pense numa história com começo, virada e final, do jeito que a da menina foi contada no começo deste guia. Pra funcionar, basta que ela seja clara. Se travar, responda estas perguntas:
Qual é o objetivo do vídeo? Vender, fazer rir, emocionar, contar algo que aconteceu.
Qual sentimento quem assiste tem que sentir no final? Alegria, alívio, saudade, curiosidade.
Quem é a personagem? Idade, jeito e o que ela faz da vida.
Qual é o problema dela no começo?
O que muda?
Como ela termina?
Pra achar o clima, use referências. O Pinterest ajuda a ver estilo e cenário, e o TikTok e o Instagram mostram vídeos que passam o sentimento que você quer.
2. Peça pra IA transformar a história em roteiro
Abra o ChatGPT, o Gemini ou o Claude, na versão grátis.
Copie o pedido abaixo, troque o que está entre colchetes pela sua história e envie.
Quero fazer um vídeo vertical de 30 segundos com IA, com uma personagem só, que fala sozinha, em clima de novela.
Minha história é esta: [escreva aqui a sua história em 3 ou 4 frases]
Organize essa história em um roteiro de 3 cenas de 10 segundos.
Para cada cena, escreva:
- Onde: o lugar da cena.
- O que acontece: o que a personagem faz e qual é a expressão dela.
- Fala: o que ela diz, com no máximo 15 palavras, em português do Brasil.
No final, descreva a personagem em uma linha: idade, cabelo, roupa e um detalhe que ajude a reconhecer.
Escreva de forma simples, sem acrescentar cenas nem personagens.
Leia o roteiro que ele devolver. Se alguma fala ficar comprida ou estranha, peça o ajuste no mesmo chat, por exemplo "deixe a fala da cena 2 mais curta" ou "deixe a fala da cena 3 mais animada".
3. Coloque o roteiro nos prompts do guia
Agora é trocar a história da menina pela sua, sempre na versão em português dos prompts:
O que veio no roteiro
Onde entra no guia
a descrição da personagem
na linha "Personagem" do prompt do Passo 2
"Onde" e "O que acontece" de cada cena
nas linhas "Cena" e "Cenário" dos prompts do Passo 3
a fala de cada cena
entre as aspas dos prompts de vídeo do Passo 4
Depois de trocar, leia cada prompt inteiro e ajuste o que ainda for da história da menina, como o uniforme ou o boleto. Aí peça pra IA traduzir: pro inglês se o prompt for usado no Flow, pro chinês se for usado no Dola, sempre dizendo em qual ferramenta ele vai ser usado.
4. Faça o vídeo
Siga os Passos 1 a 5 do guia com a sua história. O Dola faz 3 cenas por dia, então um vídeo de 30 segundos sai num dia. Quando pegar o jeito, dá pra crescer: 6 cenas fazem 1 minuto e 9 cenas fazem 1min30. É só pedir pra IA organizar a história em 6 ou 9 cenas no lugar de 3.
Foto de outra pessoa só entra com a autorização dela.
Checklist na IA
Estilo escolhido e referência (ou foto) guardada
Folha da personagem pronta, com frente, perfil e costas
Uma imagem por cena, com o rosto e o estilo iguais aos da folha
Imagens com nome em ordem (cena1, cena2, cena3...)
Prompts dos vídeos colados em chinês, com a fala em português entre aspas
Vídeos gerados dentro dos pontos do dia
Tudo guardado numa pasta só
Checklist final
A primeira cena já mostra o problema, sem apresentação
O rosto e o estilo do personagem são os mesmos em todas as cenas
Vídeo vertical, exportado em 1080 x 1920
Nenhuma marca d'água, nem a do final do CapCut
Nada importante na parte de baixo da tela
A fala está clara e a legenda confere com ela
Legenda refeita com texto normal e a legenda automática apagada
O final mostra a virada da história
Você assistiu no celular antes de postar
Os prompts ficaram salvos numa pasta pra usar de novo
Este guia continua o "Seu primeiro vídeo com IA, de graça". Lá você fez a personagem, as 3 cenas e o vídeo de 30 segundos da menina que finalmente pode estudar. Aqui você vai aprender a mostrar essa mesma história de vários jeitos: de perto, de longe, de cima, por cima do ombro. É isso que dá cara de cinema a um vídeo, e continua tudo de graça e sem marca d'água.
criar as folhas de referência e as imagens nos novos enquadramentos, sem gastar crédito
Dola
transformar as imagens em vídeo
CapCut
juntar tudo
E a regra dos prompts também é a mesma: cada um aparece na língua da ferramenta, pronto pra copiar, e embaixo em português, linha por linha igual. No Flow você cola a versão em inglês. No Dola você cola a versão em chinês, que já vem pronta.
Enquadramento é o quanto a câmera mostra e de onde ela olha. Pense numa novela: quando alguém chora, a câmera chega bem perto do rosto. Quando a cena muda de lugar, ela mostra a casa inteira por fora. Cada escolha dessas conta uma parte da história.
Num vídeo curto, trocar o enquadramento a cada poucos segundos é o que prende quem está assistindo. O seu vídeo de 30 segundos tinha 3 cenas. No fim deste guia, ele vai ter 6 tomadas, cada uma com um enquadramento diferente, e continua com 30 segundos.
Passo 1. Antes de mudar o enquadramento, faça as folhas de referência
A IA só desenha com fidelidade o que ela já viu. Se ela conhece a personagem só de frente e você pede uma imagem de costas, ela inventa: o cabelo muda, a roupa ganha outro detalhe. Agora, se ela tem uma folha com a personagem de frente, de lado e de costas, ela copia o que está ali.
Isso vale pra tudo que aparece no vídeo. Se o seu vídeo é de uma moto, você precisa da moto vista de vários lados. Se é de uma casa, precisa da frente, da lateral e dos fundos. Se é um quarto, precisa das paredes que a câmera vai mostrar.
Por isso, antes de trabalhar os enquadramentos, você monta as folhas. Todas são feitas no Flow, com o Nano Banana 2, do mesmo jeito da folha do primeiro guia: formato 16:9, anexa a imagem pelo botão de +, cola o prompt em inglês e baixa em 2K.
As folhas servem só de referência. Nenhuma delas vai direto pro vídeo, então não precisa aumentar nem recortar nada. A imagem que vira vídeo é gerada no Passo 3, já no tamanho certo, usando a folha como guia. Se um dia você quiser usar uma das vistas da folha como cena, anexe a folha, deixe o formato em 9:16 e peça: "mostre só a vista de perfil, grande, na vertical". A IA refaz aquela vista inteira, no tamanho certo.
1a. A personagem inteira
Se você fez o primeiro guia, essa você já tem: é a imagem personagem, com frente, perfil e costas. Se ainda não fez, volte ao Passo 2 do primeiro guia.
1b. O rosto de perto
Serve pros closes, que mostram o rosto grande na tela. Anexe a imagem personagem.
Em inglês:
Use image 1 as the character reference. Keep the face, hair, skin tone and art style exactly the same.
Make a face reference sheet on a plain white background with four close-ups of this character side by side: front, three-quarter view, side profile and looking back over the shoulder.
Neutral expression, the same lighting in all four.
No text, no watermark.
Em português:
Use a imagem 1 como referência da personagem. Mantenha o rosto, o cabelo, o tom de pele e o estilo artístico exatamente iguais.
Faça uma folha de referência do rosto em um fundo branco liso, com quatro closes dessa personagem lado a lado: de frente, de três quartos, de perfil e olhando para trás por cima do ombro.
Expressão neutra, a mesma luz nos quatro.
Sem texto, sem marca-d'água.
Guarde com o nome rosto.
1c. Um objeto importante
Serve pra qualquer coisa que aparece de vários lados: uma moto, um carro, um produto, um bolo. Na história da menina, pode ser o celular. Anexe uma foto ou imagem do objeto.
Em inglês:
Use image 1 as the reference for the object. Keep its shape, colors, materials and details exactly the same.
Make an object reference sheet on a plain white background, showing this same object from four angles side by side: front, side, back and from above.
Same size and the same lighting in all views.
Style: the same art style as image 1.
No text, no watermark.
Em português:
Use a imagem 1 como referência do objeto. Mantenha o formato, as cores, os materiais e os detalhes exatamente iguais.
Faça uma folha de referência do objeto em um fundo branco liso, mostrando esse mesmo objeto em quatro ângulos lado a lado: frente, lateral, traseira e de cima.
Mesmo tamanho e a mesma luz em todas as vistas.
Estilo: o mesmo estilo artístico da imagem 1.
Sem texto, sem marca-d'água.
Guarde com o nome do objeto, por exemplo celular ou moto.
1d. O lugar
Serve quando a câmera vai virar pra outro lado do ambiente. Na história da menina, vale fazer do quarto, que aparece em duas cenas. Anexe a imagem da cena que mostra o lugar, por exemplo cena2.
Em inglês:
Use image 1 as the reference for the place. Keep every object, color, the lighting and the art style exactly the same.
Show this same place from four camera angles in a 2x2 grid: wide front view, view from the left corner, view from the right corner and view from above.
No people, no text, no watermark.
Em português:
Use a imagem 1 como referência do lugar. Mantenha todos os objetos, as cores, a luz e o estilo artístico exatamente iguais.
Mostre esse mesmo lugar em quatro ângulos de câmera numa grade 2x2: de frente e aberto, do canto esquerdo, do canto direito e de cima.
Sem pessoas, sem texto, sem marca-d'água.
Guarde com o nome lugar. Se o lugar for uma casa vista de fora, troque os ângulos da segunda linha por "front, side, back and aerial view" no inglês e "frente, lateral, fundos e vista aérea" no português.
Agora você pega uma cena que já existe e pede o mesmo momento visto de outro jeito.
No Flow, confira se está no Nano Banana 2 e com o formato 9:16, em pé.
Anexe duas imagens, nesta ordem: a cena (por exemplo cena1) e a folha que combina com o plano. Pra close e close extremo, a folha rosto. Pros outros planos, a folha personagem.
Cole o prompt em inglês, troque o colchete pelo nome do plano em inglês da tabela e envie.
Baixe em 2K e guarde com o nome da tomada, por exemplo tomada1.
Em inglês:
Image 1 is the scene. Image 2 is the character reference sheet.
Show the exact same moment from image 1, with the same character, clothes, place, lighting and art style.
New framing: [nome do plano em inglês].
Use image 2 to keep the character faithful from this new angle.
Vertical 9:16. Keep the main subject in the upper part of the image and leave the bottom 20% clean. No text.
Em português:
A imagem 1 é a cena. A imagem 2 é a folha de referência da personagem.
Mostre exatamente o mesmo momento da imagem 1, com a mesma personagem, as mesmas roupas, o mesmo lugar, a mesma luz e o mesmo estilo artístico.
Novo enquadramento: [nome do plano em português].
Use a imagem 2 para manter a personagem fiel neste novo ângulo.
Vertical 9:16. Mantenha o assunto principal na parte de cima da imagem e deixe os 20% de baixo livres. Sem texto.
Quando o novo plano mostra um lado do lugar ou do objeto que não aparece na cena, anexe também a folha lugar ou a folha do objeto como terceira imagem e acrescente esta linha no fim do prompt:
Em inglês: Image 3 is the reference sheet of the place or object. Use it to keep it faithful from this new angle.
Em português: A imagem 3 é a folha de referência do lugar ou do objeto. Use-a para manter tudo fiel neste novo ângulo.
Peça um plano por vez. Se a imagem sair com cara de inventada, quase sempre é porque falta a folha certa. Anexe a folha e peça de novo.
As 3 cenas de 10 segundos viram 6 tomadas de 5 segundos, cada uma com um plano diferente. No Dola, o vídeo de 5 segundos gasta 1 ponto, então as 6 tomadas cabem nos 6 pontos do dia e o vídeo continua com 30 segundos.
Em 5 segundos só cabe uma frase curta. Por isso as falas vão nos closes e nos planos em que o rosto aparece, e os planos de detalhe entram sem fala. A fala da cena 3 ficou mais enxuta pra caber.
Tomada
Parte de
Plano
O que aparece
Fala
Movimento
1
cena1
Plano geral
a lanchonete vista da rua, à noite, com ela atrás do balcão
sem fala
aproximação cinematográfica
2
cena1
Close
ela no balcão, cansada mas tranquila
"Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
câmera parada
3
cena2
Detalhe
as moedas e o boleto na mão dela
sem fala
movimento lateral
4
cena2
Perfil
ela sentada na cama, olhando o boleto
"O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
câmera na mão
5
cena3
Por cima do ombro
a tela do celular acesa, com a notícia
sem fala
aproximação cinematográfica
6
cena3
De baixo pra cima
ela comemorando, com o celular na mão
"Peraí... a faculdade vai ser de graça? Eu vou estudar!"
afastamento desfocado
Gere cada tomada no Passo 3, a partir da cena indicada na coluna "Parte de".
O enquadramento diz de onde a câmera olha, e o movimento diz o que ela faz durante a tomada. Cada tomada do Passo 4 tem o seu movimento, e os prompts logo abaixo vêm com ele escrito em chinês. Se quiser trocar, copie a linha em chinês desta tabela e cole no prompt, no lugar da que está depois de 镜头:, que quer dizer câmera.
Movimento
Linha em chinês
Linha em português
Quando usar
Câmera parada
固定镜头
câmera parada
fala e momentos de calma
Aproximação cinematográfica
电影感的缓慢推镜,靠近主体
a câmera se aproxima devagar do assunto
dar peso a um momento
Afastamento desfocado
镜头缓慢后拉,背景逐渐虚化
a câmera se afasta devagar enquanto o fundo desfoca
final e clima de sonho
Movimento lateral
从左到右平稳横移跟拍
a câmera desliza de lado, da esquerda pra direita
passear por um objeto ou cenário
Afastamento acompanhando
镜头向后移动,跟随向前走的角色
a câmera anda pra trás acompanhando a personagem que caminha pra frente
personagem vindo na direção da câmera
Acompanhamento fixo
锁定跟拍,镜头与角色始终保持相同距离
a câmera segue a personagem sempre na mesma distância
corrida, dança, ação contínua
Câmera na mão
手持镜头,带轻微自然的晃动
câmera na mão, com um tremido leve e natural
cara de bastidor, vídeo de celular
Os prompts das 6 tomadas estão logo abaixo, em chinês, com a fala em português entre aspas. No Dola, anexe a imagem da tomada, escolha 5 segundos, cole o prompt em chinês e gere. Baixe e guarde com o nome video1 até video6.
Use a imagem enviada como primeiro quadro.
Ação: à noite, vista da rua, a personagem guarda os últimos copos atrás do balcão.
Câmera: a câmera se aproxima devagar do assunto.
Som: música dramática suave de novela, barulho de rua à noite.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Tomada 2
Em chinês:
使用上传的图片作为首帧。
动作:角色双臂撑在柜台上,深吸一口气,疲惫但平静地自言自语。
镜头:固定镜头。
台词(巴西葡萄牙语,年轻女声):"Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
声音:轻柔的肥皂剧风格戏剧配乐。
时长:5秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
Ação: a personagem apoia os braços no balcão, respira fundo e fala sozinha, cansada mas tranquila.
Câmera: câmera parada.
Fala em português do Brasil, voz feminina jovem: "Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
Som: música dramática suave de novela.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Use a imagem enviada como primeiro quadro.
Ação: a mão da personagem separa as moedas, uma por uma, em cima do boleto.
Câmera: a câmera desliza de lado, da esquerda pra direita.
Som: moedas batendo, um relógio fazendo tique-taque, música triste suave.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Tomada 4
Em chinês:
使用上传的图片作为首帧。
动作:角色坐在床上看着账单,摇摇头,用悲伤的声音自言自语。
镜头:手持镜头,带轻微自然的晃动。
台词(巴西葡萄牙语,年轻女声):"O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
声音:安静的房间,轻柔的悲伤音乐。
时长:5秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
Ação: sentada na cama, a personagem olha o boleto, balança a cabeça e fala sozinha com uma voz triste.
Câmera: câmera na mão, com um tremido leve e natural.
Fala em português do Brasil, voz feminina jovem: "O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
Som: quarto silencioso, música triste suave.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Use a imagem enviada como primeiro quadro.
Ação: por cima do ombro da personagem, a tela do celular acende com a notícia.
Câmera: a câmera se aproxima devagar do assunto.
Som: a música triste vai parando e fica só um silêncio de expectativa.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Tomada 6
Em chinês:
使用上传的图片作为首帧。
动作:角色拿着手机庆祝,非常开心地自言自语。
镜头:镜头缓慢后拉,背景逐渐虚化。
台词(巴西葡萄牙语,年轻女声):"Peraí... a faculdade vai ser de graça? Eu vou estudar!"
声音:欢快又感人的肥皂剧主题曲。
时长:5秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
Ação: com o celular na mão, a personagem comemora e fala sozinha, muito feliz.
Câmera: a câmera se afasta devagar enquanto o fundo desfoca.
Fala em português do Brasil, voz feminina jovem: "Peraí... a faculdade vai ser de graça? Eu vou estudar!"
Som: um tema de novela alegre e emocionante.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
No CapCut, do mesmo jeito do primeiro guia: projeto 9:16, os 6 vídeos na ordem, corte os pedaços parados, gere a legenda automática só pra ver o texto e o tempo de cada fala, refaça a legenda com texto normal longe da parte de baixo, apague a legenda automática e o trecho final com a logo do CapCut, se aparecer, e exporte em 1080 x 1920.
Compare com o vídeo de 3 cenas que você fez antes. A história é a mesma, mas agora ela respira: abre de longe, chega perto na hora da fala, mostra o boleto, olha pela tela do celular e fecha com a comemoração vista de baixo.