Neste guia você vai fazer um vídeo vertical de 30 segundos, com uma personagem que fala em português, no estilo que você escolher. Você não precisa saber nada de IA e não vai pagar nada. Precisa de um celular ou computador, de uma conta do Google (a mesma do Gmail) e de uma tarde livre.
Todo mundo que segue este guia faz o mesmo vídeo, e isso é de propósito. Fazendo um vídeo guiado do começo ao fim, você aprende o caminho inteiro sem precisar inventar nada. No final do guia, você aprende a criar as suas próprias histórias, pra fazer o vídeo que quiser.
Uma menina de 19 anos mora na periferia e trabalha o dia inteiro. O dinheiro mal dá pro mês, e a faculdade vai ficando pra depois porque não sobra nada pra pagar a mensalidade. Só que agora a faculdade vai ser de graça, e com 19 anos essa menina finalmente pode começar a estudar.
São 3 cenas de 10 segundos. Em cada uma ela fala sozinha, no clima daquelas novelas de frutas falantes.
Cena
Onde
O que ela fala
1
no trabalho, atrás do balcão
"Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
2
no quarto, contando o dinheiro
"O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
3
no quarto, olhando o celular
"Peraí... a faculdade vai ser de graça? Com dezenove anos, eu vou começar a estudar!"
Essas falas são uma sugestão. Se quiser, escreva com as suas palavras, do jeito que você fala. Só mantenha a história e a ordem, porque é isso que faz o vídeo dar certo no final: na cena 1 ela está cansada depois de um dia inteiro de trabalho, na cena 2 percebe que o dinheiro não dá pra faculdade e na cena 3 descobre que a faculdade vai ser de graça e comemora. Cada fala precisa ser curta, com uma ou duas frases, pra caber nos 10 segundos. E se você mudar uma fala, troque também dentro do prompt do vídeo daquela cena, no trecho entre aspas.
criar a personagem e as cenas com o Nano Banana, o gerador de imagem do Google
imagem ilimitada, baixa em 2K sem gastar crédito e sai sem marca d'água
Gemini ou ChatGPT
mudar os prompts, se você quiser, e criar as suas próprias histórias no final
grátis
Dola
transformar as imagens em vídeo com fala
6 pontos por dia, cada vídeo de 10 segundos gasta 2, e o vídeo sai sem marca d'água
CapCut
juntar os vídeos e colocar legenda
grátis
O aplicativo do Gemini também gera imagem com o Nano Banana, só que coloca uma marquinha no canto. Por isso as imagens daqui são feitas no Flow, o app do Google onde fica o Veo 3. Ele usa o mesmo gerador e entrega a imagem limpa. Lá dentro aparecem 50 créditos por dia, mas eles só são gastos quando você faz vídeo com o Veo 3. Pra gerar imagem e baixar em 2K você não gasta nada, então pode refazer quantas vezes quiser.
Os 6 pontos do Dola dão exatamente as 3 cenas. Se alguma sair errada, você refaz no dia seguinte, quando os pontos voltam. Esses limites são aproximados e podem mudar.
A ferramenta é a parte técnica, e você vai aprender a mexer nela hoje mesmo. O que faz alguém assistir um vídeo até o fim vem antes dela: o objetivo, o sentimento, as referências e os elementos que você tem. Pro vídeo deste guia, as respostas já estão prontas:
Objetivo: mostrar a virada na vida da menina.
Sentimento: aperto no começo, alívio e alegria no final.
Referências: vídeos de frutas falantes em clima de novela e uma imagem do estilo que você vai escolher no Passo 1. Procure "novela das frutas" no TikTok e assista dois ou três, só pra sentir o clima.
Elementos: uma personagem, dois lugares (a lanchonete e o quarto) e um celular.
Quando você for criar a sua própria história, vai responder perguntas parecidas, no final do guia.
Prompt é o pedido que você escreve pra IA. Neste guia, cada prompt aparece duas vezes: primeiro na língua que a ferramenta entende melhor, pronto pra copiar, e embaixo em português, linha por linha igual, pra você saber exatamente o que está pedindo.
No Flow, o prompt vem em inglês. É só copiar e colar.
No Dola, o prompt vem em chinês, porque o Seedance 2.0, que faz os vídeos, é uma ferramenta chinesa e entende melhor pedido em chinês. Também é só copiar e colar, sem traduzir nada.
Se quiser mudar alguma coisa, como a cor do uniforme, mude na versão em português e peça pra IA traduzir, sempre dizendo em qual ferramenta o prompt vai ser usado.
Style: handmade plush doll made of soft cotton fabric, visible stitches, felt details.
Estilo: boneco artesanal de pelúcia feito de tecido de algodão macio, costuras aparentes, detalhes em feltro.
Sua própria foto
Style: realistic photo.
Estilo: foto realista.
Se você escolheu 3D, 2D, cartum ou algodão
Abra o Pinterest (pinterest.com ou o aplicativo).
Pesquise o termo do seu estilo, que está na primeira tabela.
Escolha uma imagem de personagem que tenha o traço que você quer.
Abra a imagem, toque nos três pontinhos e escolha baixar imagem.
Guarde com o nome referencia.
A referência serve só pra mostrar o estilo. A personagem que você vai criar no Passo 2 é nova, sua, com o traço daquela imagem.
Se você escolheu a sua própria foto
Tire uma foto de frente, com luz de janela no rosto e fundo simples.
Pegue do peito pra cima ou o corpo inteiro, sem óculos escuros e sem nada cobrindo o rosto.
Guarde com o nome minhafoto.
Um aviso importante: o Dola, que faz os vídeos no Passo 4, costuma recusar rosto de pessoa real em foto realista. O caminho mais seguro é usar a sua foto como base e transformar você num dos outros estilos (3D, 2D, cartum ou algodão). Você continua reconhecível, e as chances de o Dola aceitar aumentam. Pra isso, no Passo 2, use a linha do estilo que você quer em vez da linha de foto realista.
Aqui você cria uma folha com a personagem de frente, de lado e de costas. Essa folha é o que garante o mesmo rosto nas 3 cenas.
Entre em flow.google.com com a sua conta do Google e clique em + Novo projeto.
Clique no botão do modelo, no canto da caixa de texto. Confira se está em imagem, com o Nano Banana 2, e escolha o formato 16:9, deitado, pra caber as três vistas lado a lado.
Anexe a sua imagem pelo botão de + ou arrastando pra caixa de texto. Pode ser a referencia do Pinterest ou a minhafoto.
Copie o prompt em inglês do seu caminho, troque a linha entre colchetes pela linha de estilo que você guardou no Passo 1 e envie.
Quando gostar do resultado, clique nos três pontinhos da imagem, escolha baixar em 2K e guarde com o nome personagem.
Caminho A: com a referência do Pinterest
Em inglês:
Use image 1 only as a reference for the art style. Create a new original character, different from the one in image 1.
Character: a 19-year-old Brazilian girl with curly dark hair tied in a bun, big expressive eyes, wearing a simple red fast-food attendant uniform and cap.
Make a character reference sheet on a plain white background, showing her full body from three angles side by side: front, side and back.
Same face, same clothes and same proportions in all views.
[cole aqui a linha de estilo em inglês]
No text, no watermark.
Em português:
Use a imagem 1 só como referência do estilo artístico. Crie uma personagem nova e original, diferente da que está na imagem 1.
Personagem: uma menina brasileira de 19 anos, com cabelo escuro cacheado preso em um coque, olhos grandes e expressivos, usando um uniforme simples vermelho de atendente de lanchonete e boné.
Faça uma folha de referência da personagem em um fundo branco liso, mostrando o corpo inteiro dela em três ângulos lado a lado: frente, perfil e costas.
Mesmo rosto, mesmas roupas e mesmas proporções em todas as vistas.
[cole aqui a linha de estilo em português]
Sem texto, sem marca-d'água.
Caminho B: com a sua foto
Em inglês:
Use image 1 as the reference for the person's face and hair. Keep the face recognizable as the same person.
Turn this person into the character of this video, wearing a simple red fast-food attendant uniform and cap.
Make a character reference sheet on a plain white background, showing the full body from three angles side by side: front, side and back.
Same face, same clothes and same proportions in all views.
[cole aqui a linha de estilo em inglês]
No text, no watermark.
Em português:
Use a imagem 1 como referência do rosto e do cabelo da pessoa. Mantenha o rosto reconhecível como o da mesma pessoa.
Transforme essa pessoa na personagem deste vídeo, usando um uniforme simples vermelho de atendente de lanchonete e boné.
Faça uma folha de referência da personagem em um fundo branco liso, mostrando o corpo inteiro em três ângulos lado a lado: frente, perfil e costas.
Mesmo rosto, mesmas roupas e mesmas proporções em todas as vistas.
[cole aqui a linha de estilo em português]
Sem texto, sem marca-d'água.
Se o resultado não ficar bom, escreva o ajuste no fim do prompt, por exemplo "deixe o cabelo mais volumoso" ou "deixe o rosto mais parecido com a foto", e envie de novo. Na primeira tentativa é normal sair uma mão com seis dedos, e tentar outra vez resolve. Imagem não gasta crédito, então refaça quantas vezes precisar.
Agora você coloca a personagem em cada lugar da história. Os prompts das cenas já pedem o mesmo estilo da sua folha, então servem pra qualquer estilo que você escolheu. Repita isto pra cada cena:
No mesmo projeto do Flow, troque o formato pra 9:16, em pé.
Anexe a imagem personagem.
Cole o prompt em inglês da cena e envie.
Baixe em 2K e guarde com o nome cena1, cena2 ou cena3.
Cena 1
Em inglês:
Use image 1 as the character reference. Keep the face, hair, skin tone and uniform exactly the same.
Vertical 9:16 image.
Scene: the character stands behind the counter of a small fast-food shop at the end of the day, tired but calm, resting both arms on the counter, looking at the camera with a thoughtful expression.
Setting: a simple shop in a neighborhood on the outskirts of a Brazilian city, a cash register and a few cups on the counter, warm light.
Camera: medium shot, eye level.
Style: the same art style as image 1, dramatic soap opera mood.
Keep the character in the center and upper part of the image, leave the bottom 20% clean. No text.
Em português:
Use a imagem 1 como referência da personagem. Mantenha o rosto, o cabelo, o tom de pele e o uniforme exatamente iguais.
Imagem vertical 9:16.
Cena: a personagem está em pé atrás do balcão de uma lanchonete pequena no fim do dia, cansada mas tranquila, com os dois braços apoiados no balcão, olhando para a câmera com uma expressão pensativa.
Cenário: uma lanchonete simples em um bairro da periferia de uma cidade brasileira, uma caixa registradora e alguns copos no balcão, luz quente.
Câmera: plano médio, na altura dos olhos.
Estilo: o mesmo estilo artístico da imagem 1, clima dramático de novela.
Mantenha a personagem no centro e na parte de cima da imagem, deixe os 20% de baixo livres. Sem texto.
Cena 2
Em inglês:
Use image 1 as the character reference. Keep the face, hair and skin tone exactly the same. The character now wears a simple gray t-shirt.
Vertical 9:16 image.
Scene: at night in a small bedroom, the character sits on the bed counting a few coins and bills, holding a college tuition bill in the other hand, with a worried expression.
Setting: a simple bedroom in a house on the outskirts of the city, bare brick wall, a small window, a lamp with warm light.
Camera: medium close-up, slightly from above.
Style: the same art style as image 1, dramatic soap opera mood.
Keep the character in the center and upper part of the image, leave the bottom 20% clean. No text.
Em português:
Use a imagem 1 como referência da personagem. Mantenha o rosto, o cabelo e o tom de pele exatamente iguais. Agora a personagem usa uma camiseta cinza simples.
Imagem vertical 9:16.
Cena: à noite, em um quarto pequeno, a personagem está sentada na cama contando algumas moedas e notas, segurando um boleto da mensalidade da faculdade na outra mão, com uma expressão preocupada.
Cenário: um quarto simples em uma casa da periferia, parede de tijolo aparente, uma janela pequena, um abajur com luz quente.
Câmera: plano médio fechado, um pouco de cima.
Estilo: o mesmo estilo artístico da imagem 1, clima dramático de novela.
Mantenha a personagem no centro e na parte de cima da imagem, deixe os 20% de baixo livres. Sem texto.
Cena 3
Em inglês:
Use image 1 as the character reference. Keep the face, hair and skin tone exactly the same. The character wears a simple gray t-shirt.
Vertical 9:16 image.
Scene: sitting on the bed, the character holds the phone with both hands and looks at the screen with wide eyes and a huge surprised smile, full of joy.
Setting: the same simple bedroom with a bare brick wall, now lit by the morning sun coming through the small window.
Camera: close-up, eye level.
Style: the same art style as image 1, dramatic soap opera mood.
Keep the character in the center and upper part of the image, leave the bottom 20% clean. No text.
Em português:
Use a imagem 1 como referência da personagem. Mantenha o rosto, o cabelo e o tom de pele exatamente iguais. A personagem usa uma camiseta cinza simples.
Imagem vertical 9:16.
Cena: sentada na cama, a personagem segura o celular com as duas mãos e olha para a tela com os olhos arregalados e um sorriso enorme de surpresa, cheia de alegria.
Cenário: o mesmo quarto simples com parede de tijolo aparente, agora iluminado pelo sol da manhã entrando pela janela pequena.
Câmera: close, na altura dos olhos.
Estilo: o mesmo estilo artístico da imagem 1, clima dramático de novela.
Mantenha a personagem no centro e na parte de cima da imagem, deixe os 20% de baixo livres. Sem texto.
Antes de seguir, olhe as 3 imagens com calma. O rosto é o mesmo da folha? O estilo é o mesmo nas três? As mãos estão certas? Se alguma sair estranha, peça outra.
Os prompts dos vídeos já vêm em chinês, porque o Seedance 2.0 é uma ferramenta chinesa e entende melhor pedido em chinês. É só copiar e colar. Embaixo de cada um tem a versão em português, linha por linha igual, pra você saber o que está pedindo. A fala da personagem fica em português mesmo, entre aspas, no meio do chinês, porque é exatamente essa frase que ela vai falar.
Como gerar o vídeo no Dola
Entre em dola.com ou no aplicativo Dola, com a sua conta do Google.
Vá na parte de criar vídeo e escolha o Seedance 2.0.
Anexe a imagem da cena (cena1, cena2 ou cena3) como imagem de referência.
Escolha a duração de 10 segundos.
Copie o prompt em chinês do vídeo, cole e gere.
Baixe o vídeo e guarde com o nome video1, video2 ou video3.
Se você usou a sua foto no Passo 2 e for um menino, a história vale do mesmo jeito. Só troque 年轻女声 por 年轻男声 no prompt em chinês. Esses caracteres ficam logo antes da fala: o primeiro quer dizer voz feminina jovem e o segundo, voz masculina jovem.
Vídeo 1
Em chinês:
使用上传的图片作为首帧。
角色双臂撑在柜台上,深吸一口气,看着镜头,用疲惫但平静的声音自言自语。
台词(巴西葡萄牙语,年轻女声):"Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
镜头:缓慢推近到脸部。
声音:轻柔的肥皂剧风格戏剧配乐,远处的街道噪音。
时长:10秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
A personagem apoia os dois braços no balcão, respira fundo e fala sozinha com uma voz cansada mas tranquila, olhando para a câmera.
Fala em português do Brasil, voz feminina jovem: "Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
Câmera: aproximação lenta em direção ao rosto.
Som: música dramática suave de novela, barulho de rua ao longe.
Duração: 10 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Vídeo 2
Em chinês:
使用上传的图片作为首帧。
角色数着硬币,看了看账单,摇摇头,用悲伤的声音自言自语。
台词(巴西葡萄牙语,年轻女声):"O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
镜头:固定机位,带轻微的手持晃动。
声音:安静的房间,时钟滴答作响,轻柔的悲伤音乐。
时长:10秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
A personagem conta as moedas, olha para o boleto, balança a cabeça e fala sozinha com uma voz triste.
Fala em português do Brasil, voz feminina jovem: "O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
Câmera: parada, com um leve movimento de câmera na mão.
Som: quarto silencioso, um relógio fazendo tique-taque, música triste suave.
Duração: 10 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Vídeo 3
Em chinês:
使用上传的图片作为首帧。
角色看着手机,睁大眼睛,露出大大的笑容,自言自语,先是不敢相信,然后非常开心。
台词(巴西葡萄牙语,年轻女声):"Peraí... a faculdade vai ser de graça? Com dezenove anos, eu vou começar a estudar!"
镜头:缓慢推近,直到脸部特写。
声音:悲伤的音乐转变为欢快又感人的肥皂剧主题曲。
时长:10秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
A personagem lê o celular, arregala os olhos, abre um sorriso grande e fala sozinha, primeiro sem acreditar e depois muito feliz.
Fala em português do Brasil, voz feminina jovem: "Peraí... a faculdade vai ser de graça? Com dezenove anos, eu vou começar a estudar!"
Câmera: aproximação lenta até um close do rosto.
Som: a música triste vira um tema de novela alegre e emocionante.
Duração: 10 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Se os pontos acabarem no meio, os vídeos que faltam ficam pro dia seguinte.
Um aviso antes de começar: no CapCut grátis, dá pra gerar a legenda automática e ver ela na tela, mas ela não vai pro vídeo final e também não dá pra baixar, porque é um recurso pago. Então a automática entra só pra você pegar o texto e o tempo de cada frase, e depois você refaz a legenda com texto normal, que é grátis. Dá um pouquinho de trabalho, mas são só 3 falas curtas.
Abra o CapCut e crie um projeto novo.
Coloque video1, video2 e video3, nessa ordem.
Assista uma vez. Se algum vídeo tiver um pedaço parado no começo ou no fim, corte.
Toque em Legendas e escolha as legendas automáticas. Elas aparecem numa faixa própria na linha do tempo, cada frase num bloquinho.
Pra cada bloquinho, toque em Texto e depois em Adicionar texto. Escreva a mesma frase que aparece nele. Depois arraste e estique o texto novo na linha do tempo até ele começar e terminar junto com o bloquinho.
Deixe os textos no meio da tela, longe da parte de baixo, porque é ali que o aplicativo coloca os botões.
Quando todas as frases estiverem em texto normal, apague os bloquinhos da legenda automática.
Se aparecer no final um trecho com a logo do CapCut, apague esse trecho.
Exporte em 1080 x 1920.
Se na hora de exportar o CapCut pedir assinatura, quase sempre é porque sobrou algum bloquinho da legenda automática. Apague e exporte de novo.
Pronto. Você tem um vídeo de 30 segundos feito com IA, do começo ao fim, sem pagar nada e sem marca d'água.
Você acabou de aprender a parte técnica: criar a personagem, fazer as cenas, transformar em vídeo e juntar tudo. Falta a parte que deixa o vídeo com a sua cara, que é a história. E pra ela você também pode usar uma IA de graça.
1. Escreva a sua história em poucas linhas
Pense numa história com começo, virada e final, do jeito que a da menina foi contada no começo deste guia. Pra funcionar, basta que ela seja clara. Se travar, responda estas perguntas:
Qual é o objetivo do vídeo? Vender, fazer rir, emocionar, contar algo que aconteceu.
Qual sentimento quem assiste tem que sentir no final? Alegria, alívio, saudade, curiosidade.
Quem é a personagem? Idade, jeito e o que ela faz da vida.
Qual é o problema dela no começo?
O que muda?
Como ela termina?
Pra achar o clima, use referências. O Pinterest ajuda a ver estilo e cenário, e o TikTok e o Instagram mostram vídeos que passam o sentimento que você quer.
2. Peça pra IA transformar a história em roteiro
Abra o ChatGPT, o Gemini ou o Claude, na versão grátis.
Copie o pedido abaixo, troque o que está entre colchetes pela sua história e envie.
Quero fazer um vídeo vertical de 30 segundos com IA, com uma personagem só, que fala sozinha, em clima de novela.
Minha história é esta: [escreva aqui a sua história em 3 ou 4 frases]
Organize essa história em um roteiro de 3 cenas de 10 segundos.
Para cada cena, escreva:
- Onde: o lugar da cena.
- O que acontece: o que a personagem faz e qual é a expressão dela.
- Fala: o que ela diz, com no máximo 15 palavras, em português do Brasil.
No final, descreva a personagem em uma linha: idade, cabelo, roupa e um detalhe que ajude a reconhecer.
Escreva de forma simples, sem acrescentar cenas nem personagens.
Leia o roteiro que ele devolver. Se alguma fala ficar comprida ou estranha, peça o ajuste no mesmo chat, por exemplo "deixe a fala da cena 2 mais curta" ou "deixe a fala da cena 3 mais animada".
3. Coloque o roteiro nos prompts do guia
Agora é trocar a história da menina pela sua, sempre na versão em português dos prompts:
O que veio no roteiro
Onde entra no guia
a descrição da personagem
na linha "Personagem" do prompt do Passo 2
"Onde" e "O que acontece" de cada cena
nas linhas "Cena" e "Cenário" dos prompts do Passo 3
a fala de cada cena
entre as aspas dos prompts de vídeo do Passo 4
Depois de trocar, leia cada prompt inteiro e ajuste o que ainda for da história da menina, como o uniforme ou o boleto. Aí peça pra IA traduzir: pro inglês se o prompt for usado no Flow, pro chinês se for usado no Dola, sempre dizendo em qual ferramenta ele vai ser usado.
4. Faça o vídeo
Siga os Passos 1 a 5 do guia com a sua história. O Dola faz 3 cenas por dia, então um vídeo de 30 segundos sai num dia. Quando pegar o jeito, dá pra crescer: 6 cenas fazem 1 minuto e 9 cenas fazem 1min30. É só pedir pra IA organizar a história em 6 ou 9 cenas no lugar de 3.
Foto de outra pessoa só entra com a autorização dela.
Checklist na IA
Estilo escolhido e referência (ou foto) guardada
Folha da personagem pronta, com frente, perfil e costas
Uma imagem por cena, com o rosto e o estilo iguais aos da folha
Imagens com nome em ordem (cena1, cena2, cena3...)
Prompts dos vídeos colados em chinês, com a fala em português entre aspas
Vídeos gerados dentro dos pontos do dia
Tudo guardado numa pasta só
Checklist final
A primeira cena já mostra o problema, sem apresentação
O rosto e o estilo do personagem são os mesmos em todas as cenas
Vídeo vertical, exportado em 1080 x 1920
Nenhuma marca d'água, nem a do final do CapCut
Nada importante na parte de baixo da tela
A fala está clara e a legenda confere com ela
Legenda refeita com texto normal e a legenda automática apagada
O final mostra a virada da história
Você assistiu no celular antes de postar
Os prompts ficaram salvos numa pasta pra usar de novo
Este guia continua o "Seu primeiro vídeo com IA, de graça". Lá você fez a personagem, as 3 cenas e o vídeo de 30 segundos da menina que finalmente pode estudar. Aqui você vai aprender a mostrar essa mesma história de vários jeitos: de perto, de longe, de cima, por cima do ombro. É isso que dá cara de cinema a um vídeo, e continua tudo de graça e sem marca d'água.
criar as folhas de referência e as imagens nos novos enquadramentos, sem gastar crédito
Dola
transformar as imagens em vídeo
CapCut
juntar tudo
E a regra dos prompts também é a mesma: cada um aparece na língua da ferramenta, pronto pra copiar, e embaixo em português, linha por linha igual. No Flow você cola a versão em inglês. No Dola você cola a versão em chinês, que já vem pronta.
Enquadramento é o quanto a câmera mostra e de onde ela olha. Pense numa novela: quando alguém chora, a câmera chega bem perto do rosto. Quando a cena muda de lugar, ela mostra a casa inteira por fora. Cada escolha dessas conta uma parte da história.
Num vídeo curto, trocar o enquadramento a cada poucos segundos é o que prende quem está assistindo. O seu vídeo de 30 segundos tinha 3 cenas. No fim deste guia, ele vai ter 6 tomadas, cada uma com um enquadramento diferente, e continua com 30 segundos.
Passo 1. Antes de mudar o enquadramento, faça as folhas de referência
A IA só desenha com fidelidade o que ela já viu. Se ela conhece a personagem só de frente e você pede uma imagem de costas, ela inventa: o cabelo muda, a roupa ganha outro detalhe. Agora, se ela tem uma folha com a personagem de frente, de lado e de costas, ela copia o que está ali.
Isso vale pra tudo que aparece no vídeo. Se o seu vídeo é de uma moto, você precisa da moto vista de vários lados. Se é de uma casa, precisa da frente, da lateral e dos fundos. Se é um quarto, precisa das paredes que a câmera vai mostrar.
Por isso, antes de trabalhar os enquadramentos, você monta as folhas. Todas são feitas no Flow, com o Nano Banana 2, do mesmo jeito da folha do primeiro guia: formato 16:9, anexa a imagem pelo botão de +, cola o prompt em inglês e baixa em 2K.
As folhas servem só de referência. Nenhuma delas vai direto pro vídeo, então não precisa aumentar nem recortar nada. A imagem que vira vídeo é gerada no Passo 3, já no tamanho certo, usando a folha como guia. Se um dia você quiser usar uma das vistas da folha como cena, anexe a folha, deixe o formato em 9:16 e peça: "mostre só a vista de perfil, grande, na vertical". A IA refaz aquela vista inteira, no tamanho certo.
1a. A personagem inteira
Se você fez o primeiro guia, essa você já tem: é a imagem personagem, com frente, perfil e costas. Se ainda não fez, volte ao Passo 2 do primeiro guia.
1b. O rosto de perto
Serve pros closes, que mostram o rosto grande na tela. Anexe a imagem personagem.
Em inglês:
Use image 1 as the character reference. Keep the face, hair, skin tone and art style exactly the same.
Make a face reference sheet on a plain white background with four close-ups of this character side by side: front, three-quarter view, side profile and looking back over the shoulder.
Neutral expression, the same lighting in all four.
No text, no watermark.
Em português:
Use a imagem 1 como referência da personagem. Mantenha o rosto, o cabelo, o tom de pele e o estilo artístico exatamente iguais.
Faça uma folha de referência do rosto em um fundo branco liso, com quatro closes dessa personagem lado a lado: de frente, de três quartos, de perfil e olhando para trás por cima do ombro.
Expressão neutra, a mesma luz nos quatro.
Sem texto, sem marca-d'água.
Guarde com o nome rosto.
1c. Um objeto importante
Serve pra qualquer coisa que aparece de vários lados: uma moto, um carro, um produto, um bolo. Na história da menina, pode ser o celular. Anexe uma foto ou imagem do objeto.
Em inglês:
Use image 1 as the reference for the object. Keep its shape, colors, materials and details exactly the same.
Make an object reference sheet on a plain white background, showing this same object from four angles side by side: front, side, back and from above.
Same size and the same lighting in all views.
Style: the same art style as image 1.
No text, no watermark.
Em português:
Use a imagem 1 como referência do objeto. Mantenha o formato, as cores, os materiais e os detalhes exatamente iguais.
Faça uma folha de referência do objeto em um fundo branco liso, mostrando esse mesmo objeto em quatro ângulos lado a lado: frente, lateral, traseira e de cima.
Mesmo tamanho e a mesma luz em todas as vistas.
Estilo: o mesmo estilo artístico da imagem 1.
Sem texto, sem marca-d'água.
Guarde com o nome do objeto, por exemplo celular ou moto.
1d. O lugar
Serve quando a câmera vai virar pra outro lado do ambiente. Na história da menina, vale fazer do quarto, que aparece em duas cenas. Anexe a imagem da cena que mostra o lugar, por exemplo cena2.
Em inglês:
Use image 1 as the reference for the place. Keep every object, color, the lighting and the art style exactly the same.
Show this same place from four camera angles in a 2x2 grid: wide front view, view from the left corner, view from the right corner and view from above.
No people, no text, no watermark.
Em português:
Use a imagem 1 como referência do lugar. Mantenha todos os objetos, as cores, a luz e o estilo artístico exatamente iguais.
Mostre esse mesmo lugar em quatro ângulos de câmera numa grade 2x2: de frente e aberto, do canto esquerdo, do canto direito e de cima.
Sem pessoas, sem texto, sem marca-d'água.
Guarde com o nome lugar. Se o lugar for uma casa vista de fora, troque os ângulos da segunda linha por "front, side, back and aerial view" no inglês e "frente, lateral, fundos e vista aérea" no português.
Agora você pega uma cena que já existe e pede o mesmo momento visto de outro jeito.
No Flow, confira se está no Nano Banana 2 e com o formato 9:16, em pé.
Anexe duas imagens, nesta ordem: a cena (por exemplo cena1) e a folha que combina com o plano. Pra close e close extremo, a folha rosto. Pros outros planos, a folha personagem.
Cole o prompt em inglês, troque o colchete pelo nome do plano em inglês da tabela e envie.
Baixe em 2K e guarde com o nome da tomada, por exemplo tomada1.
Em inglês:
Image 1 is the scene. Image 2 is the character reference sheet.
Show the exact same moment from image 1, with the same character, clothes, place, lighting and art style.
New framing: [nome do plano em inglês].
Use image 2 to keep the character faithful from this new angle.
Vertical 9:16. Keep the main subject in the upper part of the image and leave the bottom 20% clean. No text.
Em português:
A imagem 1 é a cena. A imagem 2 é a folha de referência da personagem.
Mostre exatamente o mesmo momento da imagem 1, com a mesma personagem, as mesmas roupas, o mesmo lugar, a mesma luz e o mesmo estilo artístico.
Novo enquadramento: [nome do plano em português].
Use a imagem 2 para manter a personagem fiel neste novo ângulo.
Vertical 9:16. Mantenha o assunto principal na parte de cima da imagem e deixe os 20% de baixo livres. Sem texto.
Quando o novo plano mostra um lado do lugar ou do objeto que não aparece na cena, anexe também a folha lugar ou a folha do objeto como terceira imagem e acrescente esta linha no fim do prompt:
Em inglês: Image 3 is the reference sheet of the place or object. Use it to keep it faithful from this new angle.
Em português: A imagem 3 é a folha de referência do lugar ou do objeto. Use-a para manter tudo fiel neste novo ângulo.
Peça um plano por vez. Se a imagem sair com cara de inventada, quase sempre é porque falta a folha certa. Anexe a folha e peça de novo.
As 3 cenas de 10 segundos viram 6 tomadas de 5 segundos, cada uma com um plano diferente. No Dola, o vídeo de 5 segundos gasta 1 ponto, então as 6 tomadas cabem nos 6 pontos do dia e o vídeo continua com 30 segundos.
Em 5 segundos só cabe uma frase curta. Por isso as falas vão nos closes e nos planos em que o rosto aparece, e os planos de detalhe entram sem fala. A fala da cena 3 ficou mais enxuta pra caber.
Tomada
Parte de
Plano
O que aparece
Fala
Movimento
1
cena1
Plano geral
a lanchonete vista da rua, à noite, com ela atrás do balcão
sem fala
aproximação cinematográfica
2
cena1
Close
ela no balcão, cansada mas tranquila
"Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
câmera parada
3
cena2
Detalhe
as moedas e o boleto na mão dela
sem fala
movimento lateral
4
cena2
Perfil
ela sentada na cama, olhando o boleto
"O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
câmera na mão
5
cena3
Por cima do ombro
a tela do celular acesa, com a notícia
sem fala
aproximação cinematográfica
6
cena3
De baixo pra cima
ela comemorando, com o celular na mão
"Peraí... a faculdade vai ser de graça? Eu vou estudar!"
afastamento desfocado
Gere cada tomada no Passo 3, a partir da cena indicada na coluna "Parte de".
O enquadramento diz de onde a câmera olha, e o movimento diz o que ela faz durante a tomada. Cada tomada do Passo 4 tem o seu movimento, e os prompts logo abaixo vêm com ele escrito em chinês. Se quiser trocar, copie a linha em chinês desta tabela e cole no prompt, no lugar da que está depois de 镜头:, que quer dizer câmera.
Movimento
Linha em chinês
Linha em português
Quando usar
Câmera parada
固定镜头
câmera parada
fala e momentos de calma
Aproximação cinematográfica
电影感的缓慢推镜,靠近主体
a câmera se aproxima devagar do assunto
dar peso a um momento
Afastamento desfocado
镜头缓慢后拉,背景逐渐虚化
a câmera se afasta devagar enquanto o fundo desfoca
final e clima de sonho
Movimento lateral
从左到右平稳横移跟拍
a câmera desliza de lado, da esquerda pra direita
passear por um objeto ou cenário
Afastamento acompanhando
镜头向后移动,跟随向前走的角色
a câmera anda pra trás acompanhando a personagem que caminha pra frente
personagem vindo na direção da câmera
Acompanhamento fixo
锁定跟拍,镜头与角色始终保持相同距离
a câmera segue a personagem sempre na mesma distância
corrida, dança, ação contínua
Câmera na mão
手持镜头,带轻微自然的晃动
câmera na mão, com um tremido leve e natural
cara de bastidor, vídeo de celular
Os prompts das 6 tomadas estão logo abaixo, em chinês, com a fala em português entre aspas. No Dola, anexe a imagem da tomada, escolha 5 segundos, cole o prompt em chinês e gere. Baixe e guarde com o nome video1 até video6.
Use a imagem enviada como primeiro quadro.
Ação: à noite, vista da rua, a personagem guarda os últimos copos atrás do balcão.
Câmera: a câmera se aproxima devagar do assunto.
Som: música dramática suave de novela, barulho de rua à noite.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Tomada 2
Em chinês:
使用上传的图片作为首帧。
动作:角色双臂撑在柜台上,深吸一口气,疲惫但平静地自言自语。
镜头:固定镜头。
台词(巴西葡萄牙语,年轻女声):"Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
声音:轻柔的肥皂剧风格戏剧配乐。
时长:5秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
Ação: a personagem apoia os braços no balcão, respira fundo e fala sozinha, cansada mas tranquila.
Câmera: câmera parada.
Fala em português do Brasil, voz feminina jovem: "Mais um dia inteiro trabalhando. E a faculdade, fica pra quando?"
Som: música dramática suave de novela.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Use a imagem enviada como primeiro quadro.
Ação: a mão da personagem separa as moedas, uma por uma, em cima do boleto.
Câmera: a câmera desliza de lado, da esquerda pra direita.
Som: moedas batendo, um relógio fazendo tique-taque, música triste suave.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Tomada 4
Em chinês:
使用上传的图片作为首帧。
动作:角色坐在床上看着账单,摇摇头,用悲伤的声音自言自语。
镜头:手持镜头,带轻微自然的晃动。
台词(巴西葡萄牙语,年轻女声):"O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
声音:安静的房间,轻柔的悲伤音乐。
时长:5秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
Ação: sentada na cama, a personagem olha o boleto, balança a cabeça e fala sozinha com uma voz triste.
Câmera: câmera na mão, com um tremido leve e natural.
Fala em português do Brasil, voz feminina jovem: "O dinheiro mal dá pro mês. Faculdade, de novo, fica pra depois."
Som: quarto silencioso, música triste suave.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Use a imagem enviada como primeiro quadro.
Ação: por cima do ombro da personagem, a tela do celular acende com a notícia.
Câmera: a câmera se aproxima devagar do assunto.
Som: a música triste vai parando e fica só um silêncio de expectativa.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
Tomada 6
Em chinês:
使用上传的图片作为首帧。
动作:角色拿着手机庆祝,非常开心地自言自语。
镜头:镜头缓慢后拉,背景逐渐虚化。
台词(巴西葡萄牙语,年轻女声):"Peraí... a faculdade vai ser de graça? Eu vou estudar!"
声音:欢快又感人的肥皂剧主题曲。
时长:5秒,竖屏9:16。保持脸部、服装和画风与图片完全一致。
Em português:
Use a imagem enviada como primeiro quadro.
Ação: com o celular na mão, a personagem comemora e fala sozinha, muito feliz.
Câmera: a câmera se afasta devagar enquanto o fundo desfoca.
Fala em português do Brasil, voz feminina jovem: "Peraí... a faculdade vai ser de graça? Eu vou estudar!"
Som: um tema de novela alegre e emocionante.
Duração: 5 segundos, vertical 9:16. Mantenha o rosto, as roupas e o estilo artístico exatamente como na imagem.
No CapCut, do mesmo jeito do primeiro guia: projeto 9:16, os 6 vídeos na ordem, corte os pedaços parados, gere a legenda automática só pra ver o texto e o tempo de cada fala, refaça a legenda com texto normal longe da parte de baixo, apague a legenda automática e o trecho final com a logo do CapCut, se aparecer, e exporte em 1080 x 1920.
Compare com o vídeo de 3 cenas que você fez antes. A história é a mesma, mas agora ela respira: abre de longe, chega perto na hora da fala, mostra o boleto, olha pela tela do celular e fecha com a comemoração vista de baixo.