Como usar frame inicial e final no Google Flow para controlar a continuidade do vídeo

O vídeo começa exatamente como você imaginou. A personagem está certa, o cenário está certo, o enquadramento está certo.

Então passam alguns segundos.

A câmera vai para outro lugar, a personagem termina numa posição que você não queria e o último frame parece pertencer a outra cena.

Uma maneira de reduzir essa liberdade é mostrar ao Google Flow não apenas onde o vídeo deve começar, mas também onde ele precisa terminar.

Com frame inicial e frame final, você entrega duas imagens ao modelo e descreve o que deve acontecer entre elas. A inteligência artificial continua criando o movimento, mas agora existe um ponto A e um ponto B visualmente definidos.

Neste tutorial, vamos entender quando isso realmente ajuda, como configurar os dois frames e como escrever o prompt da transição sem dar instruções que entrem em conflito com as próprias imagens.

Resposta rápida: o que são frame inicial e frame final?

No Google Flow, um frame inicial é uma imagem que define como o vídeo deve começar.

O frame final define uma composição específica que o vídeo deve alcançar ao terminar.

O processo pode ser resumido assim:

imagem A → movimento ou transição → imagem B

Você fornece as duas extremidades e usa o prompt principalmente para explicar o que deve acontecer entre elas.

Isso é diferente de entregar apenas a primeira imagem e pedir:

“Faça a personagem caminhar até a janela.”

Nesse segundo caso, o modelo conhece o início, mas ainda decide boa parte do destino da cena.

Por que controlar o último frame pode fazer diferença?

Quando fornecemos somente uma imagem inicial, várias decisões ainda ficam abertas:

  • onde o personagem terminará;
  • qual será o enquadramento final;
  • quanto a câmera vai se aproximar;
  • qual será a posição dos objetos;
  • qual pose será criada;
  • como ficará a composição no último segundo.

Adicionar um frame final elimina parte dessas decisões.

Isso não significa que todos os quadros intermediários ficarão perfeitos ou que a IA simplesmente “transportará” os pixels da primeira imagem para a segunda.

Ela ainda precisa inventar o caminho.

A diferença é que agora existe um destino visual definido.

Um exemplo fácil de entender

Imagine uma influencer criada com IA em uma sala.

No primeiro frame ela aparece de corpo inteiro, próxima à porta.

No último frame queremos a mesma personagem junto à janela, em plano médio.

Sem o frame final, poderíamos pedir:

A personagem caminha lentamente em direção à janela.

A câmera acompanha o movimento de forma suave.

Movimentos corporais naturais e realistas.

Preserve a identidade da personagem durante toda a cena.

O Flow ainda precisa decidir exatamente onde colocar a personagem, onde posicionar a câmera e qual composição criar no final.

Se já produzimos uma segunda imagem mostrando exatamente como queremos terminar, podemos utilizá-la como último frame.

Nesse caso, nosso prompt passa a se concentrar no caminho entre as duas imagens.

Definir o primeiro e o último frame ajuda a controlar de onde uma cena parte e onde ela precisa terminar.
Definir o primeiro e o último frame ajuda a controlar de onde uma cena parte e onde ela precisa terminar.

Como adicionar primeiro e último frame no Google Flow

Este passo a passo segue a versão web atual do Google Flow.

  1. Abra um projeto no Google Flow.
  2. Na caixa de geração, escolha Vídeo.
  3. Selecione Frames.
  4. Arraste sua primeira imagem para Adicionar frame inicial.
  5. Adicione a segunda imagem em Adicionar frame final.
  6. Escreva no prompt o movimento ou transição que deverá ocorrer entre os dois momentos.
  7. Escolha proporção, duração e modelo compatíveis.
  8. Clique em gerar.

Esse é o fluxo descrito atualmente na documentação oficial do Google Flow.

Se determinada combinação de recurso e modelo não for compatível, o próprio Flow pode informar isso na interface.

O prompt não precisa redescrever tudo o que já está nas imagens

Este é um ponto importante.

Se os dois frames já mostram claramente:

  • a personagem;
  • a roupa;
  • o ambiente;
  • a iluminação;
  • a composição inicial e final;

não precisamos gastar metade do prompt tentando reconstruir cada detalhe visual.

Precisamos explicar principalmente:

o que se move + quem se move + como a câmera se comporta + o que precisa permanecer consistente.

Prompt 1: a personagem caminha até a câmera

Imagine que o frame inicial mostra a personagem em corpo inteiro e o frame final mostra a mesma pessoa muito mais próxima.

A personagem caminha lentamente e com naturalidade em direção à câmera.

Preserve a identidade facial, cabelo, roupa e proporções durante toda a sequência.

A câmera permanece praticamente fixa enquanto a personagem se aproxima.

Movimento corporal natural, passos realistas e transição contínua.

Não alterar o ambiente.
Não substituir a personagem.
Não criar cortes de cena.
Não adicionar outras pessoas.

O principal movimento aqui pertence à personagem.

Prompt 2: a câmera se aproxima, mas a personagem fica parada

Agora queremos chegar a um enquadramento semelhante sem fazer a pessoa caminhar.

A personagem permanece parada na mesma posição.

A câmera realiza uma aproximação lenta e suave em direção ao rosto da personagem.

Movimento cinematográfico estável e contínuo.

Preserve identidade facial, cabelo, roupa e ambiente.

Não fazer a personagem caminhar em direção à câmera.
Não alterar os objetos do cenário.
Não criar cortes.

Desta vez, quem se desloca é a câmera.

Essa distinção parece simples, mas evita pedir duas ações diferentes quando você queria apenas uma.

Vídeo: start e end frames no Google Flow na prática

O vídeo abaixo, do canal AI Mind Revolution, mostra aplicações práticas de primeiro e último frame no Flow, incluindo aproximações, movimentos mais dinâmicos e situações em que o prompt entra em conflito com os frames.

Tutorial externo do canal AI Mind Revolution sobre start e end frames no Google Flow, com exemplos de movimento e continuidade.

O erro começa antes do prompt: dois frames que não combinam

Adicionar duas imagens não transforma automaticamente qualquer combinação em uma boa cena.

A IA ainda precisa construir um movimento plausível entre elas.

Compare estes dois casos.

Caso A

Frame inicial: mulher sentada diante de uma mesa.

Frame final: a mesma mulher em pé ao lado da janela.

Existe um caminho relativamente simples:

levantar → caminhar → chegar à janela.

Caso B

Frame inicial: mulher sentada em um escritório durante o dia.

Frame final: a personagem mergulhando no oceano à noite usando outra roupa.

Agora o modelo precisa resolver simultaneamente:

  • mudança de pose;
  • mudança de roupa;
  • mudança de ambiente;
  • mudança de iluminação;
  • mudança de câmera;
  • mudança de ação;
  • e a transição narrativa entre dois lugares completamente diferentes.

O segundo caso exige muito mais invenção.

Método Simplifike: meça a distância visual antes de gerar

Uma maneira simples de decidir se dois frames funcionam bem juntos é observar quantas coisas importantes mudam entre eles.

ElementoDistância menorDistância maior
Personagemmesma identidadeoutra aparência
Roupaigualcompletamente diferente
Ambientemesmo localoutro local
Câmeraplano médio → closecorpo inteiro → aérea
Açãosentar → levantarsentar → correr
Iluminaçãomesma condiçãodia → noite

Quanto mais elementos você muda simultaneamente, mais decisões o modelo precisa tomar entre o primeiro e o último frame.

Essa matriz é um método editorial da Simplifike para planejar a cena; não é uma regra oficial do Google.

Frame final também pode ajudar em vídeos de produto

Um uso interessante é controlar uma transformação comercial.

Imagine:

Frame inicial: produto sobre fundo simples.

Frame final: exatamente o mesmo produto sobre uma bancada com aparência mais sofisticada.

Podemos usar:

Faça uma transição gradual e realista entre os dois ambientes.

O produto permanece como o elemento principal durante toda a sequência.

Preserve formato, proporção, embalagem, cores e identidade visual.

O fundo simples se transforma progressivamente em uma bancada contemporânea com iluminação comercial suave.

Não deformar o produto.
Não alterar a embalagem.
Não criar outro produto.
Não realizar cortes bruscos.

Esse tipo de fluxo complementa nosso tutorial sobre como transformar foto de produto em vídeo com IA.

Em peças comerciais, revise sempre o vídeo antes de publicar: um clipe visualmente bonito não deve mostrar características que o produto verdadeiro não possui.

Frame inicial e final resolvem consistência de personagem?

Não sozinhos.

Existe uma diferença entre:

controlar a trajetória de uma cena

e

manter a identidade de uma personagem em vários vídeos.

Os frames ajudam a mostrar ao modelo como determinado clipe começa e termina.

Já para construir uma personagem recorrente, referências e recursos de personagem continuam importantes.

Na Simplifike, mostramos essa outra parte no tutorial Como criar um influencer IA consistente.

As técnicas podem ser combinadas:

personagem consistente + primeiro frame + último frame + prompt de movimento.

Um dos piores erros: o prompt contradizer o frame final

Imagine que sua imagem final mostra a personagem sentada.

Mas você escreve:

“Ela permanece em pé durante toda a sequência.”

Agora o texto e a imagem dizem coisas incompatíveis.

Antes de gerar, faça uma pergunta simples:

o movimento que descrevi realmente consegue levar a imagem inicial até a imagem final?

Se a resposta for não, corrija o prompt ou substitua um dos frames.

Outro erro: tentar contar uma história inteira em poucos segundos

Definir o último frame não faz um clipe curto comportar uma sequência enorme de acontecimentos.

Um prompt como:

Ela levanta, pega o celular, sai do escritório, entra no elevador, atravessa a rua, chama um carro e chega a uma cafeteria.

obriga a IA a comprimir várias cenas em poucos segundos.

É melhor dividir.

Clipe 1: levantar e pegar o celular.

Clipe 2: caminhar até a porta.

Clipe 3: sair do ambiente.

Clipe 4: chegada ao novo local.

O Flow possui um Criador de Cenas que permite organizar, reorganizar e aparar clipes para formar uma sequência maior.

Use o último frame de um vídeo para começar o próximo

Aqui está uma das aplicações mais interessantes para continuidade.

O Google Flow permite pausar um vídeo gerado e salvar um frame.

Esse frame pode ser reaproveitado posteriormente como:

  • elemento;
  • frame inicial;
  • frame final.

O processo pode ficar assim:

vídeo 1 → salvar um frame final → usar como começo do vídeo 2 → gerar nova ação

Imagine que o primeiro vídeo termina com uma influencer chegando à porta.

Você salva um frame desse momento.

Na próxima geração, esse frame pode servir como ponto de partida para a personagem abrir a porta e continuar a ação.

A reutilização de frames e o Criador de Cenas são recursos documentados pelo próprio Google Flow.

Como construir uma sequência de três clipes

Clipe 1

A personagem trabalha sentada diante de um notebook.

O final planejado mostra ela olhando para o celular.

Clipe 2

O início reaproveita uma composição coerente com o final anterior.

Ela pega o celular e se levanta.

O último frame mostra a personagem em pé.

Clipe 3

A próxima cena começa nessa posição.

Ela caminha até a porta.

Em vez de pedir um único vídeo para executar oito ações, produzimos pequenos movimentos que podem ser conectados posteriormente.

Frame inicial ou inicial + final?

ObjetivoAbordagem
Animar livremente uma imagemFrame inicial
Não importa exatamente onde a cena terminaFrame inicial
Chegar a um enquadramento específicoInicial + final
Conectar duas posiçõesInicial + final
Criar transformação planejadaInicial + final
Experimentar movimento livreFrame inicial

Mais controle não significa automaticamente um vídeo melhor.

Se você não possui uma razão para determinar exatamente onde a cena termina, permitir que o modelo crie livremente o final pode produzir resultados interessantes.

Use o último frame quando o destino da cena realmente importa.

Quais modelos aceitam primeiro e último frame?

O suporte muda conforme o Google atualiza os modelos, portanto confira a seleção disponível antes de gastar créditos.

Na documentação atual:

ModeloPrimeiro + último frameDurações documentadas
Veo 3.1 LiteSim4, 6 e 8 segundos
Veo 3.1 FastSim4, 6 e 8 segundos
Veo 3.1 QualitySim4, 6 e 8 segundos
Gemini Omni Flash 1.1Sim4, 6, 8 e 10 segundos

O Google informa que disponibilidade, modelos e recursos podem variar conforme conta, plataforma, país ou região.

Você pode consultar a tabela atual de modelos e recursos do Google Flow antes de gerar.

E pelo celular?

O Flow também possui recursos móveis, mas não devemos assumir que toda função disponível na web aparecerá exatamente da mesma maneira no aplicativo ou em todas as contas.

Se primeiro e último frame não estiverem disponíveis no ambiente que você está usando, confira o mesmo projeto na versão web.

A Simplifike tem um guia separado sobre como continuar projetos do Google Flow pelo celular.

5 regras para ter mais controle entre os dois frames

  1. Use imagens visualmente compatíveis. Não mude tudo de uma vez.
  2. Decida quem se move. Personagem, câmera ou ambos?
  3. Descreva o caminho. Não repita apenas aquilo que já está visível.
  4. Não contradiga o último frame. Texto e referência precisam apontar para o mesmo resultado.
  5. Divida movimentos complexos. Vários clipes simples costumam ser mais controláveis que uma cena sobrecarregada.

Um teste simples para entender quando dois frames realmente ajudam

Você pode fazer um experimento sem mudar várias condições ao mesmo tempo.

Crie primeiro um vídeo usando apenas um frame inicial:

A personagem caminha lentamente até a janela.

Ela para diante da janela e observa a rua.

A câmera acompanha o movimento de forma suave.

Preserve a identidade da personagem, roupa e ambiente.

Depois faça uma segunda geração usando:

  • o mesmo frame inicial;
  • o mesmo prompt;
  • o mesmo modelo;
  • a mesma duração;
  • a mesma proporção;
  • e um frame final mostrando exatamente como você gostaria que a cena terminasse.

Compare:

  • posição final;
  • trajetória;
  • enquadramento;
  • identidade;
  • movimento de câmera;
  • artefatos;
  • quantidade de novas gerações necessárias.

A pergunta não é “dois frames são sempre melhores?”.

A pergunta mais útil é:

em quais tipos de cena vale a pena trocar liberdade por controle?

Quando vale a pena usar frame inicial e final?

Eu consideraria a técnica principalmente quando houver um destino visual claro:

  • uma pessoa caminhando até determinada posição;
  • uma aproximação que precisa terminar em um enquadramento específico;
  • uma transformação entre duas composições;
  • um produto passando de um cenário para outro;
  • uma mudança de pose planejada;
  • dois clipes que precisam parecer partes da mesma sequência.

Se a intenção for apenas experimentar e descobrir o que a IA consegue criar a partir de uma imagem, o frame final pode ser desnecessário.

Mas quando você já sabe como a cena deve terminar, mostrar esse destino pode ser muito mais eficiente do que tentar explicá-lo apenas com palavras.

Fontes oficiais

Entre para a comunidade Simplifike

Receba novidades sobre inteligência artificial, ferramentas, tutoriais práticos e oportunidades diretamente no WhatsApp.

✓ Entrar no grupo gratuitamente Grupo gratuito. Você pode sair quando quiser.
Compartilhe seu amor
Daniel Kroll
Daniel Kroll

Daniel Kroll é graduado em Design Digital e fundador da Simplifike. Desde 2022, aplica inteligência artificial à criação de conteúdos, produção de vídeos, automações e negócios digitais. Na Simplifike, desenvolve conteúdos e treinamentos que transformam ferramentas complexas em processos práticos para criadores, profissionais e pequenas empresas.

Artigos: 79

2 comentários

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *