Alternar tema

Como prolongar vídeos no Veo 3 para mais de 1 minuto

Easton editorial illustration: step-by-step assembly path

O Veo 3 gera no máximo 8 segundos por vez. A interface até tem um botão Extend, mas, quando você o abre, o modelo muda automaticamente para o Veo 2 Fast — sem áudio e com qualidade de imagem inferior à do Veo 3. Para preservar a qualidade e o áudio do Veo 3, esse botão praticamente não serve.

O problema de simplesmente juntar vários trechos de 8 segundos é a consistência dos personagens: a cor da roupa do protagonista, o cenário de fundo e o estilo da iluminação começam a mudar discretamente de um trecho para outro, e o resultado não se encaixa. Em uma demonstração de produto de 45 segundos, corrigir essas variações já consome bastante tempo.

Este artigo apresenta três soluções para prolongar vídeos: Flow Scene Builder, a opção mais estável; extensão automática pela API Gemini, que pode chegar a 148 segundos; e montagem com ferramentas externas, a opção mais flexível. Também há uma seção dedicada a manter os personagens consistentes.

Por que o Veo 3 só gera 8 segundos

Primeiro, vale entender a origem dessa limitação. Não é uma dificuldade criada de propósito pelo Google, mas uma escolha ligada à arquitetura técnica. Para manter a qualidade muito alta da geração e do áudio, o Veo 3 precisa equilibrar tempo de processamento, consumo de recursos e qualidade do resultado. Você pode escolher 4, 6 ou 8 segundos, mas não há uma opção mais longa.

O mais frustrante é que a interface tem um botão “Extend”, porém, ao abri-lo, o modelo muda automaticamente para o Veo 2 Fast — sem áudio e com qualidade bem inferior à do Veo 3. É por isso que tantas pessoas reclamam no Reddit e no TikTok: “Eu só quero a qualidade do Veo 3. Por que preciso voltar para o Veo 2?”

É possível que o Google ofereça suporte nativo a vídeos mais longos em uma versão futura, mas, por enquanto, precisamos contornar a limitação.

Três formas de prolongar vídeos

Método 1: Flow Scene Builder + fluxo Frames-to-Video (recomendado)

Este é o método que mais uso quando preciso manter a alta qualidade e o áudio completo do Veo 3. O processo exige um pouco mais de trabalho, mas entrega o resultado mais estável.

Passo a passo:

  1. Gere o primeiro trecho: crie o primeiro vídeo de 8 segundos no Google Flow e selecione “Highest Quality”, que corresponde ao Veo 3.

  2. Salve o último quadro: depois que o vídeo for gerado, leve o cursor de reprodução até o último quadro e clique no sinal “+” para salvá-lo como asset. Essa etapa é essencial, porque esse quadro será o ponto de partida do próximo trecho.

  3. Mude para Frames-to-Video: clique no modo “Frames to Video” e envie o último quadro que você acabou de salvar.

  4. Repita a descrição do personagem: esta é a etapa mais importante e também a mais fácil de ignorar. No prompt, você precisa repetir integralmente todas as descrições dos personagens do primeiro trecho — aparência, roupa, cenário, iluminação, atmosfera e até efeitos sonoros. Não resuma nem reescreva: copie e cole exatamente o mesmo texto.

    Por exemplo, se o prompt do primeiro trecho for:

    “A 35-year-old Asian woman with long black hair, wearing a white blouse and blue jeans, standing in a modern office with natural daylight, smiling warmly.”

    Use a mesma descrição no segundo trecho e acrescente apenas a nova ação:

    “A 35-year-old Asian woman with long black hair, wearing a white blouse and blue jeans, standing in a modern office with natural daylight, turning to face the camera.”

  5. Adicione à linha do tempo: quando a geração terminar, clique em “Add to Scene” para inserir o novo trecho na linha do tempo.

  6. Ajuste a transição: pode haver uma sobreposição de 1 ou 2 quadros entre os trechos. Faça um pequeno corte na ferramenta de edição para criar uma transição fluida.

  7. Continue prolongando: repita as etapas de 2 a 6 até chegar à duração desejada.

Atenção:

  • Não volte para a página da biblioteca de materiais durante a geração, pois isso pode interromper o processo.
  • Em cada uso do Frames-to-Video, descreva todas as características do personagem. Caso contrário, ocorrerá a “deriva do personagem”. Já tentei economizar tempo resumindo a descrição, e o cabelo da protagonista passou de longo para curto.
  • Confira a consistência depois de cada extensão. Se o resultado se afastar demais da referência, ajuste imediatamente; não espere gerar dez trechos para descobrir que tudo ficou diferente.

Vantagem: mantém a qualidade máxima e o suporte completo a áudio do Veo 3.
Desvantagem: exige trabalho manual e leva mais tempo.

Método 2: extensão automática pela API Gemini (mais eficiente)

Se você precisa gerar rapidamente um vídeo mais longo, com até dois minutos e meio, e tem alguma experiência com programação, este método é especialmente útil.

Como funciona:
Depois de chamar o Veo pela API Gemini para gerar o vídeo inicial, use o parâmetro “extend” para acrescentar 7 segundos por vez. É possível fazer até 20 extensões, chegando a 148 segundos. Todo o processo é automatizado: você não precisa salvar quadros nem enviar imagens manualmente.

Passo a passo:

  1. Solicite uma chave de API no Google AI Studio. A conta gratuita oferece uma cota diária.
  2. Use o código abaixo para chamar a API e gerar o primeiro vídeo:
import google.generativeai as genai

genai.configure(api_key='YOUR_API_KEY')

prompt = "A cat playing piano in a cozy living room"
video = genai.generate_video(prompt=prompt, duration=8)

# Prolonga o vídeo
for i in range(10):  # Faz 10 extensões, totalizando cerca de 80 segundos
    video = genai.extend_video(video, duration=7)

Pontos técnicos:

  • Cada extensão acrescenta 7 segundos; não é possível escolher uma duração maior.
  • Ao prolongar o vídeo, a API usa automaticamente as informações visuais e textuais do trecho anterior como referência.
  • Monitore a cota da API para não ultrapassar o limite.

Vantagens: alto nível de automação, bom para geração em lote e grande economia de trabalho manual.
Desvantagens: exige conhecimentos de programação, a API tem limites de uso e a cota de uma conta gratuita pode não ser suficiente.

Método 3: montagem com ferramentas externas de edição (mais flexível)

Se você precisa de um acabamento detalhado na pós-produção ou quer combinar trechos de diferentes cenas em um único vídeo, é melhor usar uma ferramenta profissional de edição.

Comparação das ferramentas:

FerramentaRecursosIndicado paraPreço
CapCutLegendas por IA, ampla biblioteca de efeitos sonoros e produção com um cliqueProdução rápida, sem edição complexaGratuito
Premiere Pro 2025Recursos profissionais, edição inteligente por IA e legendas em vários idiomasAcabamento detalhado e resultado com qualidade cinematográficaAssinatura
DaVinci ResolveRecursos avançados de correção de cor e ferramentas profissionais gratuitasQuem tem orçamento limitado, mas precisa de funções profissionaisVersão gratuita + versão paga

Boas práticas de montagem:

  1. Use transições em fade: aplique um crossfade de 0,5 segundo na junção entre os trechos para reduzir bastante a sensação de corte brusco.
  2. Sincronize o áudio com IA: o CapCut tem um recurso de sincronização com a batida que ajusta automaticamente os cortes ao ritmo da música e disfarça pequenas diferenças entre os trechos.
  3. Adicione música de fundo: uma trilha contínua melhora muito a sensação de unidade e dificulta que o público perceba as emendas.

Talvez você esteja em dúvida sobre qual método escolher:

  • Se a prioridade é qualidade e você tem tempo para ajustar o resultado, use o método 1.
  • Se você sabe programar e precisa gerar vídeos em lote, use o método 2.
  • Se precisa de mais liberdade na pós-produção, use o método 3.

Na prática, não é tão complicado. Muitas vezes combino os métodos: primeiro gero alguns trechos de alta qualidade com o método 1 e depois faço a montagem detalhada e o tratamento de áudio no CapCut.

Criar vídeos longos com o Flow Scene Builder

Use o Flow Scene Builder e o fluxo Frames-to-Video para prolongar um vídeo de 8 segundos para mais de 1 minuto, mantendo a alta qualidade e o áudio completo do Veo 3

Estimated time: PT30M

  1. 1

    Step 1: Gerar o primeiro trecho

    Gere o primeiro vídeo de 8 segundos no Google Flow e selecione o modo Highest Quality (Veo 3)
  2. 2

    Step 2: Salvar o último quadro

    Depois que o vídeo for gerado, leve o cursor de reprodução até o último quadro e clique no sinal + para salvá-lo como asset e usá-lo como ponto de partida do próximo trecho
  3. 3

    Step 3: Mudar para Frames-to-Video

    Clique no modo Frames to Video e envie o último quadro que você acabou de salvar
  4. 4

    Step 4: Repetir integralmente a descrição do personagem

    Repita no prompt todas as descrições dos personagens do primeiro trecho — aparência, roupa, cenário, iluminação, atmosfera e efeitos sonoros — sem resumir nem reescrever
  5. 5

    Step 5: Adicionar à linha do tempo

    Quando a geração terminar, clique em Add to Scene para inserir o novo trecho na linha do tempo
  6. 6

    Step 6: Ajustar a transição

    Pode haver uma sobreposição de 1 ou 2 quadros entre os trechos; corte-a com a ferramenta de edição para criar uma transição fluida
  7. 7

    Step 7: Continuar prolongando

    Repita as etapas de 2 a 6 até chegar à duração desejada

Seis técnicas para manter os personagens consistentes

Depois dos métodos de extensão, chegamos ao problema mais difícil: como fazer o personagem permanecer igual do início ao fim? Quando comecei a usar o Veo 3, cinco trechos podiam mostrar três pessoas diferentes. Parecia que a IA tinha perdido a memória. Depois de analisar vários casos, reuni estas seis técnicas:

Técnica 1: crie uma ficha do personagem (Character Bible)

Hoje, esta é a primeira etapa de todos os meus projetos. Crie um documento que registre em detalhes as informações do personagem:

  • Idade, gênero e tom de pele
  • Penteado, cor e comprimento do cabelo
  • Roupa, incluindo cor e estilo específicos
  • Acessórios, como óculos, colar e relógio
  • Características da expressão, como sorriso e olhar
  • Ambiente de fundo

Ponto principal: sempre que gerar um novo trecho, cole o bloco de descrição completo, sem resumir nem reescrever. A IA é mais sensível aos detalhes do que parece. “Camisa branca” e “blusa branca” podem ser interpretadas como duas peças diferentes.

Técnica 2: aproveite o Scene Builder

O recurso “Add to Scene” do Flow faz o Veo 3 usar as informações visuais do trecho anterior como referência, o que aumenta bastante a taxa de consistência. Em mais de dez testes, obtive uma melhora de pelo menos 50% em comparação com a geração de trechos separados.

Técnica 3: use o fluxo de imagem para vídeo (mais confiável)

Este é o método mais estável que encontrei até agora:

  1. Primeiro, gere no Imagen 3 uma imagem estática perfeita do personagem.
  2. Importe essa imagem como referência no recurso Image-to-Video do Veo 3.
  3. Use a mesma imagem como referência visual em cada extensão posterior.

Assim, a IA passa a ter uma “resposta de referência” forte e tende a se desviar menos. Usei esse método em um vídeo de entrevista de 90 segundos, e o apresentador permaneceu o mesmo do início ao fim, inclusive no penteado e nas dobras da roupa.

Técnica 4: mantenha o prompt consistente

Use exatamente o mesmo texto para descrever o personagem. Pode parecer mecânico, mas funciona. Quanto mais específica e distinta for a descrição, maior será a consistência.

Boa descrição:

“A 28-year-old woman with shoulder-length curly red hair, wearing round tortoiseshell glasses and a navy blue cardigan over a white turtleneck.”

Descrição ruim:

“A young woman with nice hair and glasses.”

A segunda é vaga demais, e a IA pode interpretá-la de uma maneira diferente a cada geração.

Técnica 5: use Jump To e Extend Scene

Esses dois recursos aproveitam o contexto visual e textual do trecho anterior. Mesmo assim, o novo prompt ainda precisa conter a descrição completa do personagem. Não tente economizar esse trabalho: copiar e colar leva menos de dez segundos.

Técnica 6: adote um fluxo multimodal avançado

Se você tem um perfil mais técnico, pode testar este processo avançado:

  1. Use o Gemini 2.5 Pro para analisar as características semânticas do personagem.
  2. Use o Imagen 3.0 para criar uma imagem de referência.
  3. Gere o vídeo com o Veo.
  4. Crie um “vetor de identidade” (identity vector) para reduzir as variações.

O processo é mais complexo, mas o resultado pode ser impressionante. Vi um curta de três minutos criado com esse fluxo em que até a posição de uma pinta no rosto do protagonista permaneceu igual do início ao fim.

Casos práticos e dúvidas frequentes

Caso 1: vídeo de demonstração de produto (45 segundos)

Cenário: apresentar as três funções principais de um aplicativo.
Solução: gerar três trechos de 15 segundos com o mesmo modelo de mãos e o mesmo estilo de interface.

Pontos principais:

  • Mantenha os mesmos gestos, a mesma iluminação e o mesmo ângulo de filmagem.
  • Use o mesmo modelo de celular e a mesma mesa de fundo.
  • Especifique no prompt: “as mesmas mãos, o mesmo celular e a mesma mesa”.

Na semana passada, usei esse método para criar um vídeo de demonstração para um cliente. A montagem final ficou sem nenhuma quebra visual, e o cliente pensou que era uma gravação real.

Caso 2: vídeo de entrevista (1 minuto e 30 segundos)

Cenário: um apresentador de TV comenta três notícias.
Solução: usar a API Gemini para prolongar o vídeo até 90 segundos em conjunto com o Scene Builder.

Pontos principais:

  • Mantenha a câmera fixa, com o apresentador sempre no centro da imagem.
  • Preserve o mesmo fundo: estúdio de notícias, telas e iluminação ao fundo.
  • Não mude a roupa: terno escuro e gravata.

O desafio deste caso são os closes no rosto, que exigem um nível de consistência especialmente alto. Usei o fluxo de imagem para vídeo: primeiro gerei no Imagen uma foto frontal do apresentador e depois fiz todos os trechos usarem essa foto como referência.

Perguntas frequentes

P: Por que meu personagem muda em cada geração?
R: Em 90% dos casos, o prompt não tem detalhes suficientes ou a descrição é “melhorada” a cada tentativa. Lembre-se: copiar e colar é a melhor opção aqui; não tente “otimizar” o prompt.

P: Por que o botão Extend muda para o Veo 2?
R: No momento, o Extend só funciona com o Veo 2 Fast. Essa é uma limitação definida pelo Google. Para manter a qualidade do Veo 3, é necessário usar o fluxo Frames-to-Video.

P: Posso usar comercialmente os vídeos baixados do Flow?
R: Consulte os termos de uso do Google Veo. No momento, o Veo 3 ainda está em fase experimental, e o uso comercial pode ter restrições. Confirme as condições antes de publicar.

P: Como escolher uma ferramenta para juntar os trechos?
R: Para produzir rapidamente, use o CapCut, que é gratuito e fácil de aprender. Para um acabamento detalhado, use o Premiere Pro, que é profissional e completo. Se o orçamento for limitado, mas você ainda precisar de recursos profissionais, use o DaVinci Resolve; a versão gratuita já é bastante poderosa.

Resumo e próximos passos

Estas são as três opções principais:

  • Flow Scene Builder + Frames-to-Video: indicado quando a prioridade é manter a alta qualidade e o áudio do Veo 3; exige paciência durante o processo.
  • Extensão automática pela API Gemini: indicada para geração em lote e vídeos longos, com até 148 segundos; exige conhecimentos de programação.
  • Montagem com ferramentas externas de edição: indicada para um acabamento detalhado e para combinar várias cenas.

A consistência dos personagens é essencial para produzir vídeos longos. Entre as seis técnicas, as mais importantes são criar uma Character Bible, usar o fluxo de imagem para vídeo e manter o prompt exatamente igual.

Abra o Google Flow e teste o fluxo do Scene Builder. Comece com um trecho de 8 segundos e use o Frames-to-Video para prolongá-lo gradualmente até a duração desejada. Talvez surjam alguns problemas na primeira tentativa, mas, depois de alguns testes, o processo fica mais familiar.

Salve este artigo para consultar as seis técnicas quando encontrar problemas de consistência. Com prática, você também poderá criar um curta de três minutos que pareça ter sido produzido por uma equipe profissional.

Boa criação!

FAQ

Por que o Veo 3 só gera vídeos de 8 segundos?
É uma escolha ligada à arquitetura técnica.

Para preservar a qualidade da geração e do áudio, o Veo 3 precisa equilibrar tempo de processamento, consumo de recursos e qualidade do resultado.

Atenção:
• Embora a interface tenha o botão Extend, ele muda para o Veo 2 Fast, que não tem áudio e oferece qualidade inferior
• Para manter a qualidade do Veo 3, é necessário usar o fluxo Frames-to-Video
Como prolongar um vídeo de 8 segundos para mais de 1 minuto?
Há três formas:

1) Flow Scene Builder + Frames-to-Video:
• É a opção mais estável
• Mantém a alta qualidade e o áudio do Veo 3

2) Extensão automática pela API Gemini:
• É a opção mais eficiente
• Pode chegar a 148 segundos, acrescentando 7 segundos por vez

3) Montagem com ferramentas externas de edição:
• É a opção mais flexível
• É indicada para um acabamento detalhado na pós-produção
Como manter o mesmo personagem em vários trechos de vídeo?
Seis técnicas importantes:

1) Crie uma Character Bible, com todas as informações do personagem

2) Use o Scene Builder, que pode melhorar a consistência em 50%

3) Adote o fluxo de imagem para vídeo, a opção mais confiável, com uma imagem de referência gerada no Imagen 3

4) Mantenha o prompt idêntico, repetindo toda a descrição do personagem

5) Use os recursos Jump To e Extend Scene

6) Adote um fluxo multimodal avançado, com um vetor de identidade
Por que o botão Extend muda para o Veo 2?
No momento, o recurso Extend só funciona com o Veo 2 Fast. Essa é uma limitação definida pelo Google.

Para manter a qualidade do Veo 3 e o suporte completo a áudio, é necessário usar o fluxo Frames-to-Video, salvar manualmente o último quadro e usá-lo como ponto de partida do próximo trecho.
Quais são as limitações para prolongar vídeos pela API Gemini?
Limitações:
• Cada extensão acrescenta 7 segundos e não pode ser mais longa
• É possível fazer no máximo 20 extensões, chegando a 148 segundos

Como funciona:
• Ao prolongar o vídeo, a API usa automaticamente as informações visuais e textuais do trecho anterior como referência

Atenção:
• É preciso monitorar a cota da API; uma conta gratuita pode não ser suficiente
• É mais indicado para quem sabe programar e precisa gerar vídeos em lote
Como escolher uma ferramenta para juntar os trechos de vídeo?
Escolha da ferramenta:

• Para produzir rapidamente, use o CapCut: é gratuito, fácil de aprender e oferece legendas por IA e sincronização de cortes com a batida

• Para um acabamento detalhado, use o Premiere Pro: é uma ferramenta profissional com edição inteligente por IA

• Para ter recursos profissionais com orçamento limitado, use o DaVinci Resolve: a versão gratuita já é poderosa

Dica de montagem:
• Transições em fade e música de fundo ajudam a disfarçar diferenças entre os trechos

13 min de leitura · Publicado em: 7 dez 2025 · Atualizado em: 4 set 2026

Comentários

Entre com GitHub para comentar

Easton BlogEaston Blog