Criação entre mídias: como automatizar o processo do esboço aos slides com Nano Banana 2 e Gemini 3

Na quarta-feira à tarde, meu chefe me marcou de repente no grupo: “Amanhã de manhã temos uma apresentação para investidores. Precisamos de 20 slides que expliquem com clareza a arquitetura técnica e o potencial de mercado do nosso produto.”
Fiquei olhando para a mensagem com um único pensamento: estou perdido.
Vinte slides de alta qualidade exigem estrutura, conteúdo, imagens e diagramação. Pelo método antigo, isso significaria passar a noite em claro: escrever o roteiro, procurar materiais, ajustar as cores e alinhar aquelas caixas de texto que nunca parecem ficar no lugar certo.
Mas, naquela noite, fiz algo diferente.
Abri o NotebookLM, enviei alguns documentos do produto e pedi: “Com base nesses materiais, crie o roteiro de uma apresentação para investidores, com foco na arquitetura técnica e no potencial de mercado.” Dez minutos depois, o roteiro estava pronto.
Em seguida, abri o Gemini 3 e chamei o Nano Banana 2: “Crie um diagrama em camadas do sistema para a parte de arquitetura técnica, com visual tecnológico em tons de azul e resolução 4K.” A imagem foi gerada.
Por fim, usei a Google Slides API para reunir automaticamente todo o conteúdo em uma apresentação completa. Da chegada da tarefa à conclusão, levei menos de duas horas.
Naquele momento, percebi que os fluxos de trabalho criativo estão passando por uma mudança profunda. Já não se trata de “uma pessoa fazer tudo”, mas de “uma pessoa definir a direção e a IA executar o trabalho entre diferentes mídias”.
É disso que este artigo trata: de esboços a slides, de texto a recursos visuais, e de como o Nano Banana 2 e o Gemini 3 estão reformulando o processo criativo.
Nano Banana 2: uma nova referência do Google em geração de imagens
Vamos começar pelo recém-lançado Nano Banana 2.
Em 26 de fevereiro de 2026, o Google lançou oficialmente o Nano Banana 2, a evolução mais recente após o Nano Banana original, apresentado no segundo semestre de 2025, e a versão Pro, lançada em novembro. Tecnicamente, ele é o Gemini 3.1 Flash Image, mas traz melhorias claras de desempenho.
Alguns recursos importantes:
Mais velocidade: em comparação com a versão Pro, o Nano Banana 2 tornou a geração muito mais rápida sem abrir mão da qualidade. Isso é essencial em situações que exigem a produção de muitos recursos visuais.
Resoluções mais flexíveis: oferece várias resoluções, de 512 px a 4K, além de diferentes proporções de imagem. Precisa de uma capa horizontal em 16:9 para uma apresentação? Sem problema. Quer uma imagem quadrada para redes sociais? Também funciona.
Consistência de personagens: é um recurso indispensável para criar conteúdo em série. Você pode gerar um conjunto de imagens que mantém os mesmos personagens e o mesmo estilo, algo útil para narrativas de produto ou identidade visual de marca.
Marca d’água SynthID integrada: a tecnologia de identificação de conteúdo de IA do Google adiciona automaticamente uma marca d’água invisível às imagens geradas, facilitando sua detecção e rastreabilidade.
Em resumo, o Nano Banana 2 não é um brinquedo, mas uma ferramenta pronta para produção.
Do texto ao visual: geração de imagens orientada por linguagem natural
Como funciona o processo tradicional de criação de uma imagem?
O designer entende a necessidade → busca referências → faz um esboço → produz no computador → revisa → finaliza. Uma única imagem pode levar horas ou até dias.
O Nano Banana 2 encurta a distância entre a primeira e a quarta etapa. Agora, você pode descrever diretamente em linguagem natural a imagem que deseja.
Por exemplo, eu precisava de uma ilustração conceitual sobre “fluxo de dados” para um slide de arquitetura técnica. Antes, teria de passar um bom tempo explicando a ideia a um designer. Agora, digito no Gemini 3:
“Crie um diagrama abstrato de arquitetura técnica que represente o fluxo de dados de dispositivos de borda para um centro de processamento na nuvem. Use um gradiente em azul-escuro e azul-elétrico, com linhas e nós de aparência tecnológica, resolução 4K e proporção 16:9. Adote como referência o estilo das ilustrações de sites modernos de produtos SaaS.”
Trinta segundos depois, eu tinha um recurso utilizável. Talvez não estivesse 100% perfeito, mas já era suficiente como primeira versão ou prova de conceito.
Dicas para prompts
- Descreva o estilo com precisão: em vez de dizer “bonito”, diga “estilo de ilustração flat” ou “aparência de renderização 3D”
- Informe a finalidade: “para usar como fundo de PPT”, “adequado para ícone” ou “adequado para capa”
- Controle as cores: indique diretamente a cor principal, como “azul da marca #1E90FF combinado com branco”
- Dê referências: “semelhante ao estilo visual de uma apresentação da Apple” ou “com a aparência das ilustrações do site do Notion”
Do esboço ao resultado final: automação visual e lógica
Gerar uma imagem a partir de texto é apenas o primeiro passo. O mais interessante é o fluxo “orientado por esboços”.
Imagine a seguinte situação: você desenha um esboço no caderno, com algumas caixas, linhas e rótulos como “camada de usuário”, “camada de API” e “camada de dados”. Depois, tira uma foto, envia ao Gemini 3 e pede: “Com base neste esboço de arquitetura, crie um diagrama profissional da arquitetura do produto, com o estilo visual de um SaaS corporativo e ícones e elementos decorativos adequados.”
O Gemini 3 compreende a estrutura lógica do esboço, e o Nano Banana 2 gera uma representação visual de acordo com a descrição. A intenção do desenho é preservada, enquanto sua apresentação é aprimorada.
Essa automação dupla, visual e lógica, se apoia nos recursos multimodais do Gemini 3. Ele não apenas enxerga a imagem: também entende as relações lógicas nela e as combina com instruções em texto para gerar um novo resultado visual.
Na prática, esse fluxo é especialmente útil para:
- Prototipagem rápida: faça um esboço da ideia com papel e caneta, e deixe a IA convertê-lo em um visual profissional
- Colaboração em equipe: o gerente de produto desenha o esboço, e o designer usa a IA para refiná-lo, dobrando a eficiência
- Aprimoramento iterativo: gere uma versão → marque as alterações → gere novamente; após algumas rodadas, o resultado já estará pronto para uso
Apresentações automatizadas: NotebookLM + Google Slides
Com as imagens prontas, o próximo passo é organizá-las em uma apresentação completa.
Aqui entram duas ferramentas combinadas: NotebookLM e Google Slides API.
O papel do NotebookLM é organizar conteúdo disperso, como documentos, PDFs e páginas da web, em uma narrativa estruturada. Você pode enviar um documento de requisitos do produto, um white paper técnico e um relatório de pesquisa de mercado e, em seguida, pedir: “Crie a estrutura de uma apresentação para investidores, com os pontos principais de cada slide.”
O NotebookLM vai:
- Extrair as informações essenciais
- Organizá-las em uma estrutura lógica de slides
- Criar um título e os pontos principais de cada página
Depois, use a Google Slides API para criar os slides automaticamente. Você pode escrever um script:
from googleapiclient.discovery import build
from google.oauth2 import service_account
# Autenticação
service = build('slides', 'v1', credentials=creds)
# Criar a apresentação
presentation = service.presentations().create(
body={'title': 'Arquitetura técnica do produto'}
).execute()
presentation_id = presentation.get('presentationId')
# Adicionar slides em lote
for slide_content in notebooklm_outline:
service.presentations().batchUpdate(
presentationId=presentation_id,
body={'requests': [{
'createSlide': {
'slideLayoutReference': {
'predefinedLayout': 'TITLE_AND_BODY'
}
}
}]}
).execute()
# Adicionar as imagens geradas pelo Nano Banana 2...
O fluxo completo passa a ser:
- O NotebookLM analisa o conteúdo → gera o roteiro e o texto
- O Nano Banana 2 gera as imagens → fornece os recursos visuais
- A Google Slides API faz a diagramação automática → entrega o resultado final
Um trabalho que antes exigia um designer, um redator e várias horas agora pode ter sua primeira versão concluída por uma pessoa em poucas dezenas de minutos.
Tendências futuras: a mudança de paradigma no trabalho criativo
Depois de tudo isso, o que esse fluxo realmente significa?
Na minha visão, há mudanças em três níveis:
Primeiro nível: mais eficiência
É a mudança mais direta. Uma tarefa que antes levava dias agora pode ter sua primeira versão concluída em algumas horas ou até em poucas dezenas de minutos. Não é a pessoa que ficou mais rápida: ela transferiu a execução para a IA e passou a se concentrar na avaliação e nos ajustes.
Segundo nível: menos barreiras de entrada
Nem todo mundo é designer, mas todo mundo precisa fazer apresentações. A combinação do Nano Banana 2 com o Gemini 3 permite que pessoas sem formação especializada também produzam conteúdo visual “bom o suficiente”. O design deixa de ser exclusividade de poucos.
Terceiro nível: mudança de paradigma
Esse é o impacto mais profundo. O fluxo tradicional é linear: primeiro se escreve o conteúdo, depois se criam as imagens e, por fim, faz-se a diagramação. Cada etapa depende da conclusão da anterior.
O novo fluxo é paralelo e iterativo. Você pode começar explorando direções visuais e depois ajustar a estrutura do conteúdo a partir delas; pode experimentar vários estilos visuais ao mesmo tempo, compará-los e escolher rapidamente; também pode pedir à IA que gere diversas versões e deixar a seleção final para uma pessoa.
O foco do trabalho criativo passa da “execução” para a “curadoria”: em vez de produzir pessoalmente cada elemento, você define a direção, escolhe a proposta e ajusta os detalhes.
É claro que isso não significa que designers ficarão sem trabalho. Pelo contrário, os melhores profissionais ganharão ainda mais destaque. Seu senso estético, sua capacidade de concepção criativa e sua compreensão de marca se tornarão “metacompetências” para orientar a IA. Já o trabalho repetitivo de execução pode ficar com as ferramentas.
Conclusão
Voltando àquela quarta-feira à tarde do início do artigo.
Se eu tivesse seguido o método antigo, certamente teria passado a noite fazendo o PPT. Com o novo fluxo, porém, não apenas terminei a tarefa no prazo, como ainda tive tempo para ensaiar e preparar respostas para possíveis perguntas.
A apresentação do dia seguinte correu muito bem. Quando os investidores perguntaram alguns detalhes técnicos, consegui abrir rapidamente os diagramas de arquitetura correspondentes e explicar cada ponto. Aquelas imagens não eram materiais genéricos encontrados ao acaso: tinham sido personalizadas para o nosso produto e apresentavam a lógica com clareza.
É isso que quero dizer: o Nano Banana 2 e o Gemini 3 não são apenas ferramentas, mas novos parceiros criativos. Eles não substituem sua criatividade, mas permitem transformá-la em realidade com mais rapidez e facilidade.
Se você ainda não experimentou esse fluxo, recomendo começar por um projeto pequeno. Pode ser, por exemplo, o PPT de uma apresentação para a equipe na próxima semana: use o NotebookLM para criar o roteiro e o Nano Banana 2 para produzir algumas imagens e veja como fica.
Talvez o resultado não seja perfeito na primeira tentativa. Ainda assim, você provavelmente se surpreenderá ao perceber que, quando a IA assume o peso da execução, você pode direcionar sua energia para o que realmente importa: contar uma boa história, transmitir ideias e envolver o público.
E essa é a verdadeira essência da criação.
FAQ
O que é o Nano Banana 2 e como ele se diferencia dos modelos anteriores de geração de imagens?
As principais melhorias incluem:
• **Mais velocidade**: a geração ficou muito mais rápida em comparação com a versão Pro, o que favorece a produção em lote
• **Resoluções flexíveis**: oferece opções de 512 px a 4K e várias proporções de imagem
• **Consistência de personagens**: permite criar séries de imagens mantendo personagens e estilo consistentes
• **Marca d'água SynthID**: inclui uma identificação de conteúdo de IA para facilitar a detecção e a rastreabilidade
Em comparação com os modelos anteriores, o Nano Banana 2 deixou de ser um 'brinquedo' e se tornou uma ferramenta pronta para produção, mais adequada a aplicações comerciais.
Como escrever bons prompts para o Nano Banana 2?
**Descreva o estilo com precisão**:
• Em vez de dizer 'bonito', diga 'estilo de ilustração flat' ou 'aparência de renderização 3D'
• Indique o estilo artístico: 'cyberpunk', 'minimalista' ou 'art nouveau'
**Deixe claro o contexto de uso**:
• 'Para usar como fundo de PPT, com espaço livre para texto'
• 'Adequado para ícone de aplicativo, simples e fácil de reconhecer'
**Controle a paleta de cores**:
• Informe diretamente a cor principal: 'azul da marca #1E90FF combinado com branco'
• Descreva a atmosfera: 'tons terrosos quentes' ou 'gradiente frio em azul e roxo'
**Dê referências**:
• 'Semelhante ao estilo visual de uma apresentação da Apple'
• 'Com a aparência das ilustrações do site do Notion'
Quanto mais específica for a descrição, mais próximo do esperado será o resultado.
Como funciona um fluxo de geração com IA orientado por esboços?
1. **Faça um esboço à mão**: desenhe no papel a estrutura da ideia, com caixas, setas e anotações
2. **Fotografe e envie**: tire uma foto do esboço com o celular e envie ao Gemini 3
3. **Descreva a necessidade**: explique o estilo e a finalidade desejados
4. **Gere com IA**: o Gemini entende a estrutura lógica do esboço, e o Nano Banana 2 produz um visual profissional
5. **Aprimore por iterações**: marque o que precisa mudar e gere novamente
As vantagens desse fluxo são:
• Preservar a intenção do esboço e melhorar sua apresentação
• Permitir que gerentes de produto validem ideias rapidamente
• Deixar que designers comecem pelo refinamento, em vez de desenhar do zero
• Chegar a um resultado utilizável após poucas iterações
Como combinar o NotebookLM e a Google Slides API para automatizar apresentações?
**Etapa do NotebookLM**:
• Envie materiais de referência, como documentos de produto e white papers técnicos
• Use a instrução: 'Crie o roteiro de uma apresentação para investidores, com foco na arquitetura técnica e no potencial de mercado'
• Resultado: uma estrutura organizada de slides e os principais pontos de cada página
**Etapa do Nano Banana 2**:
• Gere recursos visuais relacionados ao conteúdo de cada slide
• Escolha estilos diferentes conforme o tipo de página, como capa, gráfico ou ilustração
**Etapa da Google Slides API**:
• Chame a API para criar uma nova apresentação
• Adicione os slides em lote
• Insira o texto gerado pelo NotebookLM
• Insira as imagens geradas pelo Nano Banana 2
• Aplique automaticamente layout e formatação
Resultado final: uma primeira versão da apresentação com estrutura completa, conteúdo consistente e visual profissional, pronta para uso após pequenos ajustes manuais.
O que a automação por IA significa para profissionais criativos?
**Eficiência**: a execução fica muito mais rápida; a IA assume o trabalho repetitivo, enquanto as pessoas se concentram em avaliar e ajustar
**Acesso**: mesmo quem não é especialista consegue produzir conteúdo visual 'bom o suficiente', e o design deixa de ser exclusividade de poucas pessoas
**Paradigma**: o fluxo linear dá lugar a um processo paralelo e iterativo
• É possível explorar várias direções visuais ao mesmo tempo
• O ciclo de gerar, selecionar e aprimorar fica mais rápido
• O foco criativo passa da 'execução' para a 'curadoria'
**Impacto para designers**:
• Redução do trabalho básico de execução
• Maior valor de 'metacompetências', como senso estético, concepção criativa e compreensão de marca
• Designers de ponta se tornam 'diretores' da IA, e não apenas executores
A ideia central é: a IA não substitui a criatividade; ela permite transformá-la em realidade com mais rapidez.
9 min de leitura · Publicado em: 28 fev 2026 · Atualizado em: 4 set 2026
Domínio do Google AI
Se você chegou pela busca, o caminho mais rápido é ir para o post anterior ou próximo desta série.



Comentários
Entre com GitHub para comentar