Se você já procurou como gerar imagens no Gemini, provavelmente esbarrou em uma confusão de nomes: Nano Banana, Nano Banana 2, Nano Banana Pro, Gemini 3.1 Flash Image. Parecem produtos diferentes e não são — Nano Banana é simplesmente o nome da geração de imagens nativa do Gemini, e os demais são versões dela.

Esse esclarecimento importa porque a escolha do modelo é a decisão que mais afeta o resultado. Um infográfico com texto denso feito no modelo rápido sai com letras tortas; o mesmo pedido no modelo Pro sai legível. Saber qual usar em cada caso economiza tentativas e cota diária.

Este guia cobre os três modelos e quando usar cada um, o passo a passo de geração, como escrever prompts do jeito que o Gemini aproveita melhor, a edição conversacional que é o principal diferencial da ferramenta, e as limitações reais.

O que é Nano Banana

Nano Banana é o nome da capacidade nativa de geração e edição de imagens do Gemini. Nativa significa que o modelo de imagem está integrado ao próprio Gemini, e não acionado como um sistema separado — ele entende o pedido no mesmo contexto da conversa, incluindo imagens que você enviou e o que já foi dito antes.

Em fevereiro de 2026 o Nano Banana 2 passou a ser o caminho padrão de geração de imagens nas principais superfícies do Google, incluindo o app do Gemini. O Nano Banana Pro continua existindo como opção de alta fidelidade, principalmente para quem tem plano pago.

Os três modelos e quando usar cada um

Dentro do Gemini, o menu de modelos aparece com nomes de comportamento — Rápido, Raciocínio e Pro. Por baixo, correspondem a três modelos distintos.

ModeloPerfilUse quando
Nano Banana 2 Lite (Rápido)O mais veloz e econômicoTestes, variações rápidas, imagens simples de uma cena só
Nano Banana 2 (Raciocínio)O generalista, padrão para quase tudoA maior parte dos casos: cenas, retratos, produtos, ilustrações
Nano Banana ProAlta fidelidade, texto e layout complexosInfográficos, cartazes com texto denso, peças de produção

Uma característica útil do fluxo: você pode gerar primeiro no modelo padrão e, se o resultado pedir mais detalhe, refazer a mesma imagem no Pro. Nos planos pagos, a opção aparece no menu de três pontos da imagem gerada, como "Refazer com o Pro". A limitação é que, ao esgotar a cota diária do modelo padrão, a refação no Pro também deixa de estar disponível.

💡 Estratégia de cota: use o modelo rápido para descobrir a composição que funciona e só então refaça no Pro. Gastar as gerações do modelo mais caro em testes é o erro que mais desperdiça cota diária.

Como gerar sua primeira imagem

  1. Abra o Gemini. No computador, acesse pelo navegador; no celular, pelo aplicativo.
  2. Entre na área de imagens. Na barra lateral existe uma seção de Imagens; alternativamente, no menu de ferramentas há a opção de criar imagens.
  3. Escolha o modelo. Rápido, Raciocínio ou Pro, conforme a tabela acima. Se estiver em dúvida, comece pelo padrão.
  4. Escreva o pedido em linguagem natural. Frases completas funcionam melhor que listas de palavras separadas por vírgula.
  5. Peça ajustes na mesma conversa. "Deixe o fundo mais escuro", "mude para o fim da tarde", "tire a planta do canto". Ele mantém a imagem e altera só o que foi pedido.
  6. Baixe em resolução cheia. Use o botão de download, nunca captura de tela.

Resolução: o que você consegue baixar

A resolução de download depende do plano. Sem plano pago do Google com IA, o download sai em 1K. Com plano, é possível baixar em 2K. O Nano Banana Pro é o caminho para saídas de fidelidade mais alta, incluindo material com texto e layout que precisa aguentar ampliação.

Na prática isso significa que, para uso digital comum — post, thumbnail, imagem de blog, apresentação — o que o Gemini entrega já resolve. Para impressão em tamanho grande ou monitor de alta resolução, você vai precisar ampliar depois da geração. Dá para aumentar a resolução da imagem sem perder qualidade, e o resultado costuma ser bom quando a imagem é limpa e pouco detalhada.

Como escrever prompts para o Gemini

O próprio Google sugere uma fórmula inicial simples: peça a criação de uma imagem indicando o sujeito, a ação e a cena. É um bom ponto de partida — e o passo seguinte é justamente expandi-la.

Comece pela fórmula, depois detalhe

Um pedido mínimo funcionaria assim:

Crie a imagem de um gato cochilando em um raio de sol no parapeito de uma janela.

Já dá resultado. Mas cada camada adicional aproxima o resultado do que você imaginou:

Crie a imagem de um gato preto cochilando enrolado em um raio de sol no parapeito de uma janela de madeira, cortina de linho ao lado balançando levemente, poeira suspensa visível na luz, plano médio lateral, luz quente de fim de tarde, tons bege e âmbar, fotografia doméstica contemplativa.

Escreva em prosa, não em tags

Esta é a diferença mais importante em relação a ferramentas como o Midjourney. O Gemini é conversacional e aproveita melhor frases completas do que listas de termos separados por vírgula. Escreva como se estivesse explicando a cena para alguém.

Diga a proporção

Se você não indicar, o modelo escolhe. Diga "formato vertical para stories", "quadrado para Instagram", "horizontal widescreen" ou a proporção diretamente.

Coloque o texto entre aspas

Quando a imagem precisa conter palavras, escreva-as literalmente entre aspas e indique a posição. Sem isso, o modelo pode parafrasear ou colocar onde achar melhor.

Itere em vez de reescrever

Se algo saiu errado, peça a correção específica em vez de reescrever tudo. "Mantenha a composição e troque só a cor do casaco para verde" preserva o que já estava bom. Reescrever o prompt inteiro gera uma imagem nova sem relação com a anterior.

Edição conversacional: o principal diferencial

É aqui que o Gemini se destaca. Você envia uma imagem — gerada por ele ou sua — e descreve a alteração em palavras, sem máscara, camada ou seleção.

Trocar o fundo

Manter o sujeito e substituir o ambiente atrás dele. Útil para retratos, produtos e peças de marketing.

Mantenha a pessoa exatamente como está e substitua o fundo por uma parede de concreto aparente clara, com luz natural difusa vindo da esquerda. Preserve a iluminação sobre o rosto.

Mudar o clima e o horário

Transformar um dia ensolarado em noite, adicionar chuva, trocar o outono pelo inverno. A mesma cena com outra atmosfera.

Mantenha a composição e todos os elementos. Mude de dia ensolarado para noite chuvosa, com a rua molhada refletindo as luzes e neblina baixa.

Alterar o ângulo de câmera

Pedir a mesma cena vista de outro ponto. Não é perfeito, porque o modelo precisa inventar o que não estava visível, mas funciona bem em cenas com espaço.

Mostre a mesma cena vista de um ângulo mais baixo, próximo ao chão, mantendo os mesmos objetos, a mesma iluminação e o mesmo estilo.

Transferir estilo de uma referência

Um dos recursos mais úteis e menos conhecidos: enviar duas imagens e pedir que a textura, a cor ou o estilo de uma seja aplicada à outra. É a forma mais rápida de testar estéticas sem começar do zero.

Aplique a paleta de cores e a textura da segunda imagem à primeira, mantendo a composição, os objetos e o enquadramento da primeira exatamente iguais.

Adicionar ou remover elementos

Tirar um objeto indesejado, acrescentar uma planta, incluir uma pessoa ao fundo. Funciona bem com elementos claramente delimitados; remoções em áreas de textura complexa às vezes deixam marcas.

Remova o carro estacionado à direita e complete a rua naturalmente, mantendo o restante da imagem sem alterações.

Trabalhar com imagens de referência

Enviar imagens junto com o pedido é onde o Gemini mostra mais força, e vale entender as três formas de usar isso.

Referência de sujeito. Você envia a foto de uma pessoa, produto ou personagem e pede que ele apareça em uma cena nova. O modelo tenta preservar a identidade do sujeito e trocar todo o resto.

Referência de estilo. Você envia uma imagem cuja estética quer reproduzir e pede que a paleta, textura ou linguagem visual seja aplicada a outra imagem ou a uma cena descrita em texto.

Referência de composição. Você envia um esboço, uma foto mal tirada ou um rascunho e pede que ele seja transformado em imagem acabada mantendo o arranjo dos elementos.

Vale um cuidado prático: quanto mais limpa a referência, melhor o resultado. Imagens com fundo bagunçado fazem o modelo carregar elementos do cenário sem que você tenha pedido. Se a sua referência tiver esse problema, remover o fundo antes de enviar melhora bastante o resultado.

Texto e infográficos

Renderização de texto legível é um dos avanços mais visíveis desta geração de modelos, e é justamente onde o Nano Banana Pro se justifica. Cartaz com título e subtítulo, infográfico com rótulos, diagrama a partir de anotações, capa com nome de marca — tudo isso saía torto até pouco tempo atrás e hoje sai limpo na maior parte das tentativas.

Três coisas melhoram muito o resultado com texto:

Ainda assim, para peças em que a tipografia precisa ser a da marca, o caminho mais confiável continua sendo gerar a imagem sem texto e adicionar o texto depois, com a fonte certa.

Oito pedidos prontos para o dia a dia

Modelos que cobrem as necessidades mais comuns. Troque o que estiver entre colchetes e mantenha o resto.

Imagem de topo para artigo

Crie uma imagem horizontal widescreen sobre [tema], com composição limpa, um elemento central em foco e o lado esquerdo mais vazio para receber texto. Iluminação natural suave, paleta em tons de [cor] e neutros, sem nenhum texto na imagem.

Post quadrado para rede social

Crie uma imagem quadrada de [assunto] com estética minimalista, fundo liso em [cor], sombra suave e muito espaço negativo ao redor do objeto. Luz difusa uniforme, alto contraste entre objeto e fundo, sem texto.

Cartaz com título

Crie um cartaz vertical de divulgação para [evento]. Título "[texto exato]" em letras grandes no topo e, menor, abaixo: "[texto exato]". Fundo em [cor] com um elemento gráfico simples. Estilo editorial, tipografia sem serifa, muito espaço vazio.

Trocar o fundo de uma foto

Mantenha a pessoa exatamente como está, sem alterar rosto, cabelo nem roupa. Substitua apenas o fundo por [descrição do cenário], preservando a mesma direção de luz que incide sobre ela.

Variação de estilo

Mantenha a mesma composição, os mesmos elementos e o mesmo enquadramento, mas refaça a imagem em estilo [aquarela / ilustração vetorial / fotografia realista], com paleta [descrição].

Mockup de produto

Crie uma foto de produto de [produto] sobre [superfície], fundo [cor] em degradê suave, iluminação de estúdio com softbox lateral, ângulo frontal levemente elevado, reflexo controlado, alta nitidez, sem texto nem rótulo.

Infográfico simples

Crie um infográfico horizontal com três colunas iguais explicando [tema]. Cada coluna tem um ícone simples no topo, um título curto e uma frase de apoio. Os títulos são "[texto]", "[texto]" e "[texto]". Paleta em [duas cores], estilo editorial limpo, sem sombras.

Limpar uma foto

Remova [elemento indesejado] da imagem e complete a área naturalmente, mantendo todo o restante sem alterações, com a mesma iluminação e o mesmo nível de detalhe.

Consistência de personagem no Gemini

Como a edição é conversacional, o método mais eficaz é também o mais simples: permanecer no mesmo fio de conversa. Depois de gerar o personagem, peça as próximas cenas sem redescrevê-lo — "agora mostre o mesmo personagem sentado em um café" — e o contexto acumulado faz o trabalho.

Quando a série for longa ou você precisar retomar em outro dia, use a imagem como referência de sujeito e mantenha uma descrição fixa dos traços permanentes, repetida palavra por palavra. O guia de consistência de personagem com IA detalha os quatro métodos e quando cada um compensa.

Gemini ou ChatGPT: o que muda na prática

AspectoGeminiChatGPT
Estilo de promptProsa conversacionalProsa conversacional
Edição por conversaForte, com boa preservação do originalForte, com boa preservação do original
Múltiplas imagens de entradaPonto forte, incluindo transferência de estiloSuportado
Texto na imagemMuito bom, melhor ainda no modelo ProMuito bom
Escolha de modeloExplícita: Rápido, Raciocínio ou ProInstantâneo ou raciocínio, conforme o plano
Resolução de download1K no gratuito, 2K com planoAté 2K

As duas ferramentas convergiram bastante. O critério prático é testar o mesmo pedido nas duas e comparar — e usar a que entrega melhor no seu tipo de imagem. O guia do ChatGPT para criar imagens cobre o outro lado em detalhe, e o comparativo das melhores IAs para criar imagens coloca as principais opções lado a lado.

O que o Gemini não faz bem

Sete erros que mais atrapalham

  1. Usar o modelo Pro para testar. Gasta cota que faria falta na versão final.
  2. Escrever em formato de tags. Lista de palavras é a linguagem de outras ferramentas; aqui, prosa rende mais.
  3. Não dizer a proporção. Sem indicação, o formato quase nunca é o que você precisa.
  4. Reescrever o prompt a cada tentativa. Você perde o que já tinha acertado. Peça correções pontuais.
  5. Enviar referência com fundo bagunçado. O modelo carrega elementos do cenário sem você pedir.
  6. Salvar por captura de tela. Perde resolução e adiciona recompressão.
  7. Publicar sem otimizar. Imagens em 2K pesam muito e derrubam o carregamento de qualquer página.

Depois de gerar: preparar a imagem

A imagem que sai do Gemini está pronta para ser vista, não para ser publicada. Quatro passos resolvem.

Converter o formato. PNG é ótimo para transparência e ruim para foto na web. Para site, WebP costuma reduzir o peso pela metade sem diferença visível; para envio comum, JPG resolve. O conversor de imagem faz a troca no navegador, e o guia de formatos de imagem ajuda a escolher.

Reduzir o peso. Uma imagem em 2K passa facilmente de vários megabytes. O compressor de imagem corta boa parte disso sem perda visível.

Ajustar tamanho e enquadramento. Para uma medida específica, use o redimensionador; se a proporção saiu diferente do necessário, recortar preserva mais qualidade do que esticar.

Isolar o sujeito quando precisar. Para produtos, logos e elementos que vão sobre fundo colorido, remover o fundo entrega o PNG transparente que a geração não produz.

💡 Ordem que funciona: baixar em resolução cheia → recortar ou redimensionar → converter o formato → comprimir por último. Comprimir antes de redimensionar desperdiça qualidade.

Checklist antes de gerar

Converta suas imagens para o formato certo

Transforme o PNG pesado do Gemini em WebP ou JPG e deixe a imagem pronta para publicar, direto no navegador.

Converter imagem

Perguntas frequentes

O que é Nano Banana e qual a relação com o Gemini?
Nano Banana é o nome da geração de imagens nativa do Gemini — não é um produto separado nem um aplicativo à parte. Hoje existem três modelos na família: o Lite, voltado a velocidade e custo, o Nano Banana 2, que é o generalista padrão desde fevereiro de 2026, e o Nano Banana Pro, de alta fidelidade, indicado para texto denso e layouts complexos. No aplicativo, eles aparecem no menu como Rápido, Raciocínio e Pro.
Dá para criar imagens no Gemini de graça?
Sim, com limitações. O uso gratuito tem cota diária de geração e o download sai em resolução 1K. Com plano pago do Google com IA, o download passa a 2K e fica disponível a opção de refazer a imagem no Nano Banana Pro. Um detalhe prático que pega muita gente: quando a cota diária do modelo padrão acaba, a refação no Pro também deixa de funcionar, mesmo com plano.
Qual modelo escolher para cada tipo de imagem?
Para a maioria dos casos — cenas, retratos, produtos, ilustrações — o modelo padrão resolve bem. O modelo rápido serve para explorar composições e gerar variações sem gastar cota do mais caro. O Pro compensa quando o pedido envolve texto denso, infográfico, diagrama, cartaz com hierarquia tipográfica ou peça que vai para produção. A estratégia mais econômica é testar no rápido e refazer no Pro só a versão escolhida.
Como editar uma foto minha no Gemini?
Envie a imagem na conversa e descreva a alteração em linguagem natural — trocar o fundo, mudar a iluminação, remover um objeto, aplicar outro estilo. Não é preciso máscara nem seleção. Vale saber que o resultado é uma imagem nova gerada a partir da sua, não uma edição pixel a pixel: a composição é preservada, mas detalhes finos do original mudam. Para alterações que exigem fidelidade absoluta, um editor tradicional continua sendo mais adequado.
Como conseguir fundo transparente?
Mesmo pedindo explicitamente, a imagem costuma vir com fundo sólido em vez de transparência real. O caminho mais rápido é pedir fundo branco liso, que é o mais fácil de recortar, e criar a transparência depois removendo o fundo e salvando em PNG. Insistir com o modelo costuma resultar em um fundo quadriculado desenhado imitando transparência, que não serve para nada.
Posso usar comercialmente as imagens geradas?
As regras dependem do plano, do país e dos termos vigentes do Google, e podem mudar. Além disso, permissão de uso comercial não é o mesmo que proteção legal: em várias jurisdições, obras criadas inteiramente por máquina enfrentam restrições de registro de direitos autorais. Antes de usar em material de cliente ou produto à venda, confira os termos atuais e evite pedidos que envolvam marcas registradas, personagens licenciados ou pessoas reais.