Duas pessoas usam a mesma inteligência artificial, no mesmo dia, para gerar a mesma ideia de imagem. Uma recebe algo que parece saído de uma revista. A outra recebe um borrão sem graça, com mãos deformadas e cores estranhas. A diferença quase nunca está na ferramenta — está no prompt.

Prompt é o texto que você escreve para descrever a imagem que quer. Parece simples, e é justamente por parecer simples que a maioria das pessoas escreve prompts ruins: elas digitam uma frase curta, apertam gerar, olham o resultado medíocre e concluem que "a IA não é tão boa assim". Na prática, o modelo entregou exatamente o que foi pedido — o pedido é que era vago.

Este guia mostra a estrutura que separa um prompt amador de um prompt profissional. Você vai ver a anatomia de seis camadas que compõe qualquer bom prompt, o vocabulário técnico que realmente muda o resultado, como a ordem das palavras afeta o que a IA prioriza, como adaptar o mesmo prompt entre ferramentas diferentes e quais erros destroem imagens antes mesmo de a geração começar. Tudo com exemplos prontos para copiar e adaptar.

Por que a maioria dos prompts gera imagens genéricas

Modelos de geração de imagem aprenderam a partir de centenas de milhões de imagens acompanhadas de descrições. Quando você escreve "um cachorro", o modelo não tem nenhuma pista sobre qual das milhões de fotos de cachorro que ele viu deve servir de referência. Ele faz o que qualquer sistema estatístico faria: entrega a média. E a média de tudo é justamente o que chamamos de genérico.

Um prompt vago não é interpretado como liberdade criativa. Ele é interpretado como ausência de informação, e a ausência de informação é preenchida com os clichês mais frequentes do conjunto de treinamento: enquadramento centralizado, luz neutra, fundo desfocado, composição previsível. É por isso que prompts curtos costumam produzir imagens que parecem banco de imagens barato.

O caminho oposto também tem armadilha. Prompts com oitenta palavras empilhadas, cheios de adjetivos contraditórios, fazem o modelo diluir a atenção entre conceitos demais e não executar nenhum direito. O ponto ideal fica no meio: descrição específica, organizada em camadas, sem repetição e sem contradição.

💡 Regra prática: se o seu prompt pudesse descrever mil imagens diferentes, ele é vago demais. Se você não consegue explicar por que cada palavra está ali, ele é longo demais.

A anatomia de um prompt que funciona: as 6 camadas

Praticamente todo prompt de alta qualidade — em qualquer ferramenta — pode ser decomposto em seis camadas. Você não precisa usar todas em toda imagem, mas quanto mais camadas você preenche conscientemente, menos espaço sobra para a IA escolher por você.

1. Sujeito — o que aparece na imagem

É o núcleo do prompt e a parte que mais gente escreve mal, porque escreve pouco. "Uma mulher" é sujeito. "Uma mulher de meia-idade, cabelo grisalho preso em coque, jaleco branco de laboratório" também é sujeito, e a diferença de resultado é abissal. Descreva idade aproximada, roupa, traços marcantes, expressão e postura. Se houver mais de um elemento, defina a relação entre eles: quem está na frente, quem está ao fundo, quem interage com o quê.

2. Ação e composição — o que está acontecendo e como está enquadrado

Aqui você diz o que o sujeito faz e de que ângulo vemos a cena. Termos como plano fechado, plano médio, plano americano, vista aérea, contra-plongée, close extremo, enquadramento simétrico ou regra dos terços mudam completamente a leitura da imagem. Sem essa camada, a IA quase sempre entrega um plano médio frontal e centralizado.

3. Ambiente — onde a cena acontece

Cenário, época, clima e contexto. "Em uma cozinha" é fraco. "Em uma cozinha industrial de aço inox, panelas penduradas ao fundo, vapor subindo" cria profundidade e dá ao modelo material para preencher o segundo plano com coerência. O ambiente também carrega informação implícita de luz e paleta, o que ajuda o resto do prompt.

4. Iluminação — a camada mais subestimada

Se você aprender apenas uma coisa deste guia, aprenda esta: iluminação é o que faz uma imagem parecer profissional. Luz natural suave, luz de janela lateral, hora dourada, hora azul, luz dura de meio-dia, contraluz, luz de neon, iluminação de estúdio com softbox, luz rembrandt, luz volumétrica atravessando poeira. Cada termo desses ativa um repertório visual inteiro dentro do modelo. Prompts sem descrição de luz recebem iluminação plana e sem personalidade.

5. Estilo — a linguagem visual

Fotografia realista, ilustração vetorial, aquarela, pintura a óleo, arte conceitual, pixel art, render 3D, estilo editorial, minimalismo escandinavo, cyberpunk, anime. Esta camada define o "idioma" da imagem. Um erro clássico é misturar estilos incompatíveis no mesmo prompt — pedir aquarela e render 3D fotorrealista ao mesmo tempo produz um híbrido feio, porque o modelo tenta atender aos dois.

6. Técnica — detalhes de câmera, material e acabamento

É a camada que empurra o resultado para o nível profissional em imagens realistas: lente 85mm, f/1.8, profundidade de campo rasa, alta resolução, textura de filme 35mm, granulação sutil, cores calibradas. Para ilustrações, a camada equivalente descreve traço, espessura de linha, textura de papel e paleta.

Do prompt fraco ao prompt forte: cinco transformações

A teoria fica clara quando você vê o antes e o depois. Em cada par abaixo, o segundo prompt usa exatamente as camadas descritas acima.

Retrato profissional

❌ foto de um homem de terno
✅ Retrato corporativo de um homem de 40 anos, terno azul-marinho bem cortado, camisa branca sem gravata, expressão confiante e relaxada, plano médio, fundo de escritório desfocado com janelas amplas, luz natural lateral suave vindo da esquerda, lente 85mm f/1.8, profundidade de campo rasa, fotografia editorial de alta resolução

Foto de produto

❌ um perfume bonito
✅ Frasco de perfume de vidro âmbar com tampa dourada sobre superfície de mármore branco, gotas de água na superfície, fundo cinza-claro degradê, iluminação de estúdio com softbox lateral e rebatedor, reflexo suave na base, close frontal levemente elevado, fotografia publicitária de produto, ultra nítida

Ilustração

❌ desenho de uma raposa
✅ Ilustração de uma raposa vermelha sentada em uma clareira de floresta outonal, folhas caindo ao redor, estilo de livro infantil em aquarela, traço leve a lápis visível, paleta quente de laranjas e ocres, luz filtrada entre as árvores, composição centralizada com espaço negativo acima

Arquitetura e interiores

❌ sala de estar moderna
✅ Sala de estar minimalista escandinava, sofá de linho bege, mesa de centro de carvalho claro, tapete de lã texturizado, planta grande no canto, parede de concreto aparente, janela do chão ao teto à direita, luz natural difusa de fim de tarde, render arquitetônico fotorrealista, plano amplo na altura dos olhos

Cena cinematográfica

✅ Mulher de casaco longo caminhando sozinha por uma rua molhada à noite, reflexos de neon vermelho e azul no asfalto, neblina baixa, silhueta em contraluz, plano aberto com ponto de fuga central, estética cinematográfica anos 80, granulação de filme, cores dessaturadas com realces saturados

A ordem das palavras muda o que a IA prioriza

Em praticamente todos os modelos de imagem, os termos escritos no começo do prompt recebem mais peso do que os do final. Isso significa que a ordem não é decorativa: ela é uma forma de controle.

A sequência mais confiável é começar pelo sujeito, seguir para ação e composição, depois ambiente, iluminação, estilo e, por último, os detalhes técnicos. Se o elemento mais importante da sua imagem for o cenário — uma paisagem, por exemplo — inverta e comece por ele. O princípio é simples: o que vem primeiro é o que a IA tenta acertar primeiro.

Outro efeito prático da ordem é a diluição. Quanto mais longo o prompt, menos peso relativo cada palavra individual carrega. Um prompt de 25 palavras bem escolhidas costuma render mais do que um de 90 palavras, porque nos 90 a IA distribui atenção entre conceitos que competem entre si.

💡 Teste de diagnóstico: se um elemento importante não apareceu na imagem, mova-o para o início do prompt antes de tentar qualquer outra coisa. Na maioria das vezes isso resolve.

Vocabulário técnico que realmente muda o resultado

Existe uma diferença enorme entre adjetivos genéricos e termos técnicos. Palavras como "bonito", "incrível", "de alta qualidade" ou "obra-prima" quase não afetam a imagem, porque não correspondem a nenhum padrão visual concreto no treinamento. Já termos usados por fotógrafos, ilustradores e diretores de arte funcionam como atalhos precisos.

ObjetivoEm vez de escreverEscreva
Fundo desfocadofundo bonitoprofundidade de campo rasa, f/1.4, bokeh suave
Luz suave e lisonjeiraboa iluminaçãoluz natural difusa de janela, hora dourada
Aparência de cinemaestilo filmeestética cinematográfica, granulação 35mm, cores dessaturadas (50 prompts)
Imagem limpa de produtofoto profissionaliluminação de estúdio, softbox lateral, fundo infinito branco
Sensação de alturade cimavista aérea, plano zenital, drone a 40 metros
Personagem imponenteparecendo fortecontra-plongée, ângulo baixo, silhueta contra o céu
Ilustração com traço visíveldesenho fofotraço a lápis visível, textura de papel, aquarela
Imagem nítida e detalhadaalta qualidadealta resolução, foco nítido nos olhos, microdetalhe de textura

O padrão é sempre o mesmo: substituir julgamento por descrição. A IA não sabe o que você considera bonito, mas sabe muito bem o que é uma lente de 85mm com abertura ampla.

Prompts negativos: dizer o que você não quer

Boa parte dos problemas em imagens de IA não se resolve adicionando informação, e sim removendo. O prompt negativo é um campo separado (ou um parâmetro, dependendo da ferramenta) onde você lista o que deve ser evitado.

Os itens que mais compensam colocar em um prompt negativo padrão são: mãos deformadas, dedos extras, membros duplicados, rostos distorcidos, texto ilegível, marca d'água, assinatura, moldura, baixa resolução, desfoque indesejado, ruído excessivo e anatomia incorreta. Para imagens de produto, vale acrescentar reflexos exagerados, sombras duras e fundo bagunçado.

Um detalhe importante: prompt negativo não é lugar para adjetivos vagos. Escrever "feio" ou "ruim" no negativo não faz nada. Escreva o defeito concreto que você quer eliminar. Se as mãos saíram erradas, o negativo é "mãos deformadas, dedos extras" — não "mãos ruins".

Nem toda ferramenta tem campo negativo dedicado. Em modelos que trabalham por conversa, como o ChatGPT, a alternativa é escrever a restrição dentro do próprio pedido, em forma afirmativa sempre que possível: em vez de "sem texto", peça "composição limpa, sem nenhum elemento tipográfico". Modelos entendem melhor instruções afirmativas do que negações.

Parâmetros: proporção, semente e força do prompt

Além do texto, quase toda ferramenta oferece controles numéricos que influenciam tanto quanto as palavras. Conhecer os principais evita muito retrabalho.

ParâmetroO que fazQuando ajustar
Proporção (aspect ratio)Define o formato: 1:1, 4:5, 16:9, 9:16, 3:2Sempre. Defina antes de gerar, não recorte depois
Semente (seed)Número que fixa o ponto de partida aleatórioQuando você quer variações de uma imagem que já ficou boa
Força do prompt (CFG / guidance)O quanto a IA obedece literalmente ao textoAumente se ela ignorar detalhes; reduza se a imagem ficar dura e artificial
Passos (steps)Quantidade de refinamentos na geraçãoValores médios costumam bastar; muito alto raramente compensa o tempo
Força de referênciaPeso de uma imagem enviada como baseAo usar imagem de referência para estilo ou composição

A proporção merece atenção especial porque tem impacto direto em SEO e redes sociais. Gerar em 1:1 e recortar depois para 9:16 desperdiça pixels e corta a composição em lugares errados. É melhor gerar já no formato final. Quando a proporção estiver errada mas cortar significar perder algo importante, o caminho é expandir a imagem com IA. Quando o recorte for inevitável, use uma ferramenta que preserve a qualidade — dá para recortar a imagem online sem recompressão desnecessária.

Como adaptar o mesmo prompt entre ferramentas diferentes

Um prompt escrito para uma ferramenta raramente rende igual em outra. Não é que uma seja melhor: elas foram treinadas de formas diferentes e esperam estilos de instrução diferentes.

Tipo de ferramentaComo ela prefere receber o promptAjuste recomendado
Modelos conversacionaisFrases naturais e completas, como se você explicasse a um designerEscreva em prosa, pode pedir correções no meio da conversa (guia do ChatGPT)
Modelos por descrição densaLista de termos separados por vírgula, do mais importante ao menosCorte artigos e conectivos, mantenha só os termos que carregam imagem
Modelos com bom controle de textoInstrução direta com o texto entre aspasEspecifique a tipografia e a posição do texto na imagem
Modelos abertos e locaisTermos densos + prompt negativo separadoUse bastante o campo negativo, é onde está o maior ganho

Na prática, mantenha uma versão "mestra" do prompt em prosa e uma versão condensada em termos separados por vírgula. Alternar entre as duas cobre quase todas as ferramentas disponíveis hoje. Se você ainda está escolhendo qual usar, vale comparar as opções no nosso guia das melhores IAs para criar imagens.

Prompts por tipo de imagem: o que priorizar em cada caso

Retratos e fotos de pessoas

Priorize iluminação e lente. A combinação de luz suave lateral com profundidade de campo rasa resolve a maior parte do trabalho. Descreva a expressão facial em vez de emoções abstratas: "sorriso discreto, olhar direto para a câmera" funciona melhor do que "feliz". Evite pedir muitas pessoas na mesma cena — a taxa de erro em rostos cresce rápido com a quantidade. Temos 50 prompts de retrato com os esquemas de iluminação prontos.

Produtos e e-commerce

Priorize fundo, material e reflexo. Descreva a superfície onde o produto está apoiado, o tipo de fundo e a direção da luz. Fundo branco infinito com softbox lateral é o padrão de marketplace — temos 50 prompts para foto de produto prontos. Depois de gerar, quase sempre você vai precisar isolar o objeto — o jeito mais rápido é remover o fundo automaticamente e salvar em PNG com transparência.

Logos e identidade visual

Priorize simplicidade e forma. Logos pedem prompts curtos, o contrário do resto: descreva o símbolo, o número de cores, o estilo (geométrico, orgânico, monolinha) e peça fundo neutro. Adjetivos demais produzem símbolos poluídos e impossíveis de reduzir. Ilustrações complexas não funcionam como marca porque somem em tamanhos pequenos. Temos 50 prompts de IA para criar logo organizados por segmento de negócio.

Arquitetura e interiores

Priorize materiais e horário — temos 50 prompts de arquitetura e interiores montados assim. Nomear materiais reais — concreto aparente, carvalho claro, linho, latão escovado — dá muito mais realismo do que adjetivos de estilo. O horário define a luz e, com ela, todo o clima: fim de tarde produz imagens quentes e convidativas, meio-dia produz imagens duras e frias.

Personagens e ilustração

Priorize consistência. Descreva traços fixos que devem se repetir entre imagens: cor e formato de cabelo, cor dos olhos, roupa característica, cicatriz, acessório marcante. Reaproveite exatamente a mesma descrição em todos os prompts da série e fixe a semente quando a ferramenta permitir — é assim que se mantém o mesmo personagem em cenas diferentes. O guia de consistência de personagem com IA detalha os quatro métodos.

Wallpapers e imagens de fundo

Priorize proporção e espaço negativo. Gere direto em 9:16 para celular ou 16:9 para desktop e peça uma área limpa onde ícones e relógio vão ficar — temos 50 prompts para wallpaper já montados assim. Depois, ajustar as dimensões exatas do seu aparelho é questão de redimensionar a imagem para a resolução certa.

Os oito erros que mais estragam prompts

  1. Empilhar adjetivos vazios. "Incrível, lindo, obra-prima, 8K, ultra detalhado" ocupa espaço no prompt sem trazer nenhuma informação visual concreta.
  2. Misturar estilos incompatíveis. Aquarela com render 3D fotorrealista, ou pixel art com fotografia — o modelo tenta atender aos dois e não entrega nenhum.
  3. Descrever emoções em vez de aparência. A IA não sabe desenhar "nostalgia"; ela sabe desenhar luz quente, grão de filme e cores desbotadas.
  4. Ignorar a iluminação. É o erro mais comum e o mais caro. Sem luz descrita, a imagem sai plana.
  5. Pedir texto dentro da imagem sem especificar. Se o texto importa, escreva-o entre aspas e diga onde ele fica e em que tipografia.
  6. Prompts longos demais. Acima de cerca de 60 palavras, cada termo novo enfraquece os anteriores.
  7. Não usar prompt negativo. Metade dos defeitos recorrentes desaparece com uma lista negativa bem montada.
  8. Gerar na proporção errada. Recortar depois destrói composição e desperdiça resolução.

O método das três rodadas para refinar um prompt

Prompt bom raramente nasce pronto. O erro de quem está começando é reescrever tudo do zero a cada tentativa, o que impede descobrir o que funcionou. O método abaixo isola uma variável por vez.

Rodada 1 — estrutura. Escreva o prompt com as seis camadas, gere quatro imagens e avalie só uma coisa: a composição está certa? O sujeito, o enquadramento e o cenário correspondem ao que você imaginou? Se não, ajuste apenas sujeito e composição, sem mexer em estilo ou luz.

Rodada 2 — clima. Com a composição resolvida, ajuste iluminação, paleta e estilo. Mude um elemento por geração. Trocar "luz natural difusa" por "contraluz de fim de tarde" e ver o efeito isolado ensina mais do que dez tentativas aleatórias.

Rodada 3 — acabamento. Agora entram os detalhes técnicos, o prompt negativo e, se a ferramenta permitir, a fixação da semente para gerar variações da imagem que ficou boa. É também aqui que você corrige defeitos pontuais com edição, em vez de gerar tudo de novo.

💡 Guarde os prompts que funcionaram. Um arquivo simples com seus melhores prompts, organizados por tipo de imagem, economiza mais tempo do que qualquer truque isolado. Se quiser um ponto de partida, temos 100 prompts de IA prontos para copiar, divididos em 12 categorias. Prompts bons são reutilizáveis com pequenas trocas de sujeito.

O que fazer com a imagem depois de gerar

Gerar é metade do trabalho. A imagem que sai de uma IA quase nunca está pronta para publicação: costuma vir pesada demais para web, no formato errado e sem os ajustes finais.

Três passos resolvem a maior parte dos casos. Primeiro, converta para o formato adequado ao destino — WebP para site, PNG quando houver transparência, JPG para envio comum. Nosso conversor de imagem faz isso direto no navegador. Segundo, reduza o peso do arquivo: imagens de IA em alta resolução passam facilmente de 5 MB, o que derruba o tempo de carregamento de qualquer página; o compressor de imagem corta boa parte disso sem diferença visível. Terceiro, se a geração saiu levemente suave nas bordas, vale melhorar a nitidez da imagem antes de publicar.

Para conteúdo visual de marca, ainda há um passo extra que quase ninguém faz: extrair a paleta de cores da imagem gerada e reaproveitá-la no restante do material. Isso mantém coerência visual entre imagens criadas em sessões diferentes.

Checklist do prompt antes de gerar

Se todas as respostas forem sim, a chance de a primeira geração já sair aproveitável é alta. E quando não sair, você vai saber exatamente qual camada ajustar — que é justamente o que separa quem usa IA por sorte de quem usa por método.

Coloque a teoria em prática agora

Descreva sua marca em poucas palavras e veja como um prompt bem estruturado vira um logo profissional em segundos, direto no navegador.

Criar logo com IA

Perguntas frequentes

Qual o tamanho ideal de um prompt de IA para imagens?
Entre 25 e 60 palavras cobre bem a maioria dos casos. Abaixo disso a IA preenche as lacunas com a média do treinamento e a imagem sai genérica. Acima disso os termos começam a competir entre si e o modelo dilui a atenção, deixando de executar bem qualquer um deles. Logos são a exceção: funcionam melhor com prompts curtos, de 10 a 20 palavras, porque marcas pedem simplicidade de forma.
Preciso escrever prompts em inglês para ter resultado melhor?
Não é mais obrigatório. Os modelos atuais entendem português bem e a diferença de qualidade diminuiu muito. Ainda assim, termos técnicos de fotografia e arte costumam ter representação mais forte em inglês no treinamento, então uma abordagem eficiente é escrever o prompt em português e manter em inglês apenas os termos técnicos específicos, como bokeh, golden hour ou low angle.
Por que a IA erra tanto em mãos e em texto?
Mãos têm enorme variação de pose e são frequentemente parciais ou desfocadas nas fotos de treinamento, o que dificulta o modelo aprender uma estrutura estável. Texto tem problema parecido: o modelo aprende a forma visual das letras, não a escrita em si. Isso melhorou bastante nas versões mais recentes. Enquanto isso, use prompt negativo com "mãos deformadas, dedos extras", evite poses com mãos em destaque e, quando o texto for essencial, escreva-o entre aspas no prompt ou adicione depois com uma ferramenta de edição.
Como manter o mesmo personagem em várias imagens?
Três coisas ajudam, e o ideal é combinar as três. Primeiro, escreva uma descrição fixa do personagem com traços concretos — cor e corte do cabelo, cor dos olhos, roupa característica, acessório marcante — e repita exatamente essa descrição em todos os prompts, sem reescrever com sinônimos. Segundo, fixe a semente quando a ferramenta permitir. Terceiro, use a melhor imagem já gerada como referência visual para as próximas, se a ferramenta aceitar imagem de entrada.
Adjetivos como "8K", "ultra detalhado" e "obra-prima" funcionam?
Funcionavam melhor em modelos antigos, onde serviam como atalho estatístico para imagens bem avaliadas. Nos modelos atuais o efeito é pequeno e às vezes negativo, porque essas palavras ocupam espaço do prompt sem descrever nada visualmente concreto. Substitua por descrições reais do acabamento que você quer: nitidez no ponto de foco, textura de pele visível, granulação de filme, alta resolução com microdetalhe.
Posso usar comercialmente imagens geradas por IA?
Depende dos termos de uso da ferramenta e da legislação do país, e as regras mudam com frequência. Muitas plataformas liberam uso comercial, algumas exigem plano pago para isso, e outras restringem o registro de direitos autorais sobre o resultado. Antes de usar em material de cliente ou produto à venda, leia os termos da ferramenta específica e evite prompts que citem artistas vivos ou marcas registradas pelo nome.