Dos personas usan la misma inteligencia artificial, el mismo día, para generar la misma idea de imagen. Una recibe algo que parece sacado de una revista. La otra recibe un borrón sin gracia, con manos deformes y colores extraños. La diferencia casi nunca está en la herramienta — está en el prompt.
Prompt es el texto que escribes para describir la imagen que quieres. Parece simple, y es justamente por parecer simple que la mayoría de las personas escribe prompts malos: escriben una frase corta, presionan generar, miran el resultado mediocre y concluyen que "la IA no es tan buena". En la práctica, el modelo entregó exactamente lo que se pidió — el pedido era el que estaba vago.
Esta guía muestra la estructura que separa un prompt amateur de un prompt profesional. Verás la anatomía de seis capas que compone cualquier buen prompt, el vocabulario técnico que realmente cambia el resultado, cómo el orden de las palabras afecta lo que la IA prioriza, cómo adaptar el mismo prompt entre herramientas distintas y qué errores destruyen imágenes antes incluso de que empiece la generación. Todo con ejemplos listos para copiar y adaptar.
Por qué la mayoría de los prompts genera imágenes genéricas
Los modelos de generación de imagen aprendieron a partir de cientos de millones de imágenes acompañadas de descripciones. Cuando escribes "un perro", el modelo no tiene ninguna pista sobre cuál de los millones de fotos de perro que vio debe servir de referencia. Hace lo que cualquier sistema estadístico haría: entrega el promedio. Y el promedio de todo es justamente lo que llamamos genérico.
Un prompt vago no se interpreta como libertad creativa. Se interpreta como ausencia de información, y la ausencia de información se rellena con los clichés más frecuentes del conjunto de entrenamiento: encuadre centrado, luz neutra, fondo desenfocado, composición previsible. Por eso los prompts cortos suelen producir imágenes que parecen banco de imágenes barato.
El camino opuesto también tiene trampa. Prompts con ochenta palabras apiladas, llenos de adjetivos contradictorios, hacen que el modelo diluya la atención entre demasiados conceptos y no ejecute ninguno bien. El punto ideal está en el medio: descripción específica, organizada en capas, sin repetición y sin contradicción.
💡 Regla práctica: si tu prompt pudiera describir mil imágenes distintas, es demasiado vago. Si no puedes explicar por qué cada palabra está ahí, es demasiado largo.
La anatomía de un prompt que funciona: las 6 capas
Prácticamente todo prompt de alta calidad — en cualquier herramienta — puede descomponerse en seis capas. No necesitas usar todas en cada imagen, pero cuantas más capas llenes conscientemente, menos espacio le queda a la IA para elegir por ti.
1. Sujeto — qué aparece en la imagen
Es el núcleo del prompt y la parte que más gente escribe mal, porque escribe poco. "Una mujer" es sujeto. "Una mujer de mediana edad, cabello canoso recogido en moño, bata blanca de laboratorio" también es sujeto, y la diferencia de resultado es abismal. Describe edad aproximada, ropa, rasgos marcados, expresión y postura. Si hay más de un elemento, define la relación entre ellos: quién está adelante, quién está al fondo, quién interactúa con qué.
2. Acción y composición — qué está pasando y cómo está encuadrado
Aquí dices qué hace el sujeto y desde qué ángulo vemos la escena. Términos como plano cerrado, plano medio, plano americano, vista aérea, contrapicado, primer plano extremo, encuadre simétrico o regla de los tercios cambian por completo la lectura de la imagen. Sin esta capa, la IA casi siempre entrega un plano medio frontal y centrado.
3. Ambiente — dónde ocurre la escena
Escenario, época, clima y contexto. "En una cocina" es débil. "En una cocina industrial de acero inoxidable, ollas colgadas al fondo, vapor subiendo" crea profundidad y le da al modelo material para llenar el segundo plano con coherencia. El ambiente también carga información implícita de luz y paleta, lo que ayuda al resto del prompt.
4. Iluminación — la capa más subestimada
Si aprendes solo una cosa de esta guía, que sea esta: la iluminación es lo que hace que una imagen parezca profesional. Luz natural suave, luz de ventana lateral, hora dorada, hora azul, luz dura de mediodía, contraluz, luz de neón, iluminación de estudio con softbox, luz rembrandt, luz volumétrica atravesando polvo. Cada uno de estos términos activa todo un repertorio visual dentro del modelo. Los prompts sin descripción de luz reciben iluminación plana y sin personalidad.
5. Estilo — el lenguaje visual
Fotografía realista, ilustración vectorial, acuarela, pintura al óleo, arte conceptual, pixel art, render 3D, estilo editorial, minimalismo escandinavo, cyberpunk, anime. Esta capa define el "idioma" de la imagen. Un error clásico es mezclar estilos incompatibles en el mismo prompt — pedir acuarela y render 3D fotorrealista al mismo tiempo produce un híbrido feo, porque el modelo intenta satisfacer ambos.
6. Técnica — detalles de cámara, material y acabado
Es la capa que empuja el resultado al nivel profesional en imágenes realistas: lente 85mm, f/1.8, profundidad de campo poco profunda, alta resolución, textura de película 35mm, granulado sutil, colores calibrados. Para ilustraciones, la capa equivalente describe trazo, grosor de línea, textura de papel y paleta.
Del prompt débil al prompt fuerte: cinco transformaciones
La teoría queda clara cuando ves el antes y el después. En cada par a continuación, el segundo prompt usa exactamente las capas descritas arriba.
Retrato profesional
Foto de producto
Ilustración
Arquitectura e interiores
Escena cinematográfica
El orden de las palabras cambia lo que la IA prioriza
En prácticamente todos los modelos de imagen, los términos escritos al principio del prompt reciben más peso que los del final. Esto significa que el orden no es decorativo: es una forma de control.
La secuencia más confiable es empezar por el sujeto, seguir con acción y composición, luego ambiente, iluminación, estilo y, por último, los detalles técnicos. Si el elemento más importante de tu imagen es el escenario — un paisaje, por ejemplo — invierte y empieza por él. El principio es simple: lo que viene primero es lo que la IA intenta acertar primero.
Otro efecto práctico del orden es la dilución. Cuanto más largo el prompt, menos peso relativo carga cada palabra individual. Un prompt de 25 palabras bien elegidas suele rendir más que uno de 90 palabras, porque en las 90 la IA distribuye la atención entre conceptos que compiten entre sí.
💡 Prueba de diagnóstico: si un elemento importante no apareció en la imagen, muévelo al inicio del prompt antes de intentar cualquier otra cosa. La mayoría de las veces esto lo resuelve.
Vocabulario técnico que realmente cambia el resultado
Existe una diferencia enorme entre adjetivos genéricos y términos técnicos. Palabras como "bonito", "increíble", "de alta calidad" u "obra maestra" casi no afectan la imagen, porque no corresponden a ningún patrón visual concreto en el entrenamiento. En cambio, los términos usados por fotógrafos, ilustradores y directores de arte funcionan como atajos precisos.
| Objetivo | En vez de escribir | Escribe |
|---|---|---|
| Fondo desenfocado | fondo bonito | profundidad de campo poco profunda, f/1.4, bokeh suave |
| Luz suave y favorecedora | buena iluminación | luz natural difusa de ventana, hora dorada |
| Apariencia de cine | estilo película | estética cinematográfica, granulado 35mm, colores desaturados (50 prompts) |
| Imagen limpia de producto | foto profesional | iluminación de estudio, softbox lateral, fondo infinito blanco |
| Sensación de altura | desde arriba | vista aérea, plano cenital, dron a 40 metros |
| Personaje imponente | que se vea fuerte | contrapicado, ángulo bajo, silueta contra el cielo |
| Ilustración con trazo visible | dibujo tierno | trazo a lápiz visible, textura de papel, acuarela |
| Imagen nítida y detallada | alta calidad | alta resolución, foco nítido en los ojos, microdetalle de textura |
El patrón es siempre el mismo: sustituir juicio por descripción. La IA no sabe qué te parece bonito, pero sabe muy bien qué es una lente de 85mm con apertura amplia.
Prompts negativos: decir lo que no quieres
Buena parte de los problemas en imágenes de IA no se resuelve agregando información, sino quitándola. El prompt negativo es un campo separado (o un parámetro, según la herramienta) donde listas lo que debe evitarse.
Los elementos que más vale la pena poner en un prompt negativo estándar son: manos deformes, dedos extra, miembros duplicados, rostros distorsionados, texto ilegible, marca de agua, firma, marco, baja resolución, desenfoque no deseado, ruido excesivo y anatomía incorrecta. Para imágenes de producto, vale agregar reflejos exagerados, sombras duras y fondo desordenado.
Un detalle importante: el prompt negativo no es lugar para adjetivos vagos. Escribir "feo" o "malo" en el negativo no hace nada. Escribe el defecto concreto que quieres eliminar. Si las manos salieron mal, el negativo es "manos deformes, dedos extra" — no "manos malas".
No toda herramienta tiene campo negativo dedicado. En modelos que trabajan por conversación, como ChatGPT, la alternativa es escribir la restricción dentro del propio pedido, en forma afirmativa siempre que sea posible: en vez de "sin texto", pide "composición limpia, sin ningún elemento tipográfico". Los modelos entienden mejor las instrucciones afirmativas que las negaciones.
Parámetros: proporción, semilla y fuerza del prompt
Además del texto, casi toda herramienta ofrece controles numéricos que influyen tanto como las palabras. Conocer los principales evita mucho retrabajo.
| Parámetro | Qué hace | Cuándo ajustar |
|---|---|---|
| Proporción (aspect ratio) | Define el formato: 1:1, 4:5, 16:9, 9:16, 3:2 | Siempre. Defínela antes de generar, no recortes después |
| Semilla (seed) | Número que fija el punto de partida aleatorio | Cuando quieres variaciones de una imagen que ya salió bien |
| Fuerza del prompt (CFG / guidance) | Cuánto obedece la IA literalmente al texto | Auméntala si ignora detalles; redúcela si la imagen queda dura y artificial |
| Pasos (steps) | Cantidad de refinamientos en la generación | Valores medios suelen bastar; muy alto rara vez compensa el tiempo |
| Fuerza de referencia | Peso de una imagen enviada como base | Al usar imagen de referencia para estilo o composición |
La proporción merece atención especial porque tiene impacto directo en SEO y redes sociales. Generar en 1:1 y recortar después a 9:16 desperdicia píxeles y corta la composición en lugares equivocados. Es mejor generar ya en el formato final. Cuando la proporción esté equivocada pero recortar signifique perder algo importante, el camino es expandir la imagen con IA. Cuando el recorte sea inevitable, usa una herramienta que preserve la calidad — se puede recortar la imagen en línea sin recompresión innecesaria.
Cómo adaptar el mismo prompt entre herramientas distintas
Un prompt escrito para una herramienta rara vez rinde igual en otra. No es que una sea mejor: fueron entrenadas de formas distintas y esperan estilos de instrucción distintos.
| Tipo de herramienta | Cómo prefiere recibir el prompt | Ajuste recomendado |
|---|---|---|
| Modelos conversacionales | Frases naturales y completas, como si le explicaras a un diseñador | Escribe en prosa, puedes pedir correcciones en medio de la conversación (guía de ChatGPT) |
| Modelos por descripción densa | Lista de términos separados por comas, del más importante al menos | Corta artículos y conectores, mantén solo los términos que cargan imagen |
| Modelos con buen control de texto | Instrucción directa con el texto entre comillas | Especifica la tipografía y la posición del texto en la imagen |
| Modelos abiertos y locales | Términos densos + prompt negativo separado | Usa bastante el campo negativo, es donde está la mayor ganancia |
En la práctica, mantén una versión "maestra" del prompt en prosa y una versión condensada en términos separados por comas. Alternar entre las dos cubre casi todas las herramientas disponibles hoy. Si todavía estás eligiendo cuál usar, vale comparar las opciones en nuestra guía de las mejores IAs para crear imágenes.
Prompts por tipo de imagen: qué priorizar en cada caso
Retratos y fotos de personas
Prioriza iluminación y lente. La combinación de luz suave lateral con profundidad de campo poco profunda resuelve la mayor parte del trabajo. Describe la expresión facial en vez de emociones abstractas: "sonrisa discreta, mirada directa a la cámara" funciona mejor que "feliz". Evita pedir muchas personas en la misma escena — la tasa de error en rostros crece rápido con la cantidad. Tenemos 50 prompts de retrato con los esquemas de iluminación listos.
Productos y e-commerce
Prioriza fondo, material y reflejo. Describe la superficie donde está apoyado el producto, el tipo de fondo y la dirección de la luz. Fondo blanco infinito con softbox lateral es el estándar de marketplace — tenemos 50 prompts para foto de producto listos. Después de generar, casi siempre vas a necesitar aislar el objeto — la forma más rápida es eliminar el fondo automáticamente y guardar en PNG con transparencia.
Logos e identidad visual
Prioriza simplicidad y forma. Los logos piden prompts cortos, lo contrario del resto: describe el símbolo, el número de colores, el estilo (geométrico, orgánico, de una sola línea) y pide fondo neutro. Demasiados adjetivos producen símbolos saturados e imposibles de reducir. Las ilustraciones complejas no funcionan como marca porque desaparecen en tamaños pequeños. Tenemos 50 prompts de IA para crear logo organizados por segmento de negocio.
Arquitectura e interiores
Prioriza materiales y horario — tenemos 50 prompts de arquitectura e interiores armados así. Nombrar materiales reales — concreto aparente, roble claro, lino, latón cepillado — da mucho más realismo que adjetivos de estilo. El horario define la luz y, con ella, todo el ambiente: el atardecer produce imágenes cálidas y acogedoras, el mediodía produce imágenes duras y frías.
Personajes e ilustración
Prioriza la consistencia. Describe rasgos fijos que deben repetirse entre imágenes: color y forma de cabello, color de ojos, ropa característica, cicatriz, accesorio distintivo. Reutiliza exactamente la misma descripción en todos los prompts de la serie y fija la semilla cuando la herramienta lo permita — así es como se mantiene el mismo personaje en escenas distintas. La guía de consistencia de personaje con IA detalla los cuatro métodos.
Fondos de pantalla e imágenes de fondo
Prioriza proporción y espacio negativo. Genera directo en 9:16 para móvil o 16:9 para escritorio y pide un área limpia donde vayan a quedar íconos y reloj — tenemos 50 prompts para fondos de pantalla ya armados así. Después, ajustar las dimensiones exactas de tu dispositivo es cuestión de redimensionar la imagen a la resolución correcta.
Los ocho errores que más arruinan prompts
- Apilar adjetivos vacíos. "Increíble, hermoso, obra maestra, 8K, ultra detallado" ocupa espacio en el prompt sin aportar ninguna información visual concreta.
- Mezclar estilos incompatibles. Acuarela con render 3D fotorrealista, o pixel art con fotografía — el modelo intenta satisfacer ambos y no entrega ninguno.
- Describir emociones en vez de apariencia. La IA no sabe dibujar "nostalgia"; sabe dibujar luz cálida, grano de película y colores desteñidos.
- Ignorar la iluminación. Es el error más común y el más costoso. Sin luz descrita, la imagen sale plana.
- Pedir texto dentro de la imagen sin especificar. Si el texto importa, escríbelo entre comillas y di dónde va y en qué tipografía.
- Prompts demasiado largos. Por encima de unas 60 palabras, cada término nuevo debilita a los anteriores.
- No usar prompt negativo. La mitad de los defectos recurrentes desaparece con una lista negativa bien armada.
- Generar en la proporción equivocada. Recortar después destruye la composición y desperdicia resolución.
El método de las tres rondas para refinar un prompt
Un buen prompt rara vez nace listo. El error de quien empieza es reescribir todo desde cero en cada intento, lo que impide descubrir qué funcionó. El método a continuación aísla una variable a la vez.
Ronda 1 — estructura. Escribe el prompt con las seis capas, genera cuatro imágenes y evalúa solo una cosa: ¿la composición está bien? ¿El sujeto, el encuadre y el escenario corresponden a lo que imaginaste? Si no, ajusta solo sujeto y composición, sin tocar estilo ni luz.
Ronda 2 — ambiente. Con la composición resuelta, ajusta iluminación, paleta y estilo. Cambia un elemento por generación. Cambiar "luz natural difusa" por "contraluz de atardecer" y ver el efecto aislado enseña más que diez intentos aleatorios.
Ronda 3 — acabado. Ahora entran los detalles técnicos, el prompt negativo y, si la herramienta lo permite, la fijación de la semilla para generar variaciones de la imagen que salió bien. También es aquí donde corriges defectos puntuales con edición, en vez de generar todo de nuevo.
💡 Guarda los prompts que funcionaron. Un archivo simple con tus mejores prompts, organizados por tipo de imagen, ahorra más tiempo que cualquier truco aislado. Si quieres un punto de partida, tenemos 100 prompts de IA listos para copiar, divididos en 12 categorías. Los buenos prompts son reutilizables con pequeños cambios de sujeto.
Qué hacer con la imagen después de generarla
Generar es la mitad del trabajo. La imagen que sale de una IA casi nunca está lista para publicación: suele venir demasiado pesada para la web, en el formato equivocado y sin los ajustes finales.
Tres pasos resuelven la mayor parte de los casos. Primero, conviértela al formato adecuado para el destino — WebP para sitio web, PNG cuando haya transparencia, JPG para envío común. Nuestro conversor de imagen hace esto directo en el navegador. Segundo, reduce el peso del archivo: las imágenes de IA en alta resolución fácilmente superan los 5 MB, lo que frena el tiempo de carga de cualquier página; el compresor de imagen recorta buena parte de eso sin diferencia visible. Tercero, si la generación salió levemente suave en los bordes, vale mejorar la nitidez de la imagen antes de publicar.
Para contenido visual de marca, todavía hay un paso extra que casi nadie hace: extraer la paleta de colores de la imagen generada y reutilizarla en el resto del material. Esto mantiene coherencia visual entre imágenes creadas en sesiones distintas.
Checklist del prompt antes de generar
- ¿El sujeto está descrito con al menos tres atributos concretos?
- ¿Hay indicación de encuadre o ángulo?
- ¿El ambiente fue descrito, y no solo nombrado?
- ¿Existe una descripción explícita de iluminación?
- ¿El estilo visual está declarado, sin mezclar lenguajes incompatibles?
- ¿Los detalles técnicos están al final, no al principio?
- ¿El prompt tiene menos de 60 palabras?
- ¿Hay un prompt negativo con defectos concretos?
- ¿La proporción fue definida antes de generar?
- ¿Puedes justificar la presencia de cada palabra?
Si todas las respuestas son sí, la probabilidad de que la primera generación ya salga aprovechable es alta. Y cuando no salga, sabrás exactamente qué capa ajustar — que es justamente lo que separa a quien usa IA por suerte de quien la usa por método.
Pon la teoría en práctica ahora
Describe tu marca en pocas palabras y mira cómo un prompt bien estructurado se convierte en un logo profesional en segundos, directo en el navegador.
Crear logo con IA