Dos personas usan la misma inteligencia artificial, el mismo día, para generar la misma idea de imagen. Una recibe algo que parece sacado de una revista. La otra recibe un borrón sin gracia, con manos deformes y colores extraños. La diferencia casi nunca está en la herramienta — está en el prompt.

Prompt es el texto que escribes para describir la imagen que quieres. Parece simple, y es justamente por parecer simple que la mayoría de las personas escribe prompts malos: escriben una frase corta, presionan generar, miran el resultado mediocre y concluyen que "la IA no es tan buena". En la práctica, el modelo entregó exactamente lo que se pidió — el pedido era el que estaba vago.

Esta guía muestra la estructura que separa un prompt amateur de un prompt profesional. Verás la anatomía de seis capas que compone cualquier buen prompt, el vocabulario técnico que realmente cambia el resultado, cómo el orden de las palabras afecta lo que la IA prioriza, cómo adaptar el mismo prompt entre herramientas distintas y qué errores destruyen imágenes antes incluso de que empiece la generación. Todo con ejemplos listos para copiar y adaptar.

Por qué la mayoría de los prompts genera imágenes genéricas

Los modelos de generación de imagen aprendieron a partir de cientos de millones de imágenes acompañadas de descripciones. Cuando escribes "un perro", el modelo no tiene ninguna pista sobre cuál de los millones de fotos de perro que vio debe servir de referencia. Hace lo que cualquier sistema estadístico haría: entrega el promedio. Y el promedio de todo es justamente lo que llamamos genérico.

Un prompt vago no se interpreta como libertad creativa. Se interpreta como ausencia de información, y la ausencia de información se rellena con los clichés más frecuentes del conjunto de entrenamiento: encuadre centrado, luz neutra, fondo desenfocado, composición previsible. Por eso los prompts cortos suelen producir imágenes que parecen banco de imágenes barato.

El camino opuesto también tiene trampa. Prompts con ochenta palabras apiladas, llenos de adjetivos contradictorios, hacen que el modelo diluya la atención entre demasiados conceptos y no ejecute ninguno bien. El punto ideal está en el medio: descripción específica, organizada en capas, sin repetición y sin contradicción.

💡 Regla práctica: si tu prompt pudiera describir mil imágenes distintas, es demasiado vago. Si no puedes explicar por qué cada palabra está ahí, es demasiado largo.

La anatomía de un prompt que funciona: las 6 capas

Prácticamente todo prompt de alta calidad — en cualquier herramienta — puede descomponerse en seis capas. No necesitas usar todas en cada imagen, pero cuantas más capas llenes conscientemente, menos espacio le queda a la IA para elegir por ti.

1. Sujeto — qué aparece en la imagen

Es el núcleo del prompt y la parte que más gente escribe mal, porque escribe poco. "Una mujer" es sujeto. "Una mujer de mediana edad, cabello canoso recogido en moño, bata blanca de laboratorio" también es sujeto, y la diferencia de resultado es abismal. Describe edad aproximada, ropa, rasgos marcados, expresión y postura. Si hay más de un elemento, define la relación entre ellos: quién está adelante, quién está al fondo, quién interactúa con qué.

2. Acción y composición — qué está pasando y cómo está encuadrado

Aquí dices qué hace el sujeto y desde qué ángulo vemos la escena. Términos como plano cerrado, plano medio, plano americano, vista aérea, contrapicado, primer plano extremo, encuadre simétrico o regla de los tercios cambian por completo la lectura de la imagen. Sin esta capa, la IA casi siempre entrega un plano medio frontal y centrado.

3. Ambiente — dónde ocurre la escena

Escenario, época, clima y contexto. "En una cocina" es débil. "En una cocina industrial de acero inoxidable, ollas colgadas al fondo, vapor subiendo" crea profundidad y le da al modelo material para llenar el segundo plano con coherencia. El ambiente también carga información implícita de luz y paleta, lo que ayuda al resto del prompt.

4. Iluminación — la capa más subestimada

Si aprendes solo una cosa de esta guía, que sea esta: la iluminación es lo que hace que una imagen parezca profesional. Luz natural suave, luz de ventana lateral, hora dorada, hora azul, luz dura de mediodía, contraluz, luz de neón, iluminación de estudio con softbox, luz rembrandt, luz volumétrica atravesando polvo. Cada uno de estos términos activa todo un repertorio visual dentro del modelo. Los prompts sin descripción de luz reciben iluminación plana y sin personalidad.

5. Estilo — el lenguaje visual

Fotografía realista, ilustración vectorial, acuarela, pintura al óleo, arte conceptual, pixel art, render 3D, estilo editorial, minimalismo escandinavo, cyberpunk, anime. Esta capa define el "idioma" de la imagen. Un error clásico es mezclar estilos incompatibles en el mismo prompt — pedir acuarela y render 3D fotorrealista al mismo tiempo produce un híbrido feo, porque el modelo intenta satisfacer ambos.

6. Técnica — detalles de cámara, material y acabado

Es la capa que empuja el resultado al nivel profesional en imágenes realistas: lente 85mm, f/1.8, profundidad de campo poco profunda, alta resolución, textura de película 35mm, granulado sutil, colores calibrados. Para ilustraciones, la capa equivalente describe trazo, grosor de línea, textura de papel y paleta.

Del prompt débil al prompt fuerte: cinco transformaciones

La teoría queda clara cuando ves el antes y el después. En cada par a continuación, el segundo prompt usa exactamente las capas descritas arriba.

Retrato profesional

❌ foto de un hombre con traje
✅ Retrato corporativo de un hombre de 40 años, traje azul marino bien cortado, camisa blanca sin corbata, expresión confiada y relajada, plano medio, fondo de oficina desenfocado con ventanales amplios, luz natural lateral suave que viene de la izquierda, lente 85mm f/1.8, profundidad de campo poco profunda, fotografía editorial de alta resolución

Foto de producto

❌ un perfume bonito
✅ Frasco de perfume de vidrio ámbar con tapa dorada sobre superficie de mármol blanco, gotas de agua en la superficie, fondo gris claro degradado, iluminación de estudio con softbox lateral y reflector, reflejo suave en la base, primer plano frontal levemente elevado, fotografía publicitaria de producto, ultra nítida

Ilustración

❌ dibujo de un zorro
✅ Ilustración de un zorro rojo sentado en un claro de bosque otoñal, hojas cayendo alrededor, estilo de libro infantil en acuarela, trazo suave a lápiz visible, paleta cálida de naranjas y ocres, luz filtrada entre los árboles, composición centrada con espacio negativo arriba

Arquitectura e interiores

❌ sala de estar moderna
✅ Sala de estar minimalista escandinava, sofá de lino beige, mesa de centro de roble claro, alfombra de lana texturizada, planta grande en la esquina, pared de concreto aparente, ventana de piso a techo a la derecha, luz natural difusa de atardecer, render arquitectónico fotorrealista, plano amplio a la altura de los ojos

Escena cinematográfica

✅ Mujer de abrigo largo caminando sola por una calle mojada de noche, reflejos de neón rojo y azul en el asfalto, niebla baja, silueta a contraluz, plano abierto con punto de fuga central, estética cinematográfica años 80, granulado de película, colores desaturados con realces saturados

El orden de las palabras cambia lo que la IA prioriza

En prácticamente todos los modelos de imagen, los términos escritos al principio del prompt reciben más peso que los del final. Esto significa que el orden no es decorativo: es una forma de control.

La secuencia más confiable es empezar por el sujeto, seguir con acción y composición, luego ambiente, iluminación, estilo y, por último, los detalles técnicos. Si el elemento más importante de tu imagen es el escenario — un paisaje, por ejemplo — invierte y empieza por él. El principio es simple: lo que viene primero es lo que la IA intenta acertar primero.

Otro efecto práctico del orden es la dilución. Cuanto más largo el prompt, menos peso relativo carga cada palabra individual. Un prompt de 25 palabras bien elegidas suele rendir más que uno de 90 palabras, porque en las 90 la IA distribuye la atención entre conceptos que compiten entre sí.

💡 Prueba de diagnóstico: si un elemento importante no apareció en la imagen, muévelo al inicio del prompt antes de intentar cualquier otra cosa. La mayoría de las veces esto lo resuelve.

Vocabulario técnico que realmente cambia el resultado

Existe una diferencia enorme entre adjetivos genéricos y términos técnicos. Palabras como "bonito", "increíble", "de alta calidad" u "obra maestra" casi no afectan la imagen, porque no corresponden a ningún patrón visual concreto en el entrenamiento. En cambio, los términos usados por fotógrafos, ilustradores y directores de arte funcionan como atajos precisos.

ObjetivoEn vez de escribirEscribe
Fondo desenfocadofondo bonitoprofundidad de campo poco profunda, f/1.4, bokeh suave
Luz suave y favorecedorabuena iluminaciónluz natural difusa de ventana, hora dorada
Apariencia de cineestilo películaestética cinematográfica, granulado 35mm, colores desaturados (50 prompts)
Imagen limpia de productofoto profesionaliluminación de estudio, softbox lateral, fondo infinito blanco
Sensación de alturadesde arribavista aérea, plano cenital, dron a 40 metros
Personaje imponenteque se vea fuertecontrapicado, ángulo bajo, silueta contra el cielo
Ilustración con trazo visibledibujo tiernotrazo a lápiz visible, textura de papel, acuarela
Imagen nítida y detalladaalta calidadalta resolución, foco nítido en los ojos, microdetalle de textura

El patrón es siempre el mismo: sustituir juicio por descripción. La IA no sabe qué te parece bonito, pero sabe muy bien qué es una lente de 85mm con apertura amplia.

Prompts negativos: decir lo que no quieres

Buena parte de los problemas en imágenes de IA no se resuelve agregando información, sino quitándola. El prompt negativo es un campo separado (o un parámetro, según la herramienta) donde listas lo que debe evitarse.

Los elementos que más vale la pena poner en un prompt negativo estándar son: manos deformes, dedos extra, miembros duplicados, rostros distorsionados, texto ilegible, marca de agua, firma, marco, baja resolución, desenfoque no deseado, ruido excesivo y anatomía incorrecta. Para imágenes de producto, vale agregar reflejos exagerados, sombras duras y fondo desordenado.

Un detalle importante: el prompt negativo no es lugar para adjetivos vagos. Escribir "feo" o "malo" en el negativo no hace nada. Escribe el defecto concreto que quieres eliminar. Si las manos salieron mal, el negativo es "manos deformes, dedos extra" — no "manos malas".

No toda herramienta tiene campo negativo dedicado. En modelos que trabajan por conversación, como ChatGPT, la alternativa es escribir la restricción dentro del propio pedido, en forma afirmativa siempre que sea posible: en vez de "sin texto", pide "composición limpia, sin ningún elemento tipográfico". Los modelos entienden mejor las instrucciones afirmativas que las negaciones.

Parámetros: proporción, semilla y fuerza del prompt

Además del texto, casi toda herramienta ofrece controles numéricos que influyen tanto como las palabras. Conocer los principales evita mucho retrabajo.

ParámetroQué haceCuándo ajustar
Proporción (aspect ratio)Define el formato: 1:1, 4:5, 16:9, 9:16, 3:2Siempre. Defínela antes de generar, no recortes después
Semilla (seed)Número que fija el punto de partida aleatorioCuando quieres variaciones de una imagen que ya salió bien
Fuerza del prompt (CFG / guidance)Cuánto obedece la IA literalmente al textoAuméntala si ignora detalles; redúcela si la imagen queda dura y artificial
Pasos (steps)Cantidad de refinamientos en la generaciónValores medios suelen bastar; muy alto rara vez compensa el tiempo
Fuerza de referenciaPeso de una imagen enviada como baseAl usar imagen de referencia para estilo o composición

La proporción merece atención especial porque tiene impacto directo en SEO y redes sociales. Generar en 1:1 y recortar después a 9:16 desperdicia píxeles y corta la composición en lugares equivocados. Es mejor generar ya en el formato final. Cuando la proporción esté equivocada pero recortar signifique perder algo importante, el camino es expandir la imagen con IA. Cuando el recorte sea inevitable, usa una herramienta que preserve la calidad — se puede recortar la imagen en línea sin recompresión innecesaria.

Cómo adaptar el mismo prompt entre herramientas distintas

Un prompt escrito para una herramienta rara vez rinde igual en otra. No es que una sea mejor: fueron entrenadas de formas distintas y esperan estilos de instrucción distintos.

Tipo de herramientaCómo prefiere recibir el promptAjuste recomendado
Modelos conversacionalesFrases naturales y completas, como si le explicaras a un diseñadorEscribe en prosa, puedes pedir correcciones en medio de la conversación (guía de ChatGPT)
Modelos por descripción densaLista de términos separados por comas, del más importante al menosCorta artículos y conectores, mantén solo los términos que cargan imagen
Modelos con buen control de textoInstrucción directa con el texto entre comillasEspecifica la tipografía y la posición del texto en la imagen
Modelos abiertos y localesTérminos densos + prompt negativo separadoUsa bastante el campo negativo, es donde está la mayor ganancia

En la práctica, mantén una versión "maestra" del prompt en prosa y una versión condensada en términos separados por comas. Alternar entre las dos cubre casi todas las herramientas disponibles hoy. Si todavía estás eligiendo cuál usar, vale comparar las opciones en nuestra guía de las mejores IAs para crear imágenes.

Prompts por tipo de imagen: qué priorizar en cada caso

Retratos y fotos de personas

Prioriza iluminación y lente. La combinación de luz suave lateral con profundidad de campo poco profunda resuelve la mayor parte del trabajo. Describe la expresión facial en vez de emociones abstractas: "sonrisa discreta, mirada directa a la cámara" funciona mejor que "feliz". Evita pedir muchas personas en la misma escena — la tasa de error en rostros crece rápido con la cantidad. Tenemos 50 prompts de retrato con los esquemas de iluminación listos.

Productos y e-commerce

Prioriza fondo, material y reflejo. Describe la superficie donde está apoyado el producto, el tipo de fondo y la dirección de la luz. Fondo blanco infinito con softbox lateral es el estándar de marketplace — tenemos 50 prompts para foto de producto listos. Después de generar, casi siempre vas a necesitar aislar el objeto — la forma más rápida es eliminar el fondo automáticamente y guardar en PNG con transparencia.

Logos e identidad visual

Prioriza simplicidad y forma. Los logos piden prompts cortos, lo contrario del resto: describe el símbolo, el número de colores, el estilo (geométrico, orgánico, de una sola línea) y pide fondo neutro. Demasiados adjetivos producen símbolos saturados e imposibles de reducir. Las ilustraciones complejas no funcionan como marca porque desaparecen en tamaños pequeños. Tenemos 50 prompts de IA para crear logo organizados por segmento de negocio.

Arquitectura e interiores

Prioriza materiales y horario — tenemos 50 prompts de arquitectura e interiores armados así. Nombrar materiales reales — concreto aparente, roble claro, lino, latón cepillado — da mucho más realismo que adjetivos de estilo. El horario define la luz y, con ella, todo el ambiente: el atardecer produce imágenes cálidas y acogedoras, el mediodía produce imágenes duras y frías.

Personajes e ilustración

Prioriza la consistencia. Describe rasgos fijos que deben repetirse entre imágenes: color y forma de cabello, color de ojos, ropa característica, cicatriz, accesorio distintivo. Reutiliza exactamente la misma descripción en todos los prompts de la serie y fija la semilla cuando la herramienta lo permita — así es como se mantiene el mismo personaje en escenas distintas. La guía de consistencia de personaje con IA detalla los cuatro métodos.

Fondos de pantalla e imágenes de fondo

Prioriza proporción y espacio negativo. Genera directo en 9:16 para móvil o 16:9 para escritorio y pide un área limpia donde vayan a quedar íconos y reloj — tenemos 50 prompts para fondos de pantalla ya armados así. Después, ajustar las dimensiones exactas de tu dispositivo es cuestión de redimensionar la imagen a la resolución correcta.

Los ocho errores que más arruinan prompts

  1. Apilar adjetivos vacíos. "Increíble, hermoso, obra maestra, 8K, ultra detallado" ocupa espacio en el prompt sin aportar ninguna información visual concreta.
  2. Mezclar estilos incompatibles. Acuarela con render 3D fotorrealista, o pixel art con fotografía — el modelo intenta satisfacer ambos y no entrega ninguno.
  3. Describir emociones en vez de apariencia. La IA no sabe dibujar "nostalgia"; sabe dibujar luz cálida, grano de película y colores desteñidos.
  4. Ignorar la iluminación. Es el error más común y el más costoso. Sin luz descrita, la imagen sale plana.
  5. Pedir texto dentro de la imagen sin especificar. Si el texto importa, escríbelo entre comillas y di dónde va y en qué tipografía.
  6. Prompts demasiado largos. Por encima de unas 60 palabras, cada término nuevo debilita a los anteriores.
  7. No usar prompt negativo. La mitad de los defectos recurrentes desaparece con una lista negativa bien armada.
  8. Generar en la proporción equivocada. Recortar después destruye la composición y desperdicia resolución.

El método de las tres rondas para refinar un prompt

Un buen prompt rara vez nace listo. El error de quien empieza es reescribir todo desde cero en cada intento, lo que impide descubrir qué funcionó. El método a continuación aísla una variable a la vez.

Ronda 1 — estructura. Escribe el prompt con las seis capas, genera cuatro imágenes y evalúa solo una cosa: ¿la composición está bien? ¿El sujeto, el encuadre y el escenario corresponden a lo que imaginaste? Si no, ajusta solo sujeto y composición, sin tocar estilo ni luz.

Ronda 2 — ambiente. Con la composición resuelta, ajusta iluminación, paleta y estilo. Cambia un elemento por generación. Cambiar "luz natural difusa" por "contraluz de atardecer" y ver el efecto aislado enseña más que diez intentos aleatorios.

Ronda 3 — acabado. Ahora entran los detalles técnicos, el prompt negativo y, si la herramienta lo permite, la fijación de la semilla para generar variaciones de la imagen que salió bien. También es aquí donde corriges defectos puntuales con edición, en vez de generar todo de nuevo.

💡 Guarda los prompts que funcionaron. Un archivo simple con tus mejores prompts, organizados por tipo de imagen, ahorra más tiempo que cualquier truco aislado. Si quieres un punto de partida, tenemos 100 prompts de IA listos para copiar, divididos en 12 categorías. Los buenos prompts son reutilizables con pequeños cambios de sujeto.

Qué hacer con la imagen después de generarla

Generar es la mitad del trabajo. La imagen que sale de una IA casi nunca está lista para publicación: suele venir demasiado pesada para la web, en el formato equivocado y sin los ajustes finales.

Tres pasos resuelven la mayor parte de los casos. Primero, conviértela al formato adecuado para el destino — WebP para sitio web, PNG cuando haya transparencia, JPG para envío común. Nuestro conversor de imagen hace esto directo en el navegador. Segundo, reduce el peso del archivo: las imágenes de IA en alta resolución fácilmente superan los 5 MB, lo que frena el tiempo de carga de cualquier página; el compresor de imagen recorta buena parte de eso sin diferencia visible. Tercero, si la generación salió levemente suave en los bordes, vale mejorar la nitidez de la imagen antes de publicar.

Para contenido visual de marca, todavía hay un paso extra que casi nadie hace: extraer la paleta de colores de la imagen generada y reutilizarla en el resto del material. Esto mantiene coherencia visual entre imágenes creadas en sesiones distintas.

Checklist del prompt antes de generar

Si todas las respuestas son sí, la probabilidad de que la primera generación ya salga aprovechable es alta. Y cuando no salga, sabrás exactamente qué capa ajustar — que es justamente lo que separa a quien usa IA por suerte de quien la usa por método.

Pon la teoría en práctica ahora

Describe tu marca en pocas palabras y mira cómo un prompt bien estructurado se convierte en un logo profesional en segundos, directo en el navegador.

Crear logo con IA

Preguntas frecuentes

¿Cuál es el tamaño ideal de un prompt de IA para imágenes?
Entre 25 y 60 palabras cubre bien la mayoría de los casos. Por debajo de eso, la IA rellena los vacíos con el promedio del entrenamiento y la imagen sale genérica. Por encima de eso, los términos empiezan a competir entre sí y el modelo diluye la atención, dejando de ejecutar bien cualquiera de ellos. Los logos son la excepción: funcionan mejor con prompts cortos, de 10 a 20 palabras, porque las marcas piden simplicidad de forma.
¿Necesito escribir prompts en inglés para obtener mejor resultado?
Ya no es obligatorio. Los modelos actuales entienden bien el español y la diferencia de calidad disminuyó mucho. Aun así, los términos técnicos de fotografía y arte suelen tener representación más fuerte en inglés en el entrenamiento, así que un enfoque eficiente es escribir el prompt en español y mantener en inglés solo los términos técnicos específicos, como bokeh, golden hour o low angle.
¿Por qué la IA falla tanto con manos y con texto?
Las manos tienen enorme variación de pose y suelen estar parciales o desenfocadas en las fotos de entrenamiento, lo que dificulta que el modelo aprenda una estructura estable. El texto tiene un problema parecido: el modelo aprende la forma visual de las letras, no la escritura en sí. Esto mejoró bastante en las versiones más recientes. Mientras tanto, usa prompt negativo con "manos deformes, dedos extra", evita poses con manos en primer plano y, cuando el texto sea esencial, escríbelo entre comillas en el prompt o agrégalo después con una herramienta de edición.
¿Cómo mantener el mismo personaje en varias imágenes?
Tres cosas ayudan, y lo ideal es combinar las tres. Primero, escribe una descripción fija del personaje con rasgos concretos — color y corte de cabello, color de ojos, ropa característica, accesorio distintivo — y repite exactamente esa descripción en todos los prompts, sin reescribir con sinónimos. Segundo, fija la semilla cuando la herramienta lo permita. Tercero, usa la mejor imagen ya generada como referencia visual para las próximas, si la herramienta acepta imagen de entrada.
¿Funcionan adjetivos como "8K", "ultra detallado" y "obra maestra"?
Funcionaban mejor en modelos antiguos, donde servían como atajo estadístico para imágenes bien evaluadas. En los modelos actuales el efecto es pequeño y a veces negativo, porque esas palabras ocupan espacio del prompt sin describir nada visualmente concreto. Sustitúyelas por descripciones reales del acabado que quieres: nitidez en el punto de foco, textura de piel visible, granulado de película, alta resolución con microdetalle.
¿Puedo usar comercialmente imágenes generadas por IA?
Depende de los términos de uso de la herramienta y de la legislación del país, y las reglas cambian con frecuencia. Muchas plataformas permiten el uso comercial, algunas exigen plan pago para eso, y otras restringen el registro de derechos de autor sobre el resultado. Antes de usar en material de un cliente o producto a la venta, lee los términos de la herramienta específica y evita prompts que citen artistas vivos o marcas registradas por su nombre.