Si ya buscaste cómo generar imágenes en Gemini, seguramente te topaste con una confusión de nombres: Nano Banana, Nano Banana 2, Nano Banana Pro, Gemini 3.1 Flash Image. Parecen productos distintos y no lo son — Nano Banana es simplemente el nombre de la generación de imágenes nativa de Gemini, y los demás son versiones de ella.

Esta aclaración importa porque la elección del modelo es la decisión que más afecta el resultado. Una infografía con texto denso hecha en el modelo rápido sale con letras torcidas; el mismo pedido en el modelo Pro sale legible. Saber cuál usar en cada caso ahorra intentos y cuota diaria.

Esta guía cubre los tres modelos y cuándo usar cada uno, el paso a paso de generación, cómo escribir prompts de la forma que Gemini aprovecha mejor, la edición conversacional que es el principal diferencial de la herramienta, y las limitaciones reales.

Qué es Nano Banana

Nano Banana es el nombre de la capacidad nativa de generación y edición de imágenes de Gemini. Nativa significa que el modelo de imagen está integrado al propio Gemini, y no se activa como un sistema aparte — entiende el pedido en el mismo contexto de la conversación, incluyendo imágenes que enviaste y lo que ya se dijo antes.

En febrero de 2026 Nano Banana 2 pasó a ser el camino estándar de generación de imágenes en las principales superficies de Google, incluyendo la app de Gemini. Nano Banana Pro sigue existiendo como opción de alta fidelidad, sobre todo para quien tiene plan pago.

Los tres modelos y cuándo usar cada uno

Dentro de Gemini, el menú de modelos aparece con nombres de comportamiento — Rápido, Razonamiento y Pro. Por debajo, corresponden a tres modelos distintos.

ModeloPerfilUsar cuando
Nano Banana 2 Lite (Rápido)El más veloz y económicoPruebas, variaciones rápidas, imágenes simples de una sola escena
Nano Banana 2 (Razonamiento)El generalista, estándar para casi todoLa mayoría de los casos: escenas, retratos, productos, ilustraciones
Nano Banana ProAlta fidelidad, texto y layout complejosInfografías, carteles con texto denso, piezas de producción

Una característica útil del flujo: puedes generar primero en el modelo estándar y, si el resultado pide más detalle, rehacer la misma imagen en el Pro. En los planes pagos, la opción aparece en el menú de tres puntos de la imagen generada, como "Rehacer con el Pro". La limitación es que, al agotarse la cuota diaria del modelo estándar, rehacer en el Pro también deja de estar disponible.

💡 Estrategia de cuota: usa el modelo rápido para descubrir la composición que funciona y solo entonces rehazla en el Pro. Gastar las generaciones del modelo más caro en pruebas es el error que más desperdicia cuota diaria.

Cómo generar tu primera imagen

  1. Abre Gemini. En la computadora, entra por el navegador; en el móvil, por la aplicación.
  2. Entra al área de imágenes. En la barra lateral hay una sección de Imágenes; alternativamente, en el menú de herramientas está la opción de crear imágenes.
  3. Elige el modelo. Rápido, Razonamiento o Pro, según la tabla anterior. Si tienes dudas, comienza por el estándar.
  4. Escribe el pedido en lenguaje natural. Las frases completas funcionan mejor que listas de palabras separadas por comas.
  5. Pide ajustes en la misma conversación. "Oscurece más el fondo", "cambia al atardecer", "quita la planta de la esquina". Mantiene la imagen y cambia solo lo que se pidió.
  6. Descarga en resolución completa. Usa el botón de descarga, nunca captura de pantalla.

Resolución: qué puedes descargar

La resolución de descarga depende del plan. Sin plan pago de Google con IA, la descarga sale en 1K. Con plan, se puede descargar en 2K. Nano Banana Pro es el camino para salidas de mayor fidelidad, incluyendo material con texto y layout que necesita soportar ampliación.

En la práctica esto significa que, para uso digital común — post, miniatura, imagen de blog, presentación — lo que Gemini entrega ya resuelve. Para impresión en tamaño grande o monitor de alta resolución, vas a necesitar ampliar después de la generación. Se puede aumentar la resolución de la imagen sin perder calidad, y el resultado suele ser bueno cuando la imagen es limpia y poco detallada.

Cómo escribir prompts para Gemini

El propio Google sugiere una fórmula inicial simple: pide la creación de una imagen indicando el sujeto, la acción y la escena. Es un buen punto de partida — y el paso siguiente es justamente ampliarla.

Empieza por la fórmula, luego detalla

Un pedido mínimo funcionaría así:

Crea la imagen de un gato durmiendo la siesta en un rayo de sol en el alféizar de una ventana.

Ya da resultado. Pero cada capa adicional acerca el resultado a lo que imaginaste:

Crea la imagen de un gato negro durmiendo la siesta enroscado en un rayo de sol en el alféizar de una ventana de madera, cortina de lino al lado balanceándose levemente, polvo suspendido visible en la luz, plano medio lateral, luz cálida de atardecer, tonos beige y ámbar, fotografía doméstica contemplativa.

Escribe en prosa, no en etiquetas

Esta es la diferencia más importante respecto a herramientas como Midjourney. Gemini es conversacional y aprovecha mejor frases completas que listas de términos separados por comas. Escribe como si estuvieras explicando la escena a alguien.

Indica la proporción

Si no la indicas, el modelo elige. Di "formato vertical para historias", "cuadrado para Instagram", "horizontal widescreen" o la proporción directamente.

Pon el texto entre comillas

Cuando la imagen necesita contener palabras, escríbelas literalmente entre comillas e indica la posición. Sin esto, el modelo puede parafrasear o colocarlo donde le parezca mejor.

Itera en vez de reescribir

Si algo salió mal, pide la corrección específica en vez de reescribir todo. "Mantén la composición y cambia solo el color del abrigo a verde" preserva lo que ya estaba bien. Reescribir el prompt entero genera una imagen nueva sin relación con la anterior.

Edición conversacional: el principal diferencial

Aquí es donde Gemini se destaca. Envías una imagen — generada por él o tuya — y describes el cambio con palabras, sin máscara, capa ni selección.

Cambiar el fondo

Mantener al sujeto y sustituir el entorno detrás de él. Útil para retratos, productos y piezas de marketing.

Mantén a la persona exactamente como está y sustituye el fondo por una pared de concreto aparente clara, con luz natural difusa que viene de la izquierda. Preserva la iluminación sobre el rostro.

Cambiar el clima y el horario

Transformar un día soleado en noche, agregar lluvia, cambiar el otoño por el invierno. La misma escena con otra atmósfera.

Mantén la composición y todos los elementos. Cambia de día soleado a noche lluviosa, con la calle mojada reflejando las luces y niebla baja.

Cambiar el ángulo de cámara

Pedir la misma escena vista desde otro punto. No es perfecto, porque el modelo necesita inventar lo que no era visible, pero funciona bien en escenas con espacio.

Muestra la misma escena vista desde un ángulo más bajo, cerca del suelo, manteniendo los mismos objetos, la misma iluminación y el mismo estilo.

Transferir estilo de una referencia

Uno de los recursos más útiles y menos conocidos: enviar dos imágenes y pedir que la textura, el color o el estilo de una se aplique a la otra. Es la forma más rápida de probar estéticas sin empezar de cero.

Aplica la paleta de colores y la textura de la segunda imagen a la primera, manteniendo la composición, los objetos y el encuadre de la primera exactamente iguales.

Agregar o quitar elementos

Quitar un objeto indeseado, agregar una planta, incluir una persona al fondo. Funciona bien con elementos claramente delimitados; las eliminaciones en áreas de textura compleja a veces dejan marcas.

Quita el auto estacionado a la derecha y completa la calle naturalmente, manteniendo el resto de la imagen sin alteraciones.

Trabajar con imágenes de referencia

Enviar imágenes junto con el pedido es donde Gemini muestra más fuerza, y vale la pena entender las tres formas de usarlo.

Referencia de sujeto. Envías la foto de una persona, producto o personaje y pides que aparezca en una escena nueva. El modelo intenta preservar la identidad del sujeto y cambiar todo lo demás.

Referencia de estilo. Envías una imagen cuya estética quieres reproducir y pides que la paleta, textura o lenguaje visual se aplique a otra imagen o a una escena descrita en texto.

Referencia de composición. Envías un boceto, una foto mal tomada o un borrador y pides que se transforme en imagen terminada manteniendo la disposición de los elementos.

Vale un cuidado práctico: cuanto más limpia la referencia, mejor el resultado. Las imágenes con fondo desordenado hacen que el modelo cargue elementos del entorno sin que lo hayas pedido. Si tu referencia tiene ese problema, eliminar el fondo antes de enviarla mejora bastante el resultado.

Texto e infografías

La renderización de texto legible es uno de los avances más visibles de esta generación de modelos, y es justamente donde Nano Banana Pro se justifica. Cartel con título y subtítulo, infografía con etiquetas, diagrama a partir de anotaciones, portada con nombre de marca — todo eso salía torcido hasta hace poco y hoy sale limpio en la mayoría de los intentos.

Tres cosas mejoran mucho el resultado con texto:

Aun así, para piezas en que la tipografía debe ser la de la marca, el camino más confiable sigue siendo generar la imagen sin texto y agregar el texto después, con la fuente correcta.

Ocho pedidos listos para el día a día

Plantillas que cubren las necesidades más comunes. Cambia lo que esté entre corchetes y mantén el resto.

Imagen de portada para artículo

Crea una imagen horizontal widescreen sobre [tema], con composición limpia, un elemento central en foco y el lado izquierdo más vacío para recibir texto. Iluminación natural suave, paleta en tonos de [color] y neutros, sin ningún texto en la imagen.

Post cuadrado para redes sociales

Crea una imagen cuadrada de [asunto] con estética minimalista, fondo liso en [color], sombra suave y mucho espacio negativo alrededor del objeto. Luz difusa uniforme, alto contraste entre objeto y fondo, sin texto.

Cartel con título

Crea un cartel vertical de promoción para [evento]. Título "[texto exacto]" en letras grandes arriba y, más pequeño, debajo: "[texto exacto]". Fondo en [color] con un elemento gráfico simple. Estilo editorial, tipografía sin serifas, mucho espacio vacío.

Cambiar el fondo de una foto

Mantén a la persona exactamente como está, sin alterar el rostro, el cabello ni la ropa. Sustituye solo el fondo por [descripción del escenario], preservando la misma dirección de luz que incide sobre ella.

Variación de estilo

Mantén la misma composición, los mismos elementos y el mismo encuadre, pero rehaz la imagen en estilo [acuarela / ilustración vectorial / fotografía realista], con paleta [descripción].

Mockup de producto

Crea una foto de producto de [producto] sobre [superficie], fondo [color] en degradado suave, iluminación de estudio con softbox lateral, ángulo frontal levemente elevado, reflejo controlado, alta nitidez, sin texto ni etiqueta.

Infografía simple

Crea una infografía horizontal con tres columnas iguales explicando [tema]. Cada columna tiene un ícono simple arriba, un título corto y una frase de apoyo. Los títulos son "[texto]", "[texto]" y "[texto]". Paleta en [dos colores], estilo editorial limpio, sin sombras.

Limpiar una foto

Elimina [elemento indeseado] de la imagen y completa el área naturalmente, manteniendo todo el resto sin alteraciones, con la misma iluminación y el mismo nivel de detalle.

Consistencia de personaje en Gemini

Como la edición es conversacional, el método más eficaz es también el más simple: permanecer en el mismo hilo de conversación. Después de generar el personaje, pide las próximas escenas sin redescribirlo — "ahora muestra al mismo personaje sentado en un café" — y el contexto acumulado hace el trabajo.

Cuando la serie sea larga o necesites retomarla otro día, usa la imagen como referencia de sujeto y mantén una descripción fija de los rasgos permanentes, repetida palabra por palabra. La guía de consistencia de personaje con IA detalla los cuatro métodos y cuándo compensa cada uno.

Gemini o ChatGPT: qué cambia en la práctica

AspectoGeminiChatGPT
Estilo de promptProsa conversacionalProsa conversacional
Edición por conversaciónFuerte, con buena preservación del originalFuerte, con buena preservación del original
Múltiples imágenes de entradaPunto fuerte, incluyendo transferencia de estiloSoportado
Texto en la imagenMuy bueno, aún mejor en el modelo ProMuy bueno
Elección de modeloExplícita: Rápido, Razonamiento o ProInstantáneo o razonamiento, según el plan
Resolución de descarga1K en gratuito, 2K con planHasta 2K

Las dos herramientas convergieron bastante. El criterio práctico es probar el mismo pedido en ambas y comparar — y usar la que entregue mejor resultado para tu tipo de imagen. La guía de ChatGPT para crear imágenes cubre el otro lado en detalle, y el comparativo de las mejores IAs para crear imágenes pone las principales opciones lado a lado.

Lo que Gemini no hace bien

Siete errores que más estorban

  1. Usar el modelo Pro para probar. Gasta cuota que haría falta en la versión final.
  2. Escribir en formato de etiquetas. Lista de palabras es el lenguaje de otras herramientas; aquí, la prosa rinde más.
  3. No indicar la proporción. Sin indicación, el formato casi nunca es el que necesitas.
  4. Reescribir el prompt en cada intento. Pierdes lo que ya habías logrado. Pide correcciones puntuales.
  5. Enviar referencia con fondo desordenado. El modelo carga elementos del entorno sin que lo pidas.
  6. Guardar por captura de pantalla. Pierde resolución y agrega recompresión.
  7. Publicar sin optimizar. Las imágenes en 2K pesan mucho y frenan la carga de cualquier página.

Después de generar: preparar la imagen

La imagen que sale de Gemini está lista para ser vista, no para ser publicada. Cuatro pasos lo resuelven.

Convertir el formato. PNG es excelente para transparencia y malo para foto en la web. Para sitio web, WebP suele reducir el peso a la mitad sin diferencia visible; para envío común, JPG resuelve. El conversor de imagen hace el cambio en el navegador, y la guía de formatos de imagen ayuda a elegir.

Reducir el peso. Una imagen en 2K fácilmente pasa de varios megabytes. El compresor de imagen recorta buena parte de eso sin pérdida visible.

Ajustar tamaño y encuadre. Para una medida específica, usa el redimensionador; si la proporción salió distinta a la necesaria, recortar preserva más calidad que estirar.

Aislar al sujeto cuando lo necesites. Para productos, logos y elementos que van sobre fondo de color, eliminar el fondo entrega el PNG transparente que la generación no produce.

💡 Orden que funciona: descargar en resolución completa → recortar o redimensionar → convertir el formato → comprimir al final. Comprimir antes de redimensionar desperdicia calidad.

Checklist antes de generar

Convierte tus imágenes al formato correcto

Transforma el PNG pesado de Gemini en WebP o JPG y deja la imagen lista para publicar, directo en el navegador.

Convertir imagen

Preguntas frecuentes

¿Qué es Nano Banana y qué relación tiene con Gemini?
Nano Banana es el nombre de la generación de imágenes nativa de Gemini — no es un producto aparte ni una aplicación independiente. Hoy existen tres modelos en la familia: Lite, enfocado en velocidad y costo, Nano Banana 2, el generalista estándar desde febrero de 2026, y Nano Banana Pro, de alta fidelidad, indicado para texto denso y layouts complejos. En la aplicación aparecen en el menú como Rápido, Razonamiento y Pro.
¿Se puede crear imágenes en Gemini gratis?
Sí, con limitaciones. El uso gratuito tiene una cuota diaria de generación y la descarga sale en resolución 1K. Con un plan pago de Google con IA, la descarga pasa a 2K y queda disponible la opción de rehacer la imagen en Nano Banana Pro. Un detalle práctico que atrapa a muchos: cuando se agota la cuota diaria del modelo estándar, rehacer en Pro también deja de funcionar, incluso con plan pago.
¿Qué modelo elegir para cada tipo de imagen?
Para la mayoría de los casos — escenas, retratos, productos, ilustraciones — el modelo estándar funciona bien. El modelo rápido sirve para explorar composiciones y generar variaciones sin gastar cuota del más costoso. El Pro vale la pena cuando el pedido involucra texto denso, infografía, diagrama, cartel con jerarquía tipográfica o pieza que va a producción. La estrategia más económica es probar en el rápido y rehacer en el Pro solo la versión elegida.
¿Cómo editar una foto mía en Gemini?
Envía la imagen en la conversación y describe el cambio en lenguaje natural — cambiar el fondo, modificar la iluminación, quitar un objeto, aplicar otro estilo. No hace falta máscara ni selección. Vale saber que el resultado es una imagen nueva generada a partir de la tuya, no una edición pixel a pixel: la composición se preserva, pero los detalles finos del original cambian. Para cambios que exigen fidelidad absoluta, un editor tradicional sigue siendo más adecuado.
¿Cómo conseguir fondo transparente?
Aunque se pida explícitamente, la imagen suele salir con fondo sólido en vez de transparencia real. El camino más rápido es pedir un fondo blanco liso, el más fácil de recortar, y crear la transparencia después eliminando el fondo y guardando en PNG. Insistir con el modelo suele resultar en un fondo a cuadros dibujado imitando transparencia, que no sirve de nada.
¿Puedo usar comercialmente las imágenes generadas?
Las reglas dependen del plan, del país y de los términos vigentes de Google, y pueden cambiar. Además, el permiso de uso comercial no es lo mismo que protección legal: en varias jurisdicciones, las obras creadas enteramente por una máquina enfrentan restricciones de registro de derechos de autor. Antes de usarlas en material de un cliente o producto a la venta, revisa los términos actuales y evita pedidos que involucren marcas registradas, personajes licenciados o personas reales.