Si ya buscaste cómo generar imágenes en Gemini, seguramente te topaste con una confusión de nombres: Nano Banana, Nano Banana 2, Nano Banana Pro, Gemini 3.1 Flash Image. Parecen productos distintos y no lo son — Nano Banana es simplemente el nombre de la generación de imágenes nativa de Gemini, y los demás son versiones de ella.
Esta aclaración importa porque la elección del modelo es la decisión que más afecta el resultado. Una infografía con texto denso hecha en el modelo rápido sale con letras torcidas; el mismo pedido en el modelo Pro sale legible. Saber cuál usar en cada caso ahorra intentos y cuota diaria.
Esta guía cubre los tres modelos y cuándo usar cada uno, el paso a paso de generación, cómo escribir prompts de la forma que Gemini aprovecha mejor, la edición conversacional que es el principal diferencial de la herramienta, y las limitaciones reales.
Qué es Nano Banana
Nano Banana es el nombre de la capacidad nativa de generación y edición de imágenes de Gemini. Nativa significa que el modelo de imagen está integrado al propio Gemini, y no se activa como un sistema aparte — entiende el pedido en el mismo contexto de la conversación, incluyendo imágenes que enviaste y lo que ya se dijo antes.
En febrero de 2026 Nano Banana 2 pasó a ser el camino estándar de generación de imágenes en las principales superficies de Google, incluyendo la app de Gemini. Nano Banana Pro sigue existiendo como opción de alta fidelidad, sobre todo para quien tiene plan pago.
Los tres modelos y cuándo usar cada uno
Dentro de Gemini, el menú de modelos aparece con nombres de comportamiento — Rápido, Razonamiento y Pro. Por debajo, corresponden a tres modelos distintos.
| Modelo | Perfil | Usar cuando |
|---|---|---|
| Nano Banana 2 Lite (Rápido) | El más veloz y económico | Pruebas, variaciones rápidas, imágenes simples de una sola escena |
| Nano Banana 2 (Razonamiento) | El generalista, estándar para casi todo | La mayoría de los casos: escenas, retratos, productos, ilustraciones |
| Nano Banana Pro | Alta fidelidad, texto y layout complejos | Infografías, carteles con texto denso, piezas de producción |
Una característica útil del flujo: puedes generar primero en el modelo estándar y, si el resultado pide más detalle, rehacer la misma imagen en el Pro. En los planes pagos, la opción aparece en el menú de tres puntos de la imagen generada, como "Rehacer con el Pro". La limitación es que, al agotarse la cuota diaria del modelo estándar, rehacer en el Pro también deja de estar disponible.
💡 Estrategia de cuota: usa el modelo rápido para descubrir la composición que funciona y solo entonces rehazla en el Pro. Gastar las generaciones del modelo más caro en pruebas es el error que más desperdicia cuota diaria.
Cómo generar tu primera imagen
- Abre Gemini. En la computadora, entra por el navegador; en el móvil, por la aplicación.
- Entra al área de imágenes. En la barra lateral hay una sección de Imágenes; alternativamente, en el menú de herramientas está la opción de crear imágenes.
- Elige el modelo. Rápido, Razonamiento o Pro, según la tabla anterior. Si tienes dudas, comienza por el estándar.
- Escribe el pedido en lenguaje natural. Las frases completas funcionan mejor que listas de palabras separadas por comas.
- Pide ajustes en la misma conversación. "Oscurece más el fondo", "cambia al atardecer", "quita la planta de la esquina". Mantiene la imagen y cambia solo lo que se pidió.
- Descarga en resolución completa. Usa el botón de descarga, nunca captura de pantalla.
Resolución: qué puedes descargar
La resolución de descarga depende del plan. Sin plan pago de Google con IA, la descarga sale en 1K. Con plan, se puede descargar en 2K. Nano Banana Pro es el camino para salidas de mayor fidelidad, incluyendo material con texto y layout que necesita soportar ampliación.
En la práctica esto significa que, para uso digital común — post, miniatura, imagen de blog, presentación — lo que Gemini entrega ya resuelve. Para impresión en tamaño grande o monitor de alta resolución, vas a necesitar ampliar después de la generación. Se puede aumentar la resolución de la imagen sin perder calidad, y el resultado suele ser bueno cuando la imagen es limpia y poco detallada.
Cómo escribir prompts para Gemini
El propio Google sugiere una fórmula inicial simple: pide la creación de una imagen indicando el sujeto, la acción y la escena. Es un buen punto de partida — y el paso siguiente es justamente ampliarla.
Empieza por la fórmula, luego detalla
Un pedido mínimo funcionaría así:
Ya da resultado. Pero cada capa adicional acerca el resultado a lo que imaginaste:
Escribe en prosa, no en etiquetas
Esta es la diferencia más importante respecto a herramientas como Midjourney. Gemini es conversacional y aprovecha mejor frases completas que listas de términos separados por comas. Escribe como si estuvieras explicando la escena a alguien.
Indica la proporción
Si no la indicas, el modelo elige. Di "formato vertical para historias", "cuadrado para Instagram", "horizontal widescreen" o la proporción directamente.
Pon el texto entre comillas
Cuando la imagen necesita contener palabras, escríbelas literalmente entre comillas e indica la posición. Sin esto, el modelo puede parafrasear o colocarlo donde le parezca mejor.
Itera en vez de reescribir
Si algo salió mal, pide la corrección específica en vez de reescribir todo. "Mantén la composición y cambia solo el color del abrigo a verde" preserva lo que ya estaba bien. Reescribir el prompt entero genera una imagen nueva sin relación con la anterior.
Edición conversacional: el principal diferencial
Aquí es donde Gemini se destaca. Envías una imagen — generada por él o tuya — y describes el cambio con palabras, sin máscara, capa ni selección.
Cambiar el fondo
Mantener al sujeto y sustituir el entorno detrás de él. Útil para retratos, productos y piezas de marketing.
Cambiar el clima y el horario
Transformar un día soleado en noche, agregar lluvia, cambiar el otoño por el invierno. La misma escena con otra atmósfera.
Cambiar el ángulo de cámara
Pedir la misma escena vista desde otro punto. No es perfecto, porque el modelo necesita inventar lo que no era visible, pero funciona bien en escenas con espacio.
Transferir estilo de una referencia
Uno de los recursos más útiles y menos conocidos: enviar dos imágenes y pedir que la textura, el color o el estilo de una se aplique a la otra. Es la forma más rápida de probar estéticas sin empezar de cero.
Agregar o quitar elementos
Quitar un objeto indeseado, agregar una planta, incluir una persona al fondo. Funciona bien con elementos claramente delimitados; las eliminaciones en áreas de textura compleja a veces dejan marcas.
Trabajar con imágenes de referencia
Enviar imágenes junto con el pedido es donde Gemini muestra más fuerza, y vale la pena entender las tres formas de usarlo.
Referencia de sujeto. Envías la foto de una persona, producto o personaje y pides que aparezca en una escena nueva. El modelo intenta preservar la identidad del sujeto y cambiar todo lo demás.
Referencia de estilo. Envías una imagen cuya estética quieres reproducir y pides que la paleta, textura o lenguaje visual se aplique a otra imagen o a una escena descrita en texto.
Referencia de composición. Envías un boceto, una foto mal tomada o un borrador y pides que se transforme en imagen terminada manteniendo la disposición de los elementos.
Vale un cuidado práctico: cuanto más limpia la referencia, mejor el resultado. Las imágenes con fondo desordenado hacen que el modelo cargue elementos del entorno sin que lo hayas pedido. Si tu referencia tiene ese problema, eliminar el fondo antes de enviarla mejora bastante el resultado.
Texto e infografías
La renderización de texto legible es uno de los avances más visibles de esta generación de modelos, y es justamente donde Nano Banana Pro se justifica. Cartel con título y subtítulo, infografía con etiquetas, diagrama a partir de anotaciones, portada con nombre de marca — todo eso salía torcido hasta hace poco y hoy sale limpio en la mayoría de los intentos.
Tres cosas mejoran mucho el resultado con texto:
- Escribir el texto exacto entre comillas. Sin esto, el modelo interpreta la palabra como tema y puede parafrasear.
- Describir la jerarquía. "Título grande arriba, subtítulo más pequeño debajo, tres bloques de texto corto en la base" da mucho más control que dejarlo abierto.
- Usar el modelo Pro. Layout denso y texto pequeño son justamente el caso en que se nota la diferencia entre los modelos.
Aun así, para piezas en que la tipografía debe ser la de la marca, el camino más confiable sigue siendo generar la imagen sin texto y agregar el texto después, con la fuente correcta.
Ocho pedidos listos para el día a día
Plantillas que cubren las necesidades más comunes. Cambia lo que esté entre corchetes y mantén el resto.
Imagen de portada para artículo
Post cuadrado para redes sociales
Cartel con título
Cambiar el fondo de una foto
Variación de estilo
Mockup de producto
Infografía simple
Limpiar una foto
Consistencia de personaje en Gemini
Como la edición es conversacional, el método más eficaz es también el más simple: permanecer en el mismo hilo de conversación. Después de generar el personaje, pide las próximas escenas sin redescribirlo — "ahora muestra al mismo personaje sentado en un café" — y el contexto acumulado hace el trabajo.
Cuando la serie sea larga o necesites retomarla otro día, usa la imagen como referencia de sujeto y mantén una descripción fija de los rasgos permanentes, repetida palabra por palabra. La guía de consistencia de personaje con IA detalla los cuatro métodos y cuándo compensa cada uno.
Gemini o ChatGPT: qué cambia en la práctica
| Aspecto | Gemini | ChatGPT |
|---|---|---|
| Estilo de prompt | Prosa conversacional | Prosa conversacional |
| Edición por conversación | Fuerte, con buena preservación del original | Fuerte, con buena preservación del original |
| Múltiples imágenes de entrada | Punto fuerte, incluyendo transferencia de estilo | Soportado |
| Texto en la imagen | Muy bueno, aún mejor en el modelo Pro | Muy bueno |
| Elección de modelo | Explícita: Rápido, Razonamiento o Pro | Instantáneo o razonamiento, según el plan |
| Resolución de descarga | 1K en gratuito, 2K con plan | Hasta 2K |
Las dos herramientas convergieron bastante. El criterio práctico es probar el mismo pedido en ambas y comparar — y usar la que entregue mejor resultado para tu tipo de imagen. La guía de ChatGPT para crear imágenes cubre el otro lado en detalle, y el comparativo de las mejores IAs para crear imágenes pone las principales opciones lado a lado.
Lo que Gemini no hace bien
- Personas reales identificables. La generación de figuras públicas está bloqueada, y reformular el pedido no lo evita.
- Marcas y personajes licenciados. Los logotipos de empresas existentes y personajes protegidos son rechazados.
- Vector real. La salida siempre es rasterizada. Para un archivo editable en curvas, el resultado sirve como referencia para rediseñar.
- Fondo transparente confiable. Aunque se pida, suele salir con fondo sólido. La transparencia es más rápida de resolver después.
- Fidelidad absoluta al editar tu foto. Al alterar una imagen enviada, el modelo regenera la escena y los detalles finos cambian.
- Volumen alto sin plan. La cuota diaria en uso gratuito es limitada.
Siete errores que más estorban
- Usar el modelo Pro para probar. Gasta cuota que haría falta en la versión final.
- Escribir en formato de etiquetas. Lista de palabras es el lenguaje de otras herramientas; aquí, la prosa rinde más.
- No indicar la proporción. Sin indicación, el formato casi nunca es el que necesitas.
- Reescribir el prompt en cada intento. Pierdes lo que ya habías logrado. Pide correcciones puntuales.
- Enviar referencia con fondo desordenado. El modelo carga elementos del entorno sin que lo pidas.
- Guardar por captura de pantalla. Pierde resolución y agrega recompresión.
- Publicar sin optimizar. Las imágenes en 2K pesan mucho y frenan la carga de cualquier página.
Después de generar: preparar la imagen
La imagen que sale de Gemini está lista para ser vista, no para ser publicada. Cuatro pasos lo resuelven.
Convertir el formato. PNG es excelente para transparencia y malo para foto en la web. Para sitio web, WebP suele reducir el peso a la mitad sin diferencia visible; para envío común, JPG resuelve. El conversor de imagen hace el cambio en el navegador, y la guía de formatos de imagen ayuda a elegir.
Reducir el peso. Una imagen en 2K fácilmente pasa de varios megabytes. El compresor de imagen recorta buena parte de eso sin pérdida visible.
Ajustar tamaño y encuadre. Para una medida específica, usa el redimensionador; si la proporción salió distinta a la necesaria, recortar preserva más calidad que estirar.
Aislar al sujeto cuando lo necesites. Para productos, logos y elementos que van sobre fondo de color, eliminar el fondo entrega el PNG transparente que la generación no produce.
💡 Orden que funciona: descargar en resolución completa → recortar o redimensionar → convertir el formato → comprimir al final. Comprimir antes de redimensionar desperdicia calidad.
Checklist antes de generar
- ¿El modelo elegido corresponde a la complejidad del pedido?
- ¿La proporción está declarada?
- ¿El prompt está en prosa, con sujeto, acción y escena?
- Si hay texto, ¿está entre comillas y con posición definida?
- ¿Las referencias enviadas tienen fondo limpio?
- ¿Estás pidiendo corrección en vez de reescribir todo?
- ¿Vas a descargar en resolución completa, y no por captura de pantalla?
Convierte tus imágenes al formato correcto
Transforma el PNG pesado de Gemini en WebP o JPG y deja la imagen lista para publicar, directo en el navegador.
Convertir imagen