El gigante de Mountain View presenta el sucesor de su fenómeno generador de imágenes. Nano Banana 2 promete la calidad de la versión Pro a la velocidad de Flash y está disponible en todo el ecosistema de Google. Descripción general.
La historia comienza con un nombre en clave que sigue siendo famoso. En agosto de 2025, apareció un modelo anónimo en la plataforma de reseñas de la comunidad Arena con el sobrenombre de «Nano Banana», un guiño a los apodos dados a Naina Raisinghani, directora de producto de Google DeepMind. El 26 de agosto Google lo hizo oficial: se trataba de Gemini 2.5 Flash Image. En pocas semanas, el modelo se convirtió en un fenómeno viral, especialmente en la India, donde los internautas se hicieron cargo masivamente de la generación de figuras fotorrealistas en 3D a partir de selfies. Los resultados son espectaculares: más de 10 millones de nuevos usuarios atraídos por la aplicación Gemini y más de 200 millones de ediciones de imágenes realizadas en las primeras semanas.
Pero es con la llegada de Nano Banana Pro el 20 de noviembre de 2025, respaldado por Gemini 3 Pro Image, que Google realmente cambió la situación. Este modelo de alta gama ha superado los límites del fotorrealismo hasta el punto de hacer casi imperceptible el límite entre la imagen generada y la fotografía real. Control avanzado de la iluminación y los ángulos de la cámara, representación de texto legible en imágenes, composición a partir de 14 imágenes originales manteniendo la coherencia visual de cinco personajes distintos: Nano Banana Pro se estableció rápidamente en la cima del ranking LMArena, el principal punto de referencia de la comunidad.
Una lucha en la cima de la IA generativa de imágenes
Este éxito no ha pasado desapercibido para la competencia. El dominio de Nano Banana Pro en el ranking llevó a OpenAI a acelerar el lanzamiento de GPT Image 1.5, lanzado a mediados de diciembre, cuatro veces más rápido que su predecesor y un 20% más barato a través de la API.
Desde entonces, los dos modelos comparten los primeros puestos del ranking, pero con perfiles distintos. GPT Image 1.5 destaca por su velocidad de iteración, estricto cumplimiento de las instrucciones y preservación de logotipos y elementos de marca, una ventaja para flujos de trabajo de marketing de gran volumen. Nano Banana Pro, por su parte, sigue siendo el punto de referencia en términos de fotorrealismo, producción de imágenes 4K, calidad de texturas, reproducción natural de tonos de piel y consistencia visual en series de imágenes. Las comparaciones publicadas por varios sitios especializados coinciden: ninguno de los dos ha prevalecido realmente y muchos usuarios utilizan ambos, eligiendo uno u otro según el contexto.
Nano Banana 2: lo mejor de ambos mundos
Es en este contexto que Google DeepMind anuncia Nano Banana 2, técnicamente llamado Gemini 3.1 Flash Image. La promesa es clara: combinar la calidad, el razonamiento avanzado y el conocimiento del mundo de Nano Banana Pro con la velocidad de ejecución del linaje Flash. Google está hablando de hacer que las funciones anteriormente reservadas para la versión Pro sean accesibles para la mayor cantidad de personas posible.
Anclado en el conocimiento en tiempo real. Nano Banana 2 aprovecha la base de conocimientos de Gemini y las imágenes y los conocimientos de búsqueda web en tiempo real para producir imágenes contextualmente más precisas. La plantilla puede generar infografías, convertir notas en diagramas o producir visualizaciones de datos. Para demostrar esta capacidad, Google ha desarrollado una aplicación de demostración llamada Window Seat, que crea vistas de ventanas fotorrealistas inspiradas en ubicaciones reales y datos meteorológicos en vivo.
Representación de texto y localización multilingüe. El modelo produce texto legible y preciso directamente integrado en imágenes: modelos de marketing, tarjetas de felicitación, carteles. Aún más notable: te permite traducir y localizar texto dentro de la propia imagen, en varios idiomas. Google demostró esta capacidad con una demostración de “Global Ad Localizer” que adapta un anuncio para diferentes mercados internacionales, localizando texto y elementos visuales simultáneamente.
Coherencia de temas y seguimiento de instrucciones. Nano Banana 2 mantiene la consistencia visual de cinco personajes y la fidelidad de 14 objetos dentro de un solo flujo de trabajo (dependiendo de la superficie; hasta 10 objetos en la aplicación Gemini), allanando el camino para los guiones gráficos y la creación de narrativas visuales continuas. El modelo también se adhiere más estrictamente a consultas complejas y matizadas.
Resolución y formatos. El modelo admite resoluciones que van desde 512 px (nuevo nivel optimizado para iteraciones rápidas) hasta 4K, con soporte nativo ampliado para relaciones de aspecto: ahora se agregan los formatos existentes 4:1, 1:4, 8:1 y 1:8. Una flexibilidad que sólo se encuentra en los modelos Banana Pro y que GPT-Image no tiene.
Fidelidad visual. Google destaca una iluminación más vibrante, texturas más ricas y detalles más nítidos en comparación con el Nano Banana original, manteniendo la velocidad esperada de un modelo Flash.
Niveles de razonamiento configurables. Por parte del desarrollador, una nueva característica notable: la capacidad de ajustar el nivel de razonamiento del modelo (Mínimo por defecto o Alto/Dinámico) para indicaciones complejas, lo que mejora significativamente la calidad de la salida y el cumplimiento de las instrucciones.
Despliegue masivo y socios fuertes
El lanzamiento de Nano Banana 2 es el más grande jamás realizado por Google para un modelo de imagen. Reemplaza a Nano Banana Pro de forma predeterminada en la aplicación Gemini (modos Fast, Thinking y Pro), así como en la Búsqueda de Google (modo AI y Lens, disponible en 141 nuevos países y territorios, con ocho idiomas adicionales). Se convierte en el modelo predeterminado en Flow (sin costo de créditos) y potencia las sugerencias de campañas en Google Ads.
Para los desarrolladores, el modelo está disponible para obtener una vista previa a través de Gemini API, Gemini CLI, AI Studio, Google Antigravity, Firebase y Vertex AI en Google Cloud. Se requiere acceso pago mediante clave API en AI Studio.
Los suscriptores de Google AI Pro y Ultra conservan el acceso a Nano Banana Pro para tareas especializadas que requieren la máxima precisión factual, accesible a través del menú contextual de actualización.
El ecosistema de socios ya es sustancial. Adobe integra Nano Banana 2 en Firefly. Figma lo usa en sus flujos de trabajo Weavy. Notion lo aprovecha para generar diagramas y elementos visuales. WPP lo ha probado con clientes como Unilever y ha observado una reducción en los tiempos de retrabajo de “horas a segundos”. La startup de moda Whering lo utiliza para transformar fotografías de usuarios de baja calidad en imágenes con calidad de estudio.
Límites para saber
Nano Banana 2 no está exento de debilidades. Google lo reconoce: funciones avanzadas como la edición de máscaras, cambios importantes de iluminación (día/noche) o la combinación de varias imágenes aún pueden producir resultados artificiales o artefactos visuales. La coherencia de los personajes, aunque mejorada, no es infalible. Consultas muy complejas o escenarios físicamente imposibles siguen siendo fuentes de inconsistencias. Y si se acerca mucho a la calidad Pro, no siempre la iguala en los renders más exigentes, de ahí el mantenimiento de Nano Banana Pro en la oferta.
Trazabilidad: SynthID y C2PA
Por el lado de la transparencia, Google está fortaleciendo su sistema de trazabilidad. Todas las imágenes generadas llevan una marca de agua SynthID invisible, junto con credenciales de contenido C2PA para proporcionar información no solo sobre si la IA estuvo presente en la creación, sino también sobre cómo se usó. Desde su lanzamiento en noviembre, la función de verificación SynthID en la aplicación Gemini se ha utilizado más de 20 millones de veces. La verificación C2PA pronto se agregará a la aplicación Gemini.
Con Nano Banana 2, Google no se limita a iterar: reestructura su gama de modelos de imagen ofreciendo un modelo versátil capaz de cubrir la mayoría de usos profesionales y del público en general. Una democratización que debería favorecer aún más el creciente éxito de Gemini, también en los móviles. Y lo que también debería llevar a OpenAI a reaccionar de nuevo…
[

