Google lanzó Nano Banana Pro hace unas semanas, las redes sociales siguieron… Entonces OpenAI contraataca y lanza GPT-Image 1.5. El desafío ya no es sólo “generar una imagen bella” a partir de una descripción, sino también editar rápidamente una imagen existente, de forma limpia, sin alterar la luz, la composición o la identidad de un rostro. ¡Y funciona!
Se habla mucho sobre las capacidades de escritura y codificación de la IA generativa. Pero la IA también ha cambiado profundamente la creación visual desde que fue capaz de generar imágenes. DALL·E de OpenAI abrió el camino en la popularización de la generación de imágenes a partir de instrucciones textuales simples. Rápidamente, MidJourney y Stable Diffusion tomaron el control, cada uno con sus propias especificidades: representación artística para uno, flexibilidad de código abierto para el otro. Google reaccionó primero con sus modelos Imagen y luego, más recientemente, con Nano Banana. A principios de año, OpenAI prendió fuego a las redes sociales al integrar su nuevo modelo GPT Image 1 en ChatGPT. Hace unas semanas, Google recuperó el liderazgo mediático al lanzar Nano Banana Pro con tecnología Gemini 3. Suficiente para obligar a OpenAI a reaccionar. ¡La editorial, que acaba de firmar un importante acuerdo con Disney que permite a sus modelos utilizar más de 200 personajes del catálogo de Walt Disney, lanzó GPT Image 1.5 esta semana!
Imagen GPT 1.5: velocidad y precisión en el corazón
El nuevo modelo promete avances notables. Genera imágenes hasta cuatro veces más rápido que su predecesor y mejora la fidelidad a las instrucciones. Mientras que los modelos a menudo tenían dificultades para mantener la coherencia de una imagen durante la edición, GPT Image 1.5 destaca por su capacidad para preservar la composición, la iluminación y los detalles finos.
Como explica Fidji Simo, director ejecutivo de aplicaciones de OpenAI: «Las nuevas pantallas de visualización y edición facilitan la creación de imágenes que coincidan con su visión o se basen en tendencias y filtros predefinidos».
Entonces, el núcleo de esta actualización es editar imágenes ya existentes. OpenAI dice que el modelo rastrea mejor la intención del usuario y modifica más «sólo lo que se solicita», preservando cosas como la iluminación, la composición y la consistencia de la apariencia de una persona entre iteraciones.
Hacia un estudio creativo integrado
Además del nuevo modelo GPT Image 1.5, OpenAI también añade un nuevo espacio Imágenes en ChatGPT, diseñado como un estudio creativo y presentado como un punto de entrada dedicado con estilos y sugerencias preestablecidos, así como una opción de carga de apariencia «una vez» para reutilizar la misma cara en creaciones posteriores.
El objetivo es acercar la idea del usuario a su ejecución visual, permitiendo retoques precisos y rápidos. “Cuando creas, deberías poder ver y dar forma a lo que imaginas”escribe Fiji Simo.
Este enfoque pretende atraer tanto a profesionales como a aficionados, haciendo que la creación visual sea más intuitiva y fiable.
Una respuesta al “Código Rojo”
Esta salida se produce en un contexto de intensa presión. Sam Altman, director general de OpenAI, había lanzado un «código rojo» interno para acelerar las innovaciones frente a Google, cuyo Nano Banana Pro impresionó por su capacidad para gestionar texto en imágenes y producir diagramas coherentes.
GPT-Image 1.5 es una respuesta directa a Nano Banana Pro. Habrá que ver cómo las redes sociales aprovecharán estas nuevas capacidades para medir si el impacto de este nuevo modelo es tan fuerte como el lanzamiento de la versión 1.0 o el lanzamiento de Nano Banana Pro.
Independientemente, OpenAI reconoce fácilmente que aún es posible avanzar mucho. Los resultados siguen siendo imperfectos en muchos aspectos y en algunos casos siguen siendo limitantes, en particular los estilos, las escenas con muchas caras y el uso multilingüe. Asimismo, el modelo todavía parece bastante limitado en sus formatos de imagen. En otras palabras, la herramienta progresa, pero no elimina la necesidad de realizar un control de calidad cuando la imagen se convierte en entregable.
Al final, con GPT Image 1.5, OpenAI intenta recuperar la ventaja en una carrera en la que Google ha tomado ventaja. Más rápido, más preciso y mejor integrado, este modelo ilustra una nueva etapa: transformar la generación de imágenes en una herramienta de producción fluida, al servicio de la creatividad y la eficiencia.
<
Lea también:
Nano Banana Pro: la IA de Google que dibuja imágenes con estilo
Un mes después de GPT-5.1, OpenAI ya lanza GPT-5.2 y lleva la IA a un nuevo nivel
Con GPT-5.1-Codex-Max, OpenAI lleva la IA de desarrollo a otra dimensión
OpenAI lanza su GPT 5.1, un modelo más eficiente pero sobre todo más “humano”
Claude Opus 4.5: Anthropic vuelve a golpear el techo de cristal de los LLM
Gemini 3 ya está aquí: la respuesta relámpago de Google para hacerse con el trono de la IA
[


