Aplicaciones

Microsoft lanza su modelo creativo interno MAI-Image-1

Poco a poco, paso a paso, la división de IA de Microsoft va dejando su huella y ganando impulso. Después de lanzar el pasado mes de septiembre una vista previa de su modelo básico “MAI-1-Preview” y de su potente modelo de voz “MAI-Voice-1”, ambos ya parcialmente explotados por Copilot, la división de IA de Microsoft presenta su primer modelo de generación de imágenes, que ya compite con GPT-Image-1 y Google Imagen 4.

La división de IA de Microsoft se ha consolidado en los últimos meses como un laboratorio bastante ágil y bastante ambicioso, dedicado a crear modelos de inteligencia artificial diseñados para enriquecer las experiencias humanas. Su credo: desarrollar una IA que sea útil, responsable y profundamente integrada en usos reales.
Nació del deseo de Satya Nadella de darle a Microsoft más independencia en términos de modelos básicos de IA, un deseo que comenzó a materializarse brevemente en el momento de la expulsión de Sam Altman de OpenAI antes de su regreso triunfal unos días después.

Después de presentar sus primeros modelos internos en agosto de 2025, a saber Vista previa de MAI-Voice-1 y MAI-1modelos que el editor está poniendo a prueba gradualmente a través de ciertos escenarios de Copilot y Copilot 365, Microsoft continúa su impulso con MAI-Imagen-1su primer generador de imágenes desarrollado íntegramente internamente.

Un modelo esencialmente fotorrealista

MAI-Image-1 marca un paso estratégico en el empoderamiento tecnológico de Microsoft, que durante mucho tiempo ha dependido de los modelos OpenAI. Este nuevo modelo fue diseñado para satisfacer las necesidades concretas de los creadores, prestando especial atención a la diversidad visual, la fotorrealidad y la velocidad de ejecución. El equipo de IA de Microsoft insiste en que este modelo fue diseñado para “ Evite representaciones repetitivas o demasiado estilizadas. » centrándose en una selección rigurosa de datos y una evaluación detallada de casos de uso creativos.

El modelo destaca especialmente en la gestión de la luz (reflejos, iluminación indirecta) y en la generación de paisajes realistas. Destaca por su capacidad para producir imágenes de calidad sin dejar de ser rápido, permitiendo a los usuarios pasar de la idea a la pantalla en un abrir y cerrar de ojos. Como resume Mustafa Suleyman, director ejecutivo de la división de IA de Microsoft: “ MAI-Image-1 logra un equilibrio impresionante entre velocidad de generación y calidad. Esperamos seguir mejorándolo y escalar puestos en el ranking. «. Esta clasificación, de hecho, es la de LMArena, una plataforma comunitaria de evaluación comparativa dedicada a los modelos de generación de imágenes. MAI-Image-1 hizo una entrada notable en el top 10, en el noveno lugar. Una puntuación honorable para un modelo de primera generación, especialmente frente a gigantes ya consolidados.

Microsoft anuncia que MAI-Image-1 pronto estará disponible en Copilot y Bing Image Creator. El modelo, como los dos anteriores, también estará disponible en Azure AI Foundry, pero inicialmente solo en versión preliminar privada. Pero todo el mundo ya puede probarlo a través de LMArena.

Una dura competencia

Pero la competencia sigue siendo feroz. Aunque hoy en día se habla mucho de modelos de generación de vídeo con el lanzamiento de Google VEO3 y más aún del espectacular SORA 2 de OpenAI, la generación de imágenes mediante IA es un mercado ya consolidado que ha encontrado en gran medida su lugar en las cadenas de producción de contenidos de los medios de comunicación, los anunciantes, los influencers de las redes sociales y los equipos de marketing.

Y este mercado de generación de imágenes fijas ya está dominado por actores poderosos y variados. OpenAI ofrece gpt-image-1, reconocido por su coherencia estilística y su fluida integración con ChatGPT, pero también con las herramientas Copilot de Microsoft. OpenAI lanzó recientemente una versión “gpt-image-1-mini” que es muy rápida y un 80% menos costosa. Google apuesta por Gemini/Imagen, que brilla por su capacidad para interpretar indicaciones complejas con gran fidelidad visual. ByteDance, con su modelo de la familia Dreamina, destaca por sus representaciones muy expresivas, a menudo populares en los mundos creativos asiáticos. Stability AI sigue siendo un pilar de Stable Diffusion, apreciado por su modularidad y su ecosistema de código abierto. Midjourney, por su parte, seduce por su estética artística y su comunidad muy activa. Finalmente, Tencent ha logrado imponer sus modelos internos, a menudo orientados hacia usos comerciales y publicitarios a gran escala.

Con MAI-Imagen-1Microsoft no sólo busca ponerse al día: quiere redefinir los estándares de las imágenes generadas por IA. Y si el noveno puesto es sólo el comienzo, ya demuestra una ambición clara: la de construir, paso a paso, una alternativa creíble e innovadora en un panorama tecnológico en pleno apogeo.

Lea también:

Microsoft lanza 2 modelos internos de IA y muestra su independencia de OpenAI

OpenAI alcanza los 500.000 millones de dólares y presenta Sora 2: la IA de vídeo que desafía a TikTok y las redes sociales

Google Gemini 2.5 Flash Image: un nuevo modelo bueno para editar

OpenAI mejora las capacidades de generación de imágenes de ChatGPT

[

Related posts
Aplicaciones

Se informa que Microsoft está preparando una revisión de Teams para julio

Después de mucho tiempo acumulando conversaciones, canales, reuniones, archivos, apps…
Read more
Aplicaciones

El nuevo Siri ya casi está aquí... pero no en la UE

Después de años de confundir un asistente inteligente con un temporizador parlante, Apple quiere…
Read more
Aplicaciones

LibreOffice saca la regla de madera... y duele

Presentado como una alternativa de oficina europea a Microsoft 365 y Google Docs, Euro-Office no ha…
Read more

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *