Unas semanas después de la llegada del soneto de Claude 3.7, el primer modelo IA Hybrid Mezcle Classic LLM y el razonamiento de antrópico, y por delante de la llegada ansiosamente esperada de GPT-5 (el primer modelo híbrido OpenAI GPT), Google formaliza su primer modelo híbrido y primer modelo de la familia «Gemini 2.5».
Desde la llegada de los modelos OpenAI O1, entonces O3, la humanidad ha descubierto que la IA generativa podría tomarse el tiempo para reflexionar antes de responder y, por lo tanto, razonar. Desde entonces, los diferentes actores de IA no solo están buscando ponerse al día con las capacidades de razonamiento de Operai O3, sino también simplificar la experiencia de los usuarios al evitar que tengan que elegir entre modelos de IA clásicos y modelos de IA con razonamiento.
Por lo tanto, hace unas semanas, Operai anunció su deseo de fusionar sus modelos de tipo «GPT» y tipo «O1/O3» para dar a luz a GPT-5 y que Anthrope lanzó su excelente y sorprendente soneto «Claude 3.7 soneto» con un modo de razonamiento «normal» o «extendido» según sus necesidades.
Historia de no dejar que sus competidores ocupen el campo, Google había iniciado a principios de año un modelo experimental llamado «Gemini 2.0 Flash Thinking Experimental». Pero el editor continúa sus esfuerzos de innovación y ya anuncia no solo el próximo lanzamiento de una nueva familia completa de modelos de IA diseñados para «pensar» antes de responder preguntas, sino también la disponibilidad inmediata del modelo más avanzado de esta nueva familia «Gemini 2.5 Pro»!
Un modelo de «pensamiento» a la vanguardia de la tecnología
« Gemini 2.5 es un modelo de pensamiento, capaz de razonar a través de sus pensamientos antes de responder, lo que resulta en un mejor rendimiento y una mayor precisión«Explica Koray Kavukcuoglu, CTO de Google Deepmind en una publicación de blog. Este enfoque permite que el modelo analice información, extrae conclusiones lógicas e incorpore contexto y matices en sus decisiones utilizando un proceso conocido como» cadena de pensamiento «.
« Durante mucho tiempo, hemos explorado los medios para hacer que la IA sea más inteligente y más capaz de razonar gracias a técnicas como el fortalecimiento del aprendizaje y la cadena de pensamiento. En esta continuidad, recientemente presentamos nuestro primer modelo de razonamiento, Gemini 2.0 Flash Thinking Explica Koray Kavukcuoglu. » Ahora, con Gemini 2.5, hemos alcanzado un nuevo nivel de rendimiento al combinar un modelo básico considerablemente mejorado con un post-entrenamiento perfeccionado. En el futuro, integramos estas capacidades para la reflexión directamente en todos nuestros modelos, para que puedan administrar problemas más complejos y apoyar a los agentes aún más eficientes y conscientes del contexto.«
El primer modelo de esta nueva generación, Gemini 2.5 Pro Experimental, ya está disponible en Google AI Studio y en la aplicación Gemini para usuarios de Gemini Advanced, ¡incluso en Europa! Pronto será accesible en Vertex AI, la plataforma de Google Cloud para empresas y la creación de aplicaciones de IA.
Rendimiento que excede las referencias del sector
Google afirma que Gemini 2.5 Pro se ubica en la parte superior de la clasificación de Lmarena, que mide las preferencias humanas, con un margen significativo. El modelo también tiene capacidades sólidas de razonamiento y codificación, que dominan en los puntos de referencia actuales en estas áreas.
« Gemini 2.5 Pro está a la vanguardia de la tecnología en una serie completa de pruebas que requieren razonamiento avanzado«, Dice el CTO de Google Deepming. Sin usar técnicas de optimización que hinchan los costos, el modelo se destaca en puntos de referencia matemáticos y científicos como GPQA y me gusta 2025.
También obtuvo una puntuación del 18.8% en el «último examen de la humanidad», un conjunto de datos diseñados por cientos de expertos para capturar la frontera humana del conocimiento y el razonamiento.
Capacidades de codificación avanzadas
« Nos centramos en el rendimiento de la codificación, y con Gemini 2.5, dimos un gran salto hacia adelante en comparación con la versión 2.0«También dice Google. Según el editor, su nuevo modelo se destaca en la creación de aplicaciones web visualmente atractivas y aplicaciones de código de agente, así como en la transformación y edición de código.
En la verificación de SWE-Bench, la referencia del sector para las evaluaciones de código de la agencia, Gemini 2.5 Pro obtiene una puntuación del 63.8% con una configuración de agente personalizada.
https://www.youtube.com/watch?v=rlcbspgos6s<
Una ventana de contexto extendida
Géminis 2.5 se basa en las fortalezas de los modelos de Géminis anteriores: multimodalidad nativa y gran ventana de contexto. Se entrega con una ventana de contexto de un millón de tokens (dos millones en pronto), lo que permite comprender grandes conjuntos de datos y procesar problemas complejos provenientes de diferentes fuentes de información: texto, audio, imágenes, video e incluso estándares de código entero.
Google aún no ha comunicado el precio de la API de Gemini 2.5 Pro, pero promete información sobre esto en las próximas semanas.
En un contexto en el que los principales jugadores tecnológicos como OpenAI, Anthrope, Deepseek y XAI desarrollan todos sus propios modelos de razonamiento, este anuncio reposiciona Google en la carrera por la innovación en el campo de la IA generativa, con una nueva familia 2.5 de modelos aún más adecuados para los desafíos de las empresas y la creación de agentes autónomos capaces de realizar tareas complejas con una intervención humana mínima.
[


