Aplicaciones

Operai obtiene la medalla de oro en las Olimpiadas de Matemáticas

Un modelo IA con razonamiento aún experimental y no disponible en público de OpenAI acaba de ganar la medalla de oro de las Olimpiadas Internacionales de Matemáticas. Un éxito que demuestra una noticia del tremendo progreso realizado por los modelos actuales para resolver problemas científicos y matemáticos, así como el grado de inteligencia cognitiva alcanzada. El hombre aún no está abrumado por Math Ai, pero ya es en gran medida igualado.

« Estoy encantado de anunciar que nuestro último modelo experimental de razonamiento en @openai acaba de lograr un gran desafío en inteligencia artificial: obtener una actuación digna de una medalla de oro para la competencia matemática más prestigiosa del mundo, las Olimpiadas Internacionales de Matemáticas (IMO) ». Fue a través de este tweet que Alexander Wei, un investigador científico de Operai, dio a conocer las noticias.

Una medalla de oro con Olimpiadas Internacionales de Matemáticas (OMI) es Una de las distinciones más prestigiosas Que un estudiante universitario (de MIT, Stanford, EPFL o equivalente) puede obtener en el campo de las matemáticas. IMOS reúne a más de 600 talentos jóvenes de más de 100 países cada año para resolver dificultades extremasMás de dos días de eventos de las 4:30 am cada uno. Allá » Medalla de oro »Recompensa a los participantes que se encuentran entre los mejores del ranking del mundo (aquellos que obtienen al menos 35 puntos de los 42 posibles). Los problemas cubren áreas como la geometría, la combinatoria, la aritmética y el álgebra, y requieren mucho más que el conocimiento escolar: la intuición, el rigor y la inventiva son esenciales.

Una hazaña significativa para la IA

Obtener una medalla de oro es un logro importante para OpenAi R&D Y más generalmente de la investigación. » Hemos evaluado nuestros modelos sobre los problemas de la OMI 2025, respetando las mismas reglas que los participantes humanos: dos sesiones de examen de las 4:30 a.m. cada uno, sin herramientas o acceso a Internet, leyendo las declaraciones oficiales de los problemas y escribiendo demostraciones en lenguaje natural Explica Alexander Wei.

El nuevo modelo no era perfecto, pero era lo suficientemente brillante como para cosechar la medalla de oro. » Durante nuestra evaluación, el modelo resolvió 5 de los 6 problemas de la OMI 2025 (resolvió los problemas p1 a p5 pero no proporcionó ninguna solución al problema p6) » explica Alexander Wei. «Para cada problema, tres ex medallistas de la OMI corrigieron independientemente la evidencia presentada por el modelo, los puntajes se validaron solo después de un consenso unánime. ¡El modelo obtuvo un total de 35 puntos de 42, lo cual es suficiente para ganar una medalla de oro!»

En Este éxito es importante en más de un sentido. Primero porque resolver problemas de OMI requiere Un nivel creativo de pensamiento sostenido cuya IA hasta ahora no ha podido. La prueba de que los modelos de razonamiento de LLM pueden ser más creativos, más confiables y más eficientes que algunos detractores expertos como Yann Lecun o Luc Julia no quieren admitirlo.

Luego, el modelo AI utilizado por OpenAI no fue diseñado específicamente para resolver problemas matemáticos, sino como un sistema de razonamiento general Usando lenguaje natural. Este resultado demuestra que un Versátil IA puede superar los modelos hiper especializadosIncluso en matemáticas de alto nivel.

« Para progresar aquí, tuvimos que ir más allá del paradigma clásico de fortalecer el aprendizaje (RL), basado en recompensas claras y fáciles de controlar. Por lo tanto, hemos obtenido un modelo capaz de elaborar un razonamiento sofisticado y perfectamente riguroso, comparable a los de un matemático humano » Alexander Wei dice.

El OpenAi AI que acaba de obtener esta medalla de oro todavía solo se explora (¿una especie de modelo «O5»?) Y no es el futuro modelo GPT-5 cuya salida se anuncia para «pronto». » No planeamos hacer que un modelo sea accesible con tal nivel en matemáticas durante varios meses ”. También admite Alexander Wei, quien reconoce de paso que el estilo de expresión del modelo es » muy especial «, Este último es» realmente experimental ».

Lanzamiento Grok 4, la semana pasada, Elon Musk explicó con su legendario optimismo que su IA » podría Descubra nuevas tecnologías para fin de año «E incluso» Descubra una nueva física el próximo año ». La predicción puede no ser tan utópica al final como se podría pensar. El nuevo modelo Operai demuestra la creciente capacidad de IA para razonar de manera abstracta y sugiere en paralelo que realmente podrían pronto contribuir significativamente a la investigación científica.


Y ya una controversia

Poco después de la publicación de OpenAI, aparecieron múltiples mensajes en X para señalar que Optaii había llevado a cabo su experimento en sus labos Sin embargo, los organizadores de la OMI confirmaron haber validado las respuestas generadas por el modelo sin haber podido validar cómo se habían obtenido estas respuestas.
Por lo tanto, deberíamos ver a otros actores anunciar sus puntajes en los próximos días ver las próximas horas. Sin embargo, según los resultados preliminares publicados por Matharena Ninguno de los modelos evaluados oficialmente ha obtenido incluso la medalla de bronce. Gemini 2.5 Pro obtuvo el mejor puntaje con 13 puntos (una puntuación del 31%) por delante de OpenAI O3-High (y su puntaje del 16%), OpenAi O4-Mini-High (y su puntaje del 14%), así como Grok 4 (y su puntaje del 11.9%lejos de Elon Musk).
Queda por ver si Google DeepMind, Harmonic y otros actores de IA también han realizado pruebas sobre IA experimental y qué puntajes obtuvieron …


Leer también:

Grok-4 y pesado: Xai acelera, OpenAi bajo presión

¡Openai da noticias de GPT-5!

¿Los modelos LLM actuales ya son demasiado inteligentes para obedecernos a ciegas?

AI: ¡Los modelos de razonamiento también alcanzarán rápidamente un techo!

[

Related posts
Aplicaciones

Se informa que Microsoft está preparando una revisión de Teams para julio

Después de mucho tiempo acumulando conversaciones, canales, reuniones, archivos, apps…
Read more
Aplicaciones

El nuevo Siri ya casi está aquí... pero no en la UE

Después de años de confundir un asistente inteligente con un temporizador parlante, Apple quiere…
Read more
Aplicaciones

LibreOffice saca la regla de madera... y duele

Presentado como una alternativa de oficina europea a Microsoft 365 y Google Docs, Euro-Office no ha…
Read more

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *