A raíz del anuncio de nuevos modelos «GPT 4.1» dedicados a su plataforma API y desarrolladores, OpenAI se lanza en ChatGPT Otros dos nuevos modelos de razonamiento, «O3» y «O4-Mini», muy integrados con características avanzadas de investigación web, análisis de datos y comprensión de imágenes. El editor también presenta un nuevo agente «Codex-Cli» …
Definitivamente, se mueve mucho en este momento en Operai, incluso si la compañía parece tener problemas para definir una hoja de ruta clara a largo plazo. Después de estar interesado al comienzo de la semana en las aplicaciones de desarrolladores y IA corporativas con sus API «GPT 4.1», OpenAI acaba de cambiar su rango de modelos «O – Series» que ya se ha integrado bien con ChatGPT y sus características avanzadas (como investigación web, análisis de datos avanzados, generación de imágenes).
«OpenAi O3» es el modelo más talentoso en OpenAi. En la gestación desde finales del año pasado, nunca debe publicarse oficialmente (incluso si Microsoft lo usa para la investigación de agente profundo de Copilot para Microsoft 365). Cambio de plan para compensar el retraso tomado por GPT-5, «O3» aparece en API y en ChatGPT. Reemplaza oficialmente «O1» y se convierte en la nueva punta de lanza del razonamiento en profundidad.
«Abierto ai o4 -mini» Reemplaza «O3-Mini» y aparece como una declinación aligerada de «O3», pensado para la reactividad y el control de costos. Si «O3» favorece la profundidad de reflexión, «O4-Mini» favorece la eficiencia.
Rendimiento avanzado
Ambos superan a sus predecesores en varios puntos de referencia de referencia, desde Codefoces hasta MMMU.
Por lo tanto, muestran significativamente mejor en las tareas de programación y la resolución de problemas matemáticos complejos.
También son mucho más altos en cuestiones científicas y de investigación.
Finalmente, son muy buenos para analizar imágenes y gráficos.
Por su razonamiento avanzado, se recomienda estos modelos para animar a los agentes de IA y son considerados por OpenAI como los mejores pilares actuales para la IA agente.
La base funcional de estos dos nuevos modelos es idéntica: acceso simultáneo a las completaciones y respuestas de chat de API, la síntesis de razonamiento integrado en la salida, la llamada paralela de herramientas, incluida la navegación web, la ejecución de pitón y la generación de imágenes y el cuidado nativo de la visión.
Los equipos de Operai subrayan eso » Por primera vez, nuestros modelos de razonamiento pueden usar de forma independiente todas las herramientas de chatgpt », Declaración que traducen en manifestaciones donde el agente se acerca en un póster científico, desencadena una investigación externa y luego regresa para comentar sobre el gráfico obtenido.
Los requisitos de ciberseguridad no se sacrifican: nuevos juegos de rechazo en el monitor Biorisk, LLM alineados con el marco de preparación y el puntaje de detección de alrededor del 99 % en las campañas internas del equipo rojo. Los gerentes de seguridad también apreciarán la trazabilidad; El resumen de razonamiento proporcionado por la API se puede revelar para auditoría o explicación, sin exponer todo el contexto del usuario.
Un agente inesperado: Codex-Cli
En paralelo, OpenAI lanza Codex -CLI, un agente publicado en Open -END -backing que se realiza localmente en el «Terminal» (en MacOS, Linux pero también Windows a través de WSL2). La idea es minimalista pero estúpidamente útil para usuarios y desarrolladores avanzados: conecte el modelo (O3 u O4 – Mini, GPT – 4.1 por venir) al sistema de archivos de usuario, acepte capturas de pantalla o bocetos de confianza, luego razone en el código in situ. Para entornos sensibles, este enfoque evita la copia de los depósitos a un servicio externo y simplifica la integración en el CI/CD o las tuberías internas de SOC.
« Puede beneficiarse del razonamiento multimodal desde la línea de comando enviando capturas de pantalla o bocetos de baja fidelidad al modelo, combinado con el acceso local a su código. Consideramos este agente como una interfaz mínima para conectar nuestros modelos a los usuarios y sus computadoras. Codex CLI es completamente abierto y está disponible hoy en github.com/openai/codex Explica el editor.
La startup también ha anunciado una iniciativa de $ 1 millón para admitir proyectos similares en mente a Codex CLI y utilizando sus modelos OpenAI, con 25,000 dólares subsidios en forma de créditos API.
Para CIO y RSSI, O3 se convierte en la elección natural tan pronto como se requiere un razonamiento largo y multimodal; O4 -Mini se hace cargo de las cargas con un alto volumen donde el costo por solicitud y la latencia son decisivos. Los dos motores comparten la misma capa de seguridad y la misma capacidad para orquestar herramientas, abriendo el camino a los agentes híbridos capaces de diálogo, código y actuar sobre los sistemas internos mientras permanecen de acuerdo con las políticas de gobernanza más estrictas. Para usos de chatbot más clásicos, se debe recomendar el uso de API del modelo «GPT 4.1» (especialmente «mini» y «nano») porque es mucho menos costoso.
Leer también:
Anthrope está lanzando su profunda «investigación» para Claude y se unió a su IA en el espacio de trabajo de Google
Hacia la automatización «agente»: Microsoft presenta el «uso de la computadora» en Copilot Studio
Operai también llega a los modelos «nano» con GPT 4.1
Google lanza Gemini 2.5 Flash, un modelo que razona a bajo costo …
[





