Operai revive el juego con «GPT-OSS» 20B y 120B, dos modelos de razonamiento, potente y abierto, capaz de ejecutar localmente, interactuar con herramientas y adaptarse a las necesidades comerciales. Entre la estrategia de apertura y la respuesta a la presión competitiva, la IA de la Batalla de los Negocios se ha intensificado nuevamente.
Es un poco del verano del verano. Todo el ecosistema de IA está esperando impacientemente el anuncio de GPT-5, un poco como si vemos una tormenta de verano: todos saben que él llega, pero nadie sabe la fecha exacta. Muchos habían apostado el 5 de agosto … se lo extrañó. Operai lanzó dos nuevos modelos ayer. ¡Pero ninguno es GPT-5! Sin embargo, Operai realizó una promesa hecha a principios de año ayer: revelando su primer LLM «abierto» desde su ancestral y olvidado «GPT-2». Un anuncio más político y estratégico de lo que parece.
De hecho, Sam Altman había hecho la promesa al comienzo del año: Openi se volvería a conectar en el año con la fuente abierta. Y no es un modelo, sino dos (una derivada del otro) que la startup insignia de la IA ha presentado esta semana. En este caso, dos modelos de razonamiento «abierto» en el sentido abierto-Baptizado por el sentido » GPT-OSS-120B »Et« GPT-OSS-20B ».
Sous Licencia Apache 2.0, Son descargables y ejecutables localmentecon Actuaciones anunciadas cerca de los modelos «OpenAi O». Por lo tanto, es la primera vez desde GPT-2 (2019) que Optaai reabría así sus pesos de una LLM, incluso si la compañía ya ha publicado otros modelos abiertos en los últimos años para comenzar con el esencial Whisper 3. Estos nuevos modelos están diseñados para operar fuera de línea, ejecutar localmente e incluso ir a la nube OpenAI, y si el usuario desea las características y las habilidades que tienen.
Con sus nuevos modelos «GPT-OS», OpenAi, por lo tanto, revive su nombre y su misión inicial de apertura, al menos en parte. Pero no nos equivoquemos: la presión competitiva de los modelos abiertos (LLAMA, Mistral AI) y el terremoto causado al comienzo del año por Deepseek R1 han contribuido en gran medida a este gesto, así como a la imagen hecniada de una sociedad que se ha cerrado demasiado. El contexto del enfrentamiento con Elon Musk, que reprocha a Openai por haber traicionado su vocación, pesa tan pesado en esta decisión: la apertura no solo es un altruista, es un reposicionamiento estratégico para contrarrestar el argumento caprichoso del multimillonario que multiplica los ataques y los procedimientos para evitar que OpenAi evite la evolución hacia una estructura completamente orientada hacia las perforaciones.
En detalle, GPT-OSS-120B Objetivos de implementaciones de centros de datos o estaciones de alta gama, con una posible ejecución en una sola GPU con 80 GB de RAM: en el lado de rendimiento, resulta estar muy cerca de los excelentes modelos patentados «OpenAi O3» y «OpenAi O4-Mini» en los puntos de referencia principales del razonamiento. La arquitectura de la mezcla de experto limita los parámetros activados por Token (5.1 mil millones de parámetros activados en el modelo DI de los parámetros totales de 117 mil millones), optimizando el costo de la inferencia.
El modelo GPT-OSS-20BSe ejecuta con 16 GB de memoria en una PC con una NPU o una GPU y apunta a iteración rápida y uso en las afueras (borde), con resultados cercanos al nivel del modelo «OpenAI O3-Mini».
Sin embargo, es esencial recordar aquí que estos dos modelos «GPT-OS», al igual que sus principales competidores de Llama 4 de Meta y Mistral, no son modelos reales de «código abierto» en el sentido de OSI. Estos son modelos de «peso abierto», lo que significa que solo los pesos del modelo son publicados y reutilizables, pero que el código de entrenamiento y especialmente los datos utilizados para el entrenamiento permanecen bajo el bushel. En otras palabras, está abierto para su uso y personalización, no para la auditoría completa del sector de capacitación.
Concretamente, ¿qué pueden hacer las empresas con modelos tan abiertos? Acomode los modelos en su propio infra, mantenga datos en el sitio, ajuste finamente los modelos (ajuste de parámetro completo) para alinearlo con sus datos y políticas, controlar la latencia y combinar la IA local con llamadas API para funciones adicionales (por ejemplo, la generación de imágenes).
Openai Selon, Sus dos modelos abiertos han sido optimizados para el uso de herramientas (En otras palabras, no solo son buenos para responder preguntas y escribir texto, sino que también pueden activar acciones, ejecutar código e interactuar con entornos técnicos), Generación de código en Integración en agente Worksflows.
Además, ofrecen Un alto grado de personalización. Por lo general, permiten que las empresas funcionen Usted ajusta completoEs decir, releer el modelo con sus propios datos para ajustar el tono, la especialización o la forma del razonamiento de la IA. Con tal «ajuste fino» equivale a modificar los parámetros internos del modelo. Esto permite, por ejemplo, especializarlo en idiomas y registros médicos, legales, técnicos o incluso raros. Incluso es posible personalizar el «esfuerzo cognitivo» Y, por lo tanto, para modular la profundidad del razonamiento, el estilo de escritura o el tipo de respuestas generadas, dependiendo del contexto y el uso.
Otro activo, estos modelos están diseñados para Orquestación de una agencia. Esto significa que pueden colaborar con herramientas externas, ejecutar código, usar complementos o API e incluso pilotar a otros agentes, como agentes que cuestionan bases de datos o administran acciones comerciales. La compañía puede decidir en particular en qué condiciones el modelo «refleja durante mucho tiempo», actúa rápidamente o delega una tarea.
Por último, pero no menos importante, Funcionan sin conexiónUna bendición para la soberanía y los casos confidenciales (especialmente aquellos que usan datos confidenciales).
Suficiente para preocupar a una competencia tan numerosa como lo está del lado de los modelos propietarios (OpenAi, pero también Google, Xai, Anthrope …) que en el lado «abierto» donde Meta (Llama) y la IA Mistral ya ocupan espacio (etc.) Es en este intenso campo de batalla que los modelos «GPT-OSS» tendrán que demostrar su valía y demostrar su simplicidad de despliegue, su capacidad de personalización y especialmente el costo total de posesión.
Más concretamente, Estos modelos están disponibles hoy en la cara de abrazocon guías oficiales. Operai ha preparado bien el campo y se ha permitido tiempo para seducir a los socios. Además de abrazar la cara, el editor también destaca Girub Para recursos y Ollama para la ejecución local. Estos modelos se pueden acomodar fácilmente hoy. Azur (a través de Azure Ai Foundry) ou AWS (a través de la roca madre). Pero Operai también anuncia asociaciones con Oh Suecia, Copo de nieve… e incluso Naranja ! Sí, el francés está en el bucle desde el primer día y ya anuncia una implementación en su infraestructura confiable para usos soberanos.
Para los CIO, este anuncio todavía cambia la ecuación ya que los modelos OpenAI son populares. De repente, la «opción On-Prem/Edge con un modelo de rango de cuasi propietario» se vuelve creíble: menos dependencia, mejor dominio de la latencia, costos de inferencia y cumplimiento. A cambio, será necesario asumir la complejidad de los MOPS, la seguridad de los modelos ajustados, la gobernanza de datos y la gestión del desempeño. Pero también ten cuidado con un defecto. Según OpenAi, sus dos modelos abiertos tienen protecciones sólidas contra los usos de riesgo (como las amenazas biológicas, por ejemplo), pero por otro lado tienen una tendencia más fuerte a alucinar que sus equivalentes de propietarios. Con una buena personalización y un contexto bien definido, este problema de alucinación debería estar bien controlado.
Leer también:
Operai lanza el «modo de estudio» en ChatGPT para estimular el aprendizaje de la IA
OpenAI formaliza el modo de agente de chatgpt en Francia
Mistral AI lanzó su primera IA de razonamiento con magistral
Un OpenAi AI obtiene la medalla de oro en las Olimpiadas de Matemáticas
Con Qwen 3, Alibaba ha destronado a Meta y Deepseek en el universo de los modelos abiertos IA
Meta revela Llama 4, nueva generación de IA multimodal
Mistral Ai se coloca en el audio y lanza Voxtral en código abierto
Phi-4, el nuevo modelo pequeño de Microsoft que razona como un gran
El pequeño granito 3.1 de IBM compite con los modelos gigantes de la IA
[


