Mientras que OpenAI apuesta por la compacidad de su GPT-4o mini, Meta está inflando su modelo LLama 3 en una variante que eclipsa a los LLM de vanguardia que son GPT-4o y Claude 3.5 Sonnet. Un hito para los modelos de código abierto.
LLama de Meta es el modelo de referencia para los modelos LLM de código abierto, el criterio con el que todos los competidores se comparan y evalúan. Más importante aún, LLama es el modelo de código abierto que todo servicio de “modelo como servicio” del mercado debe implementar. Se puede encontrar en Azure AI, Google Vertex AI y AWS Bedrock, entre otros.
El pasado mes de abril, Meta había conquistado a numerosas empresas e investigadores de IA con el lanzamiento de «LLama 3», la última versión de su LLM, con un rendimiento anunciado cercano al de Claude 3 Sonnet y Gemini Pro 1.5.
Luego, Meta presentó una versión «8B» y una versión «70B», aunque prometió una versión superior «400B» que soportaría alrededor de treinta idiomas, pero que nunca se materializó.
Esta semana, después de las filtraciones iniciales en Reddit, Meta y su laboratorio de inteligencia artificial “FAIR” anunciaron oficialmente “ Llama 3.1 » con disponibilidad de un modelo « 405B » (405 mil millones de parámetros) que, si se cree en los puntos de referencia, superarían al actual líder del mercado, «GPT-4o» de OpenAI, en varias pruebas de IA conocidas.
LLama 3.1 405B admite 8 idiomas (inglés, alemán, francés, italiano, portugués, hindi, español, tailandés) y sigue siendo un LLM basado en texto puro sin funciones multimodales (pero Meta afirma estar experimentando con multimodal para una futura evolución).
Con 405 mil millones de parámetros, LLama 3.1 405B es el más grande de los modelos LLM de código abierto, un modelo que no es realmente económico para ejecutar localmente en su centro de datos. Se entrenó con 15 billones de tokens de fuentes de noticias hasta enero de 2024.
Según los puntos de referencia publicados, esta es la primera vez que un modelo de código abierto compite tan de cerca con los mejores modelos «fronterizos» del mercado.
Por cierto, también observaremos que los modelos Llamada 3.1 8B y Llamada 3.1 70B También están logrando avances significativos, particularmente en áreas como el razonamiento matemático y la generación de códigos informáticos.
Estos resultados nos inspiran dos pensamientos:
En primer lugar, los modelos medianos como “LLama 3.1 70B” y “ GPT-4o mini » ahora parecen competir en relevancia con los modelos muy grandes y al mismo tiempo son mucho más fáciles y menos costosos de operar.
Por tanto, este salto cualitativo logrado con «LLama 3.1» debe necesariamente desafiar y preocupar a competidores en el universo del código abierto como Mistral AI. Por supuesto, la joven empresa francesa no se deja llevar. Su modelo «Mistral 7B» se considera un modelo de referencia que se puede ejecutar fácilmente a nivel local. Y la joven empresa acaba de lanzar, con » Mistral NeMo 12B «, su nueva generación pretende sustituir al «Mistral 7B» en aplicaciones de inteligencia artificial empresarial. Sin embargo, la competencia del «LLama 3.1 8B» promete ser feroz.
Mientras tanto, debemos reconocer que la innovación en IA sigue siendo tan efervescente como siempre y que, mes tras mes, el progreso es notorio y visible, acercándonos lenta pero seguramente a IA verdaderamente muy útiles o incluso a IA generalistas (AGI).
Actualizado el 23/07/2024:
El artículo original fue publicado unas horas antes del lanzamiento oficial de Llama 3.1. El artículo ha sido modificado con la información oficial publicada por Meta.
Lea también:
GPT-4o: Un poco más cerca de HAL y 2001…
Anthropic lanza Claude 3.5, que se anuncia como mejor que GPT-4o
OpenAI prescinde de observadores de Microsoft y Apple en su Junta Directiva
Proyecto Astra: la respuesta de Google a ChatGPT 4o
[

![Cariño, ups, hice la llama más grande [MAJ] 1 Llama 3](https://www.informatiquenews.fr/wp-content/uploads/2024/07/Llama-3-1024x709.webp)
![Cariño, ups, hice la llama más grande [MAJ] 3 Llama 31](https://www.informatiquenews.fr/wp-content/uploads/2024/07/Llama-31-1024x544.webp)
![Cariño, ups, hice la llama más grande [MAJ] 5 Llama 4](https://www.informatiquenews.fr/wp-content/uploads/2024/07/Llama-4-1024x709.webp)
