Entrenado en particular con los Tweets de los internautas pero también con muchas otras fuentes de datos, Grok-2 resulta ser un LLM multimodal de última generación, capaz de competir con GPT-4o, pero con un marcado humor sarcástico y filtros reducidos al mínimo estricto, dejándole mucho margen de maniobra para descarrilar.
Seamos sinceros, la primera IA conversacional lanzada en 2023 desde los laboratorios de xAI, la última startup de Elon Musk, no convenció a mucha gente. La joven compañía anunció la semana pasada la disponibilidad en X (ex-Twitter) de sus nuevos modelos Grok-2 y Grok-2 mini.
Presentado como un “modelo de frontera”, es decir un LLM muy grande, Grok-2 logra avances notables tanto en sus capacidades conversacionales como en sus capacidades de razonamiento y codificación.
Según xAI, el rendimiento de Grok-2 sería muy similar al de Gemini 1.5 Pro, Claude 3.5 Sonnet y GPT-4o. La nueva IA incluso los superaría en algunos benchmarks populares, especialmente aquellos que requieren razonamiento matemático.
Además, Grok-2 Ahora es multimodal: puede analizar imágenes pero también generarlas a partir de un mensaje de texto.
Grok-2 mini es una versión más compacta y rápida (muy rápida incluso según nuestras pruebas) de Grok-2 que ofrece un rendimiento ligeramente inferior en sus capacidades de análisis y discusión. Aunque más compacta, la IA sigue siendo multimodal con capacidades de análisis y generación de imágenes.
¿IA liberada o en decadencia?
Sin embargo, uno de los elementos que más diferencia a Grok-2 de sus pares es la relativa ausencia de filtros. Se le puede hacer decir cualquier cosa y generar cualquier cosa con facilidad. Sabiendo que ha sido entrenado con todos los tuits publicados por todo el planeta, el “cualquier cosa” puede convertirse realmente en “realmente cualquier cosa” en la más pura filosofía de “libertad de expresión” que reivindica Elon Musk. Como resultado, desde hace tres días, las imágenes Deepfake se han multiplicado en X y en la web, sin que la IA se niegue a crear falsificaciones a partir de retratos de estrellas y políticos.
Y, como es inevitable, las críticas no paran de llegar. Alejandra Caraballo, profesora de la Clínica de Derecho Cibernético de la Universidad de Harvard, considera que se trata de » de una de las implementaciones de IA más irresponsables e imprudentes jamás vistas ».
Sin embargo, Grok-2 no está exento de sus propios filtros. Las actividades violentas son generalmente detenidas y la generación de imágenes bloquea las sugerencias pornográficas (aunque es posible crear una imagen falsa de prácticamente cualquier persona en ropa interior). Sin embargo, según algunos expertos, es bastante fácil falsificar Grok para eludir sus filtros ya de por sí débiles simulando que se está investigando un tema médico o científico.
Es muy probable que la Comisión Europea -que ya tiene a X en la mira por desinformación e incumplimiento de las normas de moderación de contenidos ilegales- se muestre menos entusiasmada y divertida con las payasadas de Grok-2, una IA considerada por Elon Musk como » La IA más divertida de todas ».
XAI anuncia que las API para acceder a Grok-2 en clústeres alojados en la nube estarán disponibles próximamente con sistemas de autenticación MFA para empresas. Queda por ver si muchos se sumarán a los conceptos de «libertad de expresión» de Elon Musk y se atreverán a utilizar un modelo con filtros tan permisivos en un entorno profesional.
Lea también:
Grok AI, la nueva IA infantil terrible de Elon Musk
Elon Musk relanza la lucha legal contra OpenAI
OpenAI responde abiertamente a las acusaciones de Elon Musk
Mistral lanza la segunda generación de su gran LLM: Mistral Large 2
Cariño, ups, hice la llama más grande
[


