Aplicaciones

Operai se pregunta si Deepseek no ha bombeado su IA

Las dos compañías estadounidenses han lanzado una investigación a gran escala para averiguar si Deepseek no ha creado su famoso modelo «R1» destilando datos de los modelos Operai GPT-4O, usurpando así las propiedades intelectuales y las licencias de uso de las API de la startup estadounidense.

Veterano continúa alimentando los debates en torno al rendimiento y los costos de capacitación de su modelo de razonamiento «R1» que, en una semana, logró sacudir la confianza estadounidense en su superioridad tecnológica sobre la IA.

Y muchos se preguntan si la startup china no ha engañado un poco o incluso ha mentido no solo en sus capacidades materiales reales (que algunos suponen mucho superiores a lo que anuncia), sino también en la forma en que ha llevado a Deepseek R1, así como al modelo más clásico que lo sirve como una base de Deepsek S3.

Es cierto que el informe técnico de unas cincuenta páginas publicadas por los investigadores del disparo chino joven tiene algunas áreas grises, en particular en los juegos de datos utilizados, pero también en los modelos utilizados para el aprendizaje mediante el fortalecimiento automatizado (sin intervención humana). Porque incluso si Deepseek califica su modelo «R1» de código abierto, ahora parece obvio que responde más a la definición de un modelo abierto (o más exactamente 'peso abierto', como los meta modelos y los de Mistral) que un modelo de código abierto real a medida que califica el OSI. En efecto, Deepseek no ha publicado ningún código fuente de herramientas, códigos de capacitación e instrucciones de capacitación utilizadas para entrenar R1. También es suficiente para explorar la documentación del proyecto «Open R1» lanzado en la plataforma de abrazos de abrazos para medir el alcance de los elementos que faltan para hacer de R1 un modelo real de «código abierto». Y esta falta de transparencia podría traducir algunos pequeños secretos gloriosos.

En cualquier caso, esto es lo que Microsoft y OpenAi que acaban de abrir una encuesta por violación de las condiciones de uso CATGPT y GPT-4O. Más concretamente, OpenAi acusa a la nueva empresa china profunda de haber usado, a través de la llamada técnica de «destilación», las salidas de sus modelos propietarios para formar su propio modelo de competidor de código abierto. La destilación es una técnica común en la industria de IA y permite que un modelo más pequeño aprenda de los resultados generados por un modelo más grande, pero OpenAI le preocupa que Deepseek lo emplee con el objetivo explícito de reproducir y competir ChatGPT.

En un comunicado, OpenAI afirma tener evidencia sin revelarlas: » Sabemos que las empresas con sede en China, y otras, tratan constantemente de reproducir los modelos de las principales empresas estadounidenses de IA. ». Y para agregar » Estamos implementando contramedidas para proteger nuestra propiedad intelectual, incluido un proceso cuidadoso de selección de capacidades avanzadas para incluir en los modelos publicados, y creemos que es crucial, para el futuro, trabajar estrechamente con el gobierno estadounidense para proteger mejor los modelos más eficientes contra los intentos de los adversarios y competidores a la tecnología estadounidense apropiada estadounidense American Technology. ».

En cualquier caso, este es un asunto que no está listo para salir y que molesta a muchas certezas estadounidenses sobre su supremacía y los méritos de sus medios de inversión.

Todavía se recordará que muchas de las optimizaciones y tecnologías utilizadas por Deepseek también son exploradas por otros actores de IA para comenzar con la startup francesa Mistral AI, que también logra competir con gigantes tecnológicos a pesar de los presupuestos muy bajos. Las técnicas de aprendizaje de Moe, Mamba y Fortalecimiento se han controlado y utilizado durante mucho tiempo en modelos de IA distrales. Solo queda esperar que Deepseek haya demostrado al final especialmente que es posible desestabilizar las certezas estadounidenses y que Europa, con actores como la IA Mistral, también puede innovar e imponerse en el mercado de IA.

Leer también:

Deepseek R1, el modelo chino de código abierto IA que desata pasiones [MAJ]

Después de R1, DeepSeek altera el mundo de IA Generator con Janus-Pro

Tendencias 2025: Los cuatro cambios principales en la IA en los negocios …

Openai anuncia «O3»: ¿sucesor del modelo «O1» pero más peligroso?

[

Related posts
Aplicaciones

Se informa que Microsoft está preparando una revisión de Teams para julio

Después de mucho tiempo acumulando conversaciones, canales, reuniones, archivos, apps…
Read more
Aplicaciones

El nuevo Siri ya casi está aquí... pero no en la UE

Después de años de confundir un asistente inteligente con un temporizador parlante, Apple quiere…
Read more
Aplicaciones

LibreOffice saca la regla de madera... y duele

Presentado como una alternativa de oficina europea a Microsoft 365 y Google Docs, Euro-Office no ha…
Read more

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *