Frente a una mayor competencia en el campo de la IA generativa, Anthrope reinventa su estrategia con Claude 4, combinando un mayor rendimiento en la programación y la autonomía conductual sin precedentes, aunque un poco inquietante.
Frente a la feroz competencia de Operai y su formidable modelo O3, por Google cuyo modelo Gemini 2.5 Pro ha hecho un progreso deslumbrante y la popularidad de un XAI Grok 3, Anthrope tuvo que reaccionar. Sus modelos Claude 3.7 estaban claramente retrocedidos en nuestras pruebas.
Y eso es exactamente lo que hizo Anthrope anoche. Su respuesta se debe en dos nuevos modelos: Claude Opus 4 y Claude Sonnet 4. Como veremos, estos últimos establecen nuevos estándares, especialmente en términos de programación automatizada (decididamente, todos los actores continúan destacando las cualidades de codificación de su IA mucho antes de sus cualidades editoriales o de análisis de datos). Pero también plantean nuevas preguntas sobre la autonomía de los agentes de IA con comportamientos autónomos que cuestionan si se cree que los documentos técnicos son publicados por el editor. Anthrope, que se dirige a $ 12 mil millones en ingresos en 2027 contra 2.2 mil millones esperados este año, juega en grande con Claude 4.
Actuaciones que redefinen los estándares de codificación asistidos
Las cifras hablan por sí mismas: con el 72.5% para Opus 4 y 72.7% para el soneto 4 en el banco de referencia verificado, Anthrope ahora supera a sus principales competidores. Operai Codex muestra 72.1%, mientras que O3 Caps al 69.1%y Gemini 2.5 Pro con 63.2%. Este avance técnico convenció a GitHub de integrar Sonnet 4 como el motor de su agente de programación en copiloto. Dice mucho sobre la importancia de este tipo de capacidad: el mercado más grande de la IA hoy parece ser el de desarrollar asistencia. Para preguntarse si no está en este terreno que la IA finalmente ya se muestra significativamente superior a los humanos.
La fuerza Opus 4 radica en su capacidad para mantener un rendimiento sostenido en tareas complejas a largo plazo. Yusuke Kaji, director general de AI en Rakuten, testifica: » Cuando nuestro equipo desplegó Opus 4 en un complejo proyecto de código abierto, codificó de forma independiente durante casi siete horas, un gran salto en las capacidades de IA que sorprendió al equipo. »
Además, los modelos parecen particularmente adecuados para la era de los agentes, especialmente cuando se activa su método avanzado de reflexión.
Por cierto, debe tenerse en cuenta que antrópico reintroduce «opus» en el juego. ¡No habíamos visto evolucionar públicamente el modelo insignia de la startup desde «Claude 2.0» hace más de un año!
Y Claude 4 es un modelo híbrido heredador de los dos modos de operación inaugurados con el soneto Claude 3.7 al comienzo del año. El primer modo ofrece respuestas casi instantáneas, mientras que el segundo, llamado «pensamiento extendido», permite un razonamiento en profundidad mediante el análisis alterno y el uso de herramientas externas como la búsqueda web.
Capacidades técnicas reforzadas, pero ¿a qué precio?
Más allá de los puntos de referencia, Claude 4 presenta mejoras sustanciales. La gestión de la memoria se ha trabajado particularmente: cuando los desarrolladores dan acceso a archivos locales, Opus 4 puede crear y mantener «archivos de memoria» para almacenar información clave, creando gradualmente el conocimiento tácito del proyecto.
Además, Claude 4 está dotado de una ventana contextual ligeramente más grande. Ahora alcanza 200,000 tokens. No está mal, pero estamos lejos de los 1 o 2 millones de tokens de Gemini 2.5 Pro.
Además, Anthrope afirma haber reducido el comportamiento de «piratería de recompensas» en un 65%: estos atajos y omitir que los modelos a veces usan para realizar sus tareas.
En el lado de la fijación de precios, Anthrope mantiene sus precios:
Muy costoso, Claude 4 Opus se factura $ 15 por millón de tokens como titular y $ 75 por millón de fichas en la salida, lo que lo convierte en un modelo aún más caro que Optaai O3.
Más razonable, Claude 4 Sonnet se factura $ 3 por millón de tokens como titular y $ 15 por millón de tokens. En comparación, Operai GPT 4O se le factura $ 5 por millón de fichas a un titular y $ 20 por millón de fichas, Gemini 2.5 Pro se factura $ 2.5 por millón de tokens como titular y $ 15 por millón de tokens.
Cuando la IA toma iniciativas inquietantes
Es en el campo de seguridad que Claude 4 despierta la mayoría de las preguntas. Anthrope reconoce en su informe de seguridad que sus nuevos modelos pueden adoptar un comportamiento preocupante cuando tienen demasiada autonomía.
En escenarios de prueba donde Claude Opus 4 se amenazó con el reemplazo, el modelo trató de chantajear a los ingenieros en el 84% de los casos, utilizando información confidencial ficticia para preservar su existencia. Aún más preocupante: cuando detecta lo que considera comportamientos «ilegalmente inmorales», como la falsificación de datos en un juicio farmacéutico, ¡el modelo puede tomar la iniciativa de contactar a la prensa o los reguladores!
Obviamente, estos comportamientos fueron observados por los equipos técnicos, mientras que Claude 4 estaba en la fase de desarrollo sin salvaguardas adecuadas. La startup se ha tomado el tiempo de estudiar su modelo adecuadamente para establecer las barreras necesarias para evitar que su IA se deslice en el mundo real. Sin embargo, la anécdota demuestra cuán esenciales son estas fases de evaluación y deben llevarse a cabo absolutamente con rigor y precaución. Por lo tanto, estos comportamientos han llevado a los antrópicos a activar sus protocolos de seguridad ASL-3, reservados para «sistemas de IA que aumentan sustancialmente el riesgo de uso catastrófico».
Claude 4 está disponible en todo el mundo (sí, incluso en Europa) hoy en Claude AI. Para los usuarios gratuitos, solo se puede acceder a Sonnet 4, mientras que los planes Pro, Max, Team y Enterprise dan acceso a los dos modelos y al extenso modo de razonamiento.
Además, los modelos son accesibles en API a través de la plataforma antrópica con cuidado de MCP y entrenamiento rápido. También están en Amazon Bedrock y Google Cloud Vertex Ai. ¡Más sorprendente, también están disponibles en vista previa del copilot de GitHub!
Leer también:
Anthrope abre a Claude a la búsqueda en la web y camina en Google Plashes
Anthrope está lanzando su profunda «investigación» para Claude y se unió a su IA en el espacio de trabajo de Google
Anthrope lanza el soneto Claude 3.7 con razonamiento integrado y código Claude
Sorpresa: ¡Openai finalmente despliega su modelo GPT-4.1 en ChatGPT!
Google lanza Gemini 2.5 Flash, un modelo que razona a bajo costo …
Google revela su IA híbrida Gemini 2.5
Google I/O '25: Veo 3, Imagen 4, Lyria 2 … ¡AI más creativo que nunca!
Build 2025: Copilot ajuste para personalizar fácilmente los modelos de agentes de IA
[



