Aplicaciones

Antropic lanza el soneto Claude 3.7 con razonamiento integrado

La pelea de IA más inteligente ahora continúa en una nueva dirección. En lugar de continuar aumentando los modelos de la Fundación, los actores de IA prefieren agregar capacidad de razonamiento a los modelos existentes. Anthrope ya había inculcado un poco de reflexión en las últimas semanas en Claude 3.5. Con Claude 3.7, este razonamiento integrado adquiere una nueva dimensión y gana en transparencia.

¿Cuál es el punto común entre Deepseek R1, Openai O1/O3, Gemini 2.0 Pensando Experiment y Grok 3? Todos son modelos IA con razonamiento integrado al explotar un principio de «cadena de pensamientos» por encima del LLM, lo que hace posible descomponer las tareas complejas y verificar las hipótesis antes de producir una respuesta.

Presentado como el primer «modelo de razonamiento híbrido» en el mercado, Claude 3.7 se une a la cohorte con procesos que en última instancia no son tan nuevos como las afirmaciones antrópicas. Hay al menos los bocetos en Gemini 2.0 pensando, Operai O3-Mini e incluso Grok 3.

El modelo está destinado a ser «híbrido» porque es capaz de ofrecer respuestas casi instantáneas y explicaciones detalladas paso a paso. Gracias a un buen control de la hora de reflexión accesible a través de la API, los usuarios ahora pueden elegir entre una respuesta inmediata o un análisis en profundidad, combinando velocidad y rigor.
« Consideramos el razonamiento como una de las habilidades que debe tener un modelo de IA avanzado, integrado armoniosamente con otras características, en lugar de algo para proporcionar en un modelo separado «Explica antrópico en su anuncio.
Pero al final, bajo Claude AI, todavía depende del usuario elegir entre «sin reflexión» (el modo normal) y «reflexión preliminar» (modo alto) que apenas es diferente de verificar la función de «pensamiento» de Grok 3 o verificar el modelo de «experimento de pensamiento» en Gemini 2.0 Flash.

Un modelo «3.7» en el aire de los temperaturas

Obviamente, Anthrope revela nuevos resultados para mostrar que su nuevo modelo es igual o incluso excede los Grok 3, Gemini 2.0 y Operai O3-Mini, incluso si estos puntos de referencia finalmente revelan muy poco sobre las capacidades reales de su IA en nuestro trabajo diario.
En realidad, recordará que los modelos Claude continúan progresando en muchos ejes, especialmente en problemas matemáticos, codificación y desarrollo web. Entre los resultados más notables, recordaremos la precisión del 62.3% en el banco SWE (contra el 49.3% para O3-Mini de OpenAI) y 81.2% en el banco TAU (contra el 73.5% para el modelo O1 de OpenAI).
Sobre todo, y esta es una de las principales tendencias del momento, en OpenAi como en Grok y Anthrope, el nuevo modelo también reduce las negativas a responder injustificadas en un 45% en comparación con su predecesor.

Claude 3.7 Sonnet ahora está disponible en todas las fórmulas de Claude (Free, Pro, Team y Enterprise), así como a través de la API antrópica, Amazon Bedrock y Google Cloud Green AI. Sin embargo, el método extendido de reflexión permanece reservado para suscripciones pagas. El precio permanece sin cambios: $ 3 por millón de tokens como titular y $ 15 por millón de tokens en la salida, incluidas las tokens de la reflexión.

Claude Code, el asistente de programación de agentes

Junto con Claude 3.7 Sonnet, Anthrope lanza el código Claude, una herramienta de codificación colaborativa y «agente». Por el momento, en una vista previa limitada, Claude Code es un tipo de agente asistente que permite a los desarrolladores delegar tareas de ingeniería sustanciales en Claude sin abandonar su terminal. Diseñado para colaborar activamente con los desarrolladores, Claude Code puede navegar, analizar y modificar el código, realizar pruebas o incluso administrar depósitos de GitHub directamente desde el terminal. Las primeras pruebas muestran que puede realizar tareas en un solo pase que generalmente requiere 45 minutos de trabajo manual. Antes de abrir el acceso a todos los desarrolladores, Anthrope planea mejorar esta herramienta fortaleciendo la confiabilidad de las llamadas de comando y extendiendo su capacidad para operaciones a largo plazo.

https://www.youtube.com/watch?v=ajpk3yttkz4<

Al combinar una reflexión adaptable, un aumento de los rendimientos de desarrollo y un enfoque seguro, el soneto Claude 3.7 y el código Claude marcan un nuevo paso en el progreso de la IA antrópica. Pero con este doble lanzamiento, la startup está tratando especialmente de hablar mientras Deepseek, Mistral AI, Google, OpenAi y Grok han llegado a los titulares en las últimas semanas. Poco a poco, está surgiendo la idea de los modelos AI que podrá determinar por sí mismos el tiempo de reflexión óptimo de acuerdo con las preguntas presentadas sin que el usuario no tenga nada que seleccionar. Y apostamos a que no tendremos que esperar hasta finales de 2025 para disfrutar de tal flexibilidad.

Leer también:

IA: Anthrope descubre que los LLM pueden ocultar sus intenciones!

Anthrope lanza el protocolo MCP para conectar los modelos AI a los datos

Amazon invierte nuevamente $ 4 mil millones en antrópico

Agentes de IA: el nuevo modelo antrópico puede controlar su PC

[

Related posts
Aplicaciones

Se informa que Microsoft está preparando una revisión de Teams para julio

Después de mucho tiempo acumulando conversaciones, canales, reuniones, archivos, apps…
Read more
Aplicaciones

El nuevo Siri ya casi está aquí... pero no en la UE

Después de años de confundir un asistente inteligente con un temporizador parlante, Apple quiere…
Read more
Aplicaciones

LibreOffice saca la regla de madera... y duele

Presentado como una alternativa de oficina europea a Microsoft 365 y Google Docs, Euro-Office no ha…
Read more

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *