Aplicaciones

Claude Sonnet 4 extiende su ventana contextual a 1 millón

La extensión de la ventana contextual de Claude Sonnet 4 a un millón de tokens abre nuevas perspectivas para el análisis de datos masivos, el procesamiento de bases de código enteras e investigación avanzada. Pero tendremos que pagar más …

Anthrope está en aumento, especialmente en los negocios. Sus modelos híbridos, por su facultad de expresión de fluidos y su capacidad para adaptar su nivel de razonamiento a las preguntas formuladas, lograron hacer la sombra en OpenAi y su disputado GPT-5. Claude Ai, su plataforma conversacional, se basa en varios modelos de idiomas, incluidos el famoso sonnet 4 y Claude Opus 4.1. Si Opus es la versión más potente, diseñada para tareas complejas y la máxima precisión, el soneto 4 se posiciona como un modelo más ligero, optimizado para la velocidad y el costo, al tiempo que conserva un rendimiento sólido para la mayoría de los usos. Es este modelo «intermediario», utilizado por defecto por Claude AI y UNNAP USE (a diferencia de Opus) que acaba de recibir un ajuste importante: ahora puede tratar hasta un millón de tokens en una sola solicitud. Hasta ahora, el modelo se ha limitado a una ventana contextual de cinco tiempos más limitada. El soneto 4 se convierte así en el primer modelo de antrópico en tener una ventana contextual muy extensa, Claude Opus 4.1 que reside en una ventana de 200,000 tokens.

Cuando Anthrope habla sobre una ventana contextual, el editor en realidad se refiere a la cantidad de datos que se pueden hacer al modelo (de repente en una discusión) para alimentar su reflexión. Esto no afecta la longitud de las respuestas del modelo que permanece limitado a 32,000 tokens en Opus 4.1 y 64,000 tokens en soneto 4.

Concretamente, esta evolución cambia la situación. Con esta extensión, disponible en beta pública a través de la API antrópica y el rock de Amazon (y pronto en Google Cloud Vertex AI), los usuarios pueden cargar volúmenes de datos mucho más sustanciales de una vez. Esto es particularmente esencial para los desarrolladores que les gusta mucho este modelo con capacidades de generación de código tan poderosas que GitHub prefería soneto a cualquier otro modelo para su herramienta Spark. Con tal ventana contextual, es posible que ingieran las bases de código enteras, incluidas las pruebas y la documentación, al tiempo que mantiene una comprensión global de las relaciones entre los archivos para llevar a cabo la depuración avanzada o el análisis global. Para los investigadores y los usuarios avanzados también, dicha ventana es la oportunidad de analizar simultáneamente docenas de artículos científicos o contratos legales sin perder el cable de referencias.

Esta capacidad también abre el camino a muchos más agentes contextuales, capaces de administrar flujos de trabajo complejos que involucran cientos de llamadas de herramientas. Imagine a un asistente que mantiene en la memoria toda la documentación de la API, los archivos de configuración y el historial completo de un sistema, mientras permanece coherente durante varios días de interacción.

Sin embargo, este avance no está exento de consideración. Una ventana más amplia aumenta la carga computacional y puede diluir la relevancia de las respuestas si no se usa de manera inteligente. Algunos desarrolladores enfatizan que «poner todo en contexto» no garantiza una mejor comprensión. Y una ventana grande no cuestiona la importancia fundamental de saber cómo hacer las preguntas correctas en la IA.

Finalmente, no debemos perder de vista el hecho de que este aumento también tiene un costo. Las API antrópicas ya se consideran a menudo entre las más caras. Pero esta extensión a 1 millón de tokens tiende a duplicar la nota. La API en realidad se factura $ 6 por millón de tokens como titular (en comparación con $ 3 para la API Sonnet 4 limitado a una ventana de 200,000 tokens) y $ 22.5 por millón de tokens (contra $ 15 para la restricción de la API).

Por el momento, esta característica está reservada para clientes con acceso premium a API, pero Anthrope proporciona una implementación más amplia en las próximas semanas. El acceso a dicha ventana se limita a las API. El asistente de Claude AI se beneficia de una ventana de 200,000 tokens en su versión pagada (más reducida en su versión gratuita, pero se extendió a 500k en el Édisme).

Con sus millones de tokens de la ventana contextual, el soneto 4 supera los límites de lo que puede lograr un modelo «intermedio» híbrido. Sin embargo, esto no es lo primero. Los modelos Gemini 2.5 Flash y Gemini 2.5 Flash-Lite de Google también ofrecen una ventana contextual de más de un millón de tokens (el modelo Gemini 2.5 Pro incluso tiene una variante con 2 millones de tokens). Como recordatorio, GPT-5 y GPT-5 mini de OpenAI ofrecen una ventana contextual de 400,000 tokens. Al mismo tiempo, se recordará que en Salida Géminis 2.5 permanece limitada a 65,536 tokens, mientras que GPT-5 puede producir respuestas de hasta 128,000 tokens.

Leer también:

[

Related posts
Aplicaciones

Se informa que Microsoft está preparando una revisión de Teams para julio

Después de mucho tiempo acumulando conversaciones, canales, reuniones, archivos, apps…
Read more
Aplicaciones

El nuevo Siri ya casi está aquí... pero no en la UE

Después de años de confundir un asistente inteligente con un temporizador parlante, Apple quiere…
Read more
Aplicaciones

LibreOffice saca la regla de madera... y duele

Presentado como una alternativa de oficina europea a Microsoft 365 y Google Docs, Euro-Office no ha…
Read more

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *