IA y modelos
Anthropic lanza Sonnet 4.6 con una ventana de contexto de 1 millón de tokens
Anthropic lanzó Sonnet 4.6, su nuevo modelo predeterminado para usuarios Free y Pro, que cuenta con una ventana de contexto de 1 millón de tokens y continúa su ciclo de actualización de cuatro meses.
Anthropic lanzó una nueva versión de su modelo de inteligencia artificial (IA) de tamaño mediano, Sonnet 4.6, manteniendo el ritmo de su ciclo de actualización de cuatro meses. En una publicación donde anunció el nuevo modelo, Anthropic destacó mejoras en programación, seguimiento de instrucciones y uso de computadora. De ahora en adelante, Sonnet 4.6 servirá como el modelo predeterminado para los usuarios de los planes Free y Pro, reemplazando la versión anterior del modelo para estos usuarios.
La versión beta de Sonnet 4.6 introduce una ventana de contexto de 1 millón de tokens, que es el doble del tamaño de la ventana más grande disponible anteriormente para el modelo Sonnet. En la IA, una ventana de contexto representa la cantidad de datos que un modelo puede procesar a la vez. Estos datos se miden en tokens, que son las unidades básicas de texto procesadas por los modelos de IA. Para ilustrar la escala de esta capacidad ampliada, Anthropic describió la ventana de contexto de 1 millón de tokens como “suficiente para contener bases de código completas, contratos extensos o docenas de trabajos de investigación en una sola solicitud”. Esta expansión permite a los usuarios ingresar conjuntos de datos significativamente más grandes en una sola consulta.
El lanzamiento de Sonnet 4.6 viene acompañado de un nuevo conjunto de puntuaciones récord en varias evaluaciones estándar de la industria utilizadas para medir el rendimiento de la IA. Estas evaluaciones incluyen el benchmark OS World, que mide el rendimiento en el uso de computadora, y la evaluación SWE-Bench, que mide las capacidades de ingeniería de software. Más notablemente, Sonnet 4.6 alcanzó una puntuación del 60.4% en el benchmark ARC-AGI-2, una evaluación destinada a medir habilidades específicas de la inteligencia humana. El rendimiento del modelo en estas pruebas destaca su posición comparativa en el mercado, situándolo por encima de muchos de sus pares:
- La puntuación del 60.4% obtenida en el benchmark ARC-AGI-2 sitúa a Sonnet 4.6 por delante de la mayoría de los modelos comparables.
- A pesar de estos avances, Sonnet 4.6 todavía está por detrás de modelos como Opus 4.6, Gemini 3 Deep Think y una versión refinada de GPT 5.2.
El despliegue de Sonnet 4.6 se produce apenas dos semanas después del lanzamiento de Opus 4.6, continuando una rápida secuencia de actualizaciones de modelos. Tras estos lanzamientos consecutivos, es probable que un modelo Haiku actualizado siga en las próximas semanas.
Por qué importa
El rápido ciclo de lanzamiento de cuatro meses de Anthropic y la expansión de las ventanas de contexto a 1 millón de tokens señalan un impulso agresivo para mantener la competitividad frente a los modelos de Google y OpenAI.