Anthropic ha presentado Claude Sonnet 5.5 con capacidades mejoradas para la programación, el análisis de datos y la ejecución de tareas de múltiples pasos.

Velocidad y ahorro de tokens

En comparación con Claude Sonnet 3.5, el nuevo modelo genera respuestas más de un 30% más rápido y los costes de ejecución de tareas, según las pruebas de Anthropic, pueden reducirse hasta un 30% sin cambios en las tarifas API.

Claude Sonnet 5.5 integra las llamadas a herramientas de manera más eficiente y completa las tareas en menos pasos, consumiendo menos tokens para lograr un resultado similar.

Un millón de tokens de contexto

Sonnet 5.5 ha mantenido una ventana de contexto de 1 millón de tokens y una longitud máxima de respuesta de hasta 128 mil tokens. Esto permite trabajar con documentos extensos, bases de código y grandes volúmenes de información dentro de una misma solicitud.

El modelo acepta texto e imágenes, incluyendo capturas de pantalla, gráficos e interfaces.

Mejoras en la programación

El aumento más notable registrado por Anthropic se produjo en la prueba Terminal-Bench 4.0, que evalúa la capacidad de la IA para trabajar de forma autónoma con la terminal y ejecutar tareas de varias etapas. Claude Sonnet 5.5 obtuvo un 70,6 % frente al 10,3 % de la Sonnet 5 anterior.

El modelo es capaz de analizar código, corregir errores, ejecutar comprobaciones y continuar trabajando sin necesidad de definir manualmente cada acción siguiente.

Trabajo con documentos y gráficos

Anthropic también ha mejorado la creación de tablas, presentaciones, JSON y documentos estructurados. Según los resultados de las pruebas preliminares, Sonnet 5.5 sigue plantillas complejas con mayor precisión y crea materiales que requieren menos correcciones manuales.

El reconocimiento de información visual ha mejorado notablemente. En la prueba Chartography, el modelo obtuvo un 61,6 % frente al 15,6 % de Sonnet 5. El benchmark evalúa la capacidad de la IA para comprender gráficos y diagramas sin herramientas adicionales.

Resultados de los benchmarks

Anthropic ha publicado los resultados comparativos de Claude Sonnet 5.5 y la anterior Sonnet 5 en siete pruebas que abarcan programación, uso de computadoras, análisis de imágenes y resolución de problemas complejos.

Prueba de rendimientoSonnet 5Sonnet 5.5
Terminal-Bench 4.0 (programación)10,3 %70,6%
CursorBench 4.0 (programación)34,1%55,5%
GDPval-AA v2.1 (tareas de trabajo, índice)14491844
AA-Briefcase v1.1 (tareas de trabajo, índice)13591811
El último examen de la humanidad (con herramientas)54,9%64,5%
OSWorld 2.1 (control de computadora, prueba parcial)57,0%80,1%
Chartography (análisis de gráficos sin herramientas)15,6%61,6%

Todos los indicadores se basan en los resultados publicados por Anthropic. En GDPval-AA y AA-Briefcase se utilizan puntuaciones de índice, mientras que en el resto de las pruebas se emplean porcentajes. Un resultado más alto indica un mejor desempeño en las tareas dentro del punto de referencia correspondiente.

Disponibilidad y precio

Claude Sonnet 5.5 se lanzó el 28/09/2026 y ya está disponible en las aplicaciones de Claude, a través del API oficial, Amazon Web Services, Google Cloud y Microsoft Azure.

Coste de uso a través de API por 1 millón de tokens:

  • Tokens de entrada: $2;
  • Tokens de salida – $10;
  • Lectura desde la caché – $0,20;
  • Escritura en caché durante 5 minutos – $2,50;
  • Escritura en caché durante 1 hora – $4.

Para los desarrolladores, el modelo está disponible bajo el identificador claude-sonnet-5-5.

Sigue a MobiDevices
Telegram