Anthropic представила Claude Sonnet 5.5 с улучшенными возможностями программирования, анализа данных и выполнения многоэтапных задач.

Скорость и экономия токенов

По сравнению с Claude Sonnet 5 новая модель генерирует ответы более чем на 30% быстрее, а затраты на выполнение задач, по тестам Anthropic, могут сократиться до 30% без изменения тарифов API.

Claude Sonnet 5.5 эффективнее объединяет вызовы инструментов и выполняет задачи за меньшее количество шагов, расходуя меньше токенов для достижения аналогичного результата.

Миллион токенов контекста

Sonnet 5.5 сохранила контекстное окно объёмом 1 млн токенов и максимальную длину ответа до 128 тыс. токенов. Это позволяет работать с крупными документами, кодовыми базами и большими массивами информации в рамках одного запроса.

Модель принимает текст и изображения, включая скриншоты, графики и интерфейсы.

Улучшения в программировании

Наиболее заметный прирост Anthropic зафиксировала в тесте Terminal-Bench 4.0, проверяющем способность ИИ самостоятельно работать с терминалом и выполнять многоэтапные задачи. Claude Sonnet 5.5 набрала 70,6% против 10,3% у предыдущей Sonnet 5.

Модель способна анализировать код, исправлять ошибки, запускать проверки и продолжать работу без необходимости вручную задавать каждое следующее действие.

Работа с документами и графикой

Anthropic также улучшила создание таблиц, презентаций, JSON и структурированных документов. По результатам предварительного тестирования, Sonnet 5.5 точнее следует сложным шаблонам и создаёт материалы, требующие меньше ручных исправлений.

Заметно улучшилось распознавание визуальной информации. В тесте Chartography модель набрала 61,6% против 15,6% у Sonnet 5. Бенчмарк оценивает способность ИИ понимать графики и диаграммы без дополнительных инструментов.

Результаты бенчмарков

Anthropic опубликовала сравнительные результаты Claude Sonnet 5.5 и предыдущей Sonnet 5 в семи тестах, охватывающих программирование, работу с компьютером, анализ изображений и решение сложных задач.

БенчмаркSonnet 5Sonnet 5.5
Terminal-Bench 4.0 (программирование)10,3%70,6%
CursorBench 4.0 (программирование)34,1%55,5%
GDPval-AA v2.1 (рабочие задачи, индекс)14491844
AA-Briefcase v1.1 (рабочие задачи, индекс)13591811
Humanity’s Last Exam (с инструментами)54,9%64,5%
OSWorld 2.1 (управление компьютером, частичный тест)57,0%80,1%
Chartography (анализ графиков без инструментов)15,6%61,6%

Все показатели приведены по опубликованным Anthropic результатам. В GDPval-AA и AA-Briefcase используются индексные баллы, в остальных тестах – проценты. Более высокий результат означает лучшее выполнение заданий в рамках соответствующего бенчмарка.

Доступность и цена

Claude Sonnet 5.5 вышла 28 сентября 2026 года и уже доступна в приложениях Claude, через официальный API, Amazon Web Services, Google Cloud и Microsoft Azure.

Стоимость использования через API за 1 млн токенов:

  • Входные токены – $2;
  • Выходные токены – $10;
  • Чтение из кэша – $0,20;
  • Запись в кэш на 5 минут – $2,50;
  • Запись в кэш на 1 час – $4.

Для разработчиков модель доступна под идентификатором claude-sonnet-5-5.

Подпишись на MobiDevices
Telegram