По большинству задач Claude Opus 5.5 приблизилась к более дорогой Claude Fable 5.1, при этом стоимость работы снизилась на 40% относительно Opus 5, а скорость генерации выросла более чем на 30%.

Цены и скорость

В API Claude Opus 5.5 стоит $4 за 1 млн входных и $20 за 1 млн выходных токенов. У Opus 5 тарифы составляли $5 и $25 соответственно, поэтому сами токены подешевели на 20%, а не на 40%.

Claude Opus 5.5Claude Opus 5
Входные токены$4 за 1 млн$5 за 1 млн
Выходные токены$20 за 1 млн$25 за 1 млн
Чтение кэша$0,20 за 1 млн$0,50 за 1 млн
Запись в кэш$5 за 1 млн$6,25 за 1 млн

Заявленные 40% экономии относятся к стоимости выполнения типичных задач при стандартных настройках. Anthropic объясняет разницу тем, что Opus 5.5 расходует меньше токенов на задачу, а чтение кэша подешевело сразу на 60%. Последнее особенно важно для Claude Code и ИИ-агентов, которые постоянно используют ранее сохранённый контекст.

Одновременно модель генерирует ответы более чем на 30% быстрее Opus 5. Для Claude Code и Claude Platform также появился Fast mode, способный увеличить скорость до 2,5 раза. За это придётся платить вдвое больше: $8 за 1 млн входных и $40 за 1 млн выходных токенов.

Производительность

По внутренним тестам Anthropic, Opus 5.5 заметно превосходит Opus 5 в программировании, работе с компьютером и профессиональных задачах. В Terminal-Bench 4.0 модель набрала 66,4% против 52,3% у Opus 5 и 55,8% у Fable 5.1. У GPT-6 Astra результат составил 57,9%.

В GDPval-AA v2.1, где оценивается выполнение реальных профессиональных задач из 44 специальностей, Opus 5.5 получила 1846 баллов Elo. Для сравнения, Fable 5.1 набрала 1735, Opus 5 – 1708, GPT-6 Astra – 1542, а GPT-5.6 Sol – 1588.

ТестOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.066,4%55,8%52,3%57,9%
GDPval-AA v2.11846173517081542
AutomationBench40,0%31,4%26,9%41,4%
Humanity’s Last Exam с инструментами67,7%65,6%63,6%57,2%
Terminal-Bench-Science 0.158,7%52,6%29,0%64,6%
OSWorld 2.081,8%80,7%74,0%

При этом Opus 5.5 лидирует не во всех тестах. GPT-6 Astra показала более высокий результат в AutomationBench и Terminal-Bench-Science. Кроме того, большую часть приведённых результатов получила сама Anthropic, а на момент анонса результата Opus 5.5 ещё не было в публичной таблице Terminal-Bench 4.0. Поэтому прямое сравнение стоит воспринимать именно как данные производителя, а не как полностью независимое тестирование.

Anthropic отдельно делает ставку на большие задачи по программированию. Один из ранних тестировщиков использовал Opus 5.5 для проверки и исправления кодовой базы объёмом 200 000 строк менее чем за три часа. Opus 5 на той же задаче потребовалось более 20 часов и примерно в 2,5 раза больше токенов.

Безопасность и ограничения

Anthropic также усилила защиту модели при автономной работе с кодом и инструментами. По внутренней оценке компании, Opus 5.5 примерно на 85% реже пыталась выйти за установленные границы среды, чем Opus 5 и Mythos 5.1. Перед выпуском модель дополнительно тестировали внешние организации Frontier Design и METR.

Claude Opus

Для наиболее чувствительных задач действуют дополнительные ограничения. В частности, значительная часть запросов в области кибербезопасности может автоматически перенаправляться на Opus 4.8. Схожие меры используются для биологических исследований и других потенциально опасных сценариев.

Opus 5.5 также использует механизм preserved thinking, который не позволяет API-клиентам изменять предыдущий внутренний контекст рассуждений модели. Для новых API-аккаунтов эта система действует с 31 августа 2026 года. Полностью отключить режим thinking у Opus 5.5 нельзя.

Доступность

Claude Opus 5.5 уже доступна в сервисах Anthropic, Claude Code и Claude Platform под идентификатором claude-opus-5-5, а также через Amazon Web Services, Google Cloud и Microsoft Azure. Компания одновременно увеличила пятитичасовые лимиты использования для тарифов Pro, Max, Team и корпоративных подписок с лицензиями на пользователей.

Opus 5.5 стала первой моделью нового поколения. Claude Sonnet 5.5 и Claude Haiku 5.5 Anthropic планирует выпустить в ближайшие недели с аналогичными улучшениями производительности, эффективности и безопасности.

Подпишись на MobiDevices
Telegram