За більшістю завдань Claude Opus 5.5 наблизилася до дорожчої Claude Fable 5.1, при цьому вартість роботи знизилася на 40% порівняно з Opus 5, а швидкість генерації зросла більш ніж на 30%.

Ціни та швидкість

У API Claude Opus 5.5 вартість становить $4 за 1 млн входних та $20 за 1 млн вихідних токенів. У Opus 5 тарифи були $5 і $25 відповідно, тому ціна самих токенів знизилася на 20%, а не на 40%.

Claude Opus 5.5Claude Opus 5
Вхідні токени$4 за 1 млн$5 за 1 млн
Вихідні токени$20 за 1 млн$25 за 1 млн
Читання кешу$0,20 за 1 млн$0,50 за 1 млн
Запис у кеш$5 за 1 млн$6,25 за 1 млн

Заявлені 40% економії стосуються вартості виконання типових завдань за стандартних налаштувань. Anthropic пояснює різницю тим, що Opus 5.5 витрачає менше токенів на завдання, а читання кешу здешевшало одразу на 60%. Останнє особливо важливе для Claude Code та ІІ-агентів, які постійно використовують раніше збережений контекст.

Одночасно модель генерує відповіді більш ніж на 30% швидше за Opus 5. Для Claude Code та Claude Platform також з’явився режим Fast, здатний прискорити роботу до 2,5 разів. За це доведеться платити вдвічі більше: $8 за 1 млн вхідних і $40 за 1 млн вихідних токенів.

Продуктивність

Згідно з внутрішніми тестами Anthropic, Opus 5.5 значно перевершує Opus 5 у програмуванні, роботі з комп’ютером та професійних завданнях. У Terminal-Bench 4.0 модель набрала 66,4% проти 52,3% у Opus 5 і 55,8% у Fable 5.1. Результат GPT-6 Astra склав 57,9%.

У тесті GDPval-AA v2.1, де оцінюється виконання реальних професійних завдань із 44 спеціальностей, Opus 5.5 отримала 1846 балів Elo. Для порівняння: Fable 5.1 набрала 1735, Opus 5 – 1708, GPT-6 Astra – 1542, а GPT-5.6 Sol – 1588.

ТестOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.066,4%55,8%52,3%57,9%
GDPval-AA v2.11846173517081542
AutomationBench40,0%31,4%26,9%41,4%
Останній іспит людства з інструментами67,7%65,6%63,6%57,2%
Terminal-Bench-Science 0.158,7%52,6%29,0%64,6%
OSWorld 2.081,8%80,7%74,0%

При цьому Opus 5.5 не лідирує у всіх тестах. GPT-6 Astra показала вищий результат у AutomationBench і Terminal-Bench-Science. Крім того, більшість наведених результатів отримала сама Anthropic, а на момент анонсу результату Opus 5.5 ще не було в публічній таблиці Terminal-Bench 4.0. Тому пряме порівняння варто сприймати саме як дані виробника, а не як повністю незалежне тестування.

Anthropic окремо робить ставку на великі задачі програмування. Один із ранніх тестувальників використав Opus 5.5 для перевірки та виправлення кодової бази обсягом 200 000 рядків менш ніж за три години. Opus 5 на тій самій задачі потребував понад 20 годин і приблизно в 2,5 рази більше токенів.

Безпека та обмеження

Anthropic також посилила захист моделі під час автономної роботи з кодом та інструментами. За внутрішньою оцінкою компанії, Opus 5.5 приблизно на 85% рідше намагалася вийти за встановлені межі середовища, ніж Opus 5 і Mythos 5.1. Перед випуском модель додатково тестували зовнішні організації Frontier Design та METR.

Claude Opus

Для найчутливіших завдань діють додаткові обмеження. Зокрема, значна частина запитів у сфері кібербезпеки може автоматично перенаправлятися на Opus 4.8. Подібні заходи застосовуються для біологічних досліджень та інших потенційно небезпечних сценаріїв.

Opus 5.5 також використовує механізм збереженого мислення, який не дозволяє API-клієнтам змінювати попередній внутрішній контекст міркувань моделі. Для нових акаунтів API ця система діятиме з 31 серпня 2026 року. Повністю вимкнути режим мислення в Opus 5.5 неможливо.

Доступність

Claude Opus 5.5 вже доступна в сервісах Anthropic, Claude Code та Claude Platform під ідентифікатором claude-opus-5-5, а також через Amazon Web Services, Google Cloud та Microsoft Azure. Компанія одночасно збільшила п’ятигодинні ліміти використання для тарифів Pro, Max, Team та корпоративних підписок із ліцензіями на користувачів.

Opus 5.5 стала першою моделлю нового покоління. Anthropic планує випустити Claude Sonnet 5.5 та Claude Haiku 5.5 у найближчі тижні з аналогічними покращеннями продуктивності, ефективності та безпеки.

Підпишіться на MobiDevices
Telegram