Bei den meisten Aufgaben hat sich Claude Opus 5.5 der teureren Claude Fable 5.1 angenähert, wobei die Kosten pro Aufgabe im Vergleich zu Opus 5 um 40 % sanken und die Generierungsgeschwindigkeit um mehr als 30 % stieg.

Preise und Geschwindigkeit

Im API kostet Claude Opus 5.5 $4 pro 1 Million Eingabetokens und $20 pro 1 Million Ausgabetokens. Bei Opus 5 betrugen die Tarife jeweils $5 und $25, sodass sich die Token-Preise nur um 20 % und nicht um 40 % reduzierten.

Claude Opus 5.5Claude Opus 5
Eingabetokens$4 für 1 Mio.$5 für 1 Mio.
Ausgangstoken$20 für 1 Mio.$25 für 1 Mio.
Cache lesen$0,20 für 1 Mio.$0,50 für 1 Mio.
Eintrag im Cache$5 für 1 Mio.$6,25 für 1 Mio.

Die angegebenen 40 % Ersparnis beziehen sich auf die Kosten für typische Aufgaben bei Standardkonfigurationen. Anthropic erklärt den Unterschied damit, dass Opus 5.5 weniger Tokens pro Aufgabe verbraucht und das Lesen des Caches um 60 % günstiger geworden ist. Letzteres ist besonders wichtig für Claude Code und KI-Agenten, die ständig zuvor gespeicherte Kontexte nutzen.

Gleichzeitig generiert das Modell Antworten um mehr als 30 % schneller als Opus 5. Für Claude Code und die Claude Platform wurde zudem ein Fast-Mode eingeführt, der die Geschwindigkeit bis zum 2,5-Fachen steigern kann. Dafür muss man doppelt so viel zahlen: $8 pro 1 Mio. Eingabetoken und $40 pro 1 Mio. Ausgabetoken.

Leistung

Laut internen Tests von Anthropic übertrifft Opus 5.5 Opus 5 deutlich in den Bereichen Programmierung, Computerbedienung und professionelle Aufgaben. Im Terminal-Bench 4.0 erzielte die Modell 66,4 % gegenüber 52,3 % bei Opus 5 und 55,8 % bei Fable 5.1. Bei GPT-6 Astra lag das Ergebnis bei 57,9 %.

Im GDPval-AA v2.1, bei dem die Bewältigung realer beruflicher Aufgaben aus 44 Fachrichtungen bewertet wird, erzielte Opus 5.5 1846 Elo-Punkte. Zum Vergleich: Fable 5.1 erreichte 1735 Punkte, Opus 5 – 1708, GPT-6 Astra 1542 und GPT-5.6 Sol 1588.

TestOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.066,4 %55,8 %52,3 %57,9 %
GDPval-AA v2.11846173517081542
AutomationBench40,0 %31,4 %26,9 %41,4 %
Humanity’s Last Exam mit Werkzeugen67,7 %65,6 %63,6 %57,2 %
Terminal-Bench-Science 0.158,7 %52,6 %29,0 %64,6 %
OSWorld 2.081,8 %80,7 %74,0 %

Opus 5.5 führt jedoch nicht in allen Tests. GPT-6 Astra erzielte höhere Ergebnisse im AutomationBench und Terminal-Bench-Science. Zudem stammen die meisten der genannten Ergebnisse selbst von Anthropic, und zum Zeitpunkt der Ankündigung war das Ergebnis von Opus 5.5 noch nicht in der öffentlichen Tabelle des Terminal-Bench 4.0 enthalten. Daher sollte der direkte Vergleich als Herstellerdaten und nicht als vollständig unabhängiges Testergebnis betrachtet werden.

Anthropic setzt gezielt auf große Programmieraufgaben. Ein früher Tester nutzte Opus 5.5, um eine Codebasis mit 200.000 Zeilen in weniger als drei Stunden zu überprüfen und zu korrigieren. Opus 5 benötigte für dieselbe Aufgabe mehr als 20 Stunden und etwa das 2,5-fache an Token.

Sicherheit und Einschränkungen

Anthropic hat den Schutz der Modelle bei der autonomen Code- und Werkzeugnutzung ebenfalls verstärkt. Laut interner Einschätzung des Unternehmens versuchte Opus 5.5 etwa 85 % seltener, die festgelegten Grenzen der Umgebung zu überschreiten, als Opus 5 und Mythos 5.1. Vor dem Release wurde das Modell zusätzlich von externen Organisationen wie Frontier Design und METR getestet.

Claude Opus

Für besonders sensible Aufgaben gelten zusätzliche Einschränkungen. Insbesondere wird ein erheblicher Teil der Anfragen im Bereich Cybersicherheit automatisch an Opus 4.8 weitergeleitet. Ähnliche Maßnahmen werden für biologische Forschungen und andere potenziell gefährliche Szenarien angewendet.

Opus 5.5 nutzt auch den „preserved thinking“-Mechanismus, der es API-Clients nicht erlaubt, den vorherigen internen Denkprozess des Modells zu ändern. Für neue API-Konten gilt dieses System ab dem 31. August 2026. Der „thinking“-Modus von Opus 5.5 kann nicht vollständig deaktiviert werden.

Verfügbarkeit

Claude Opus 5.5 ist jetzt in den Diensten von Anthropic, Claude Code und der Claude Platform unter der Kennung claude-opus-5-5 sowie über Amazon Web Services, Google Cloud und Microsoft Azure verfügbar. Das Unternehmen hat gleichzeitig die fünf stündigen Nutzungslimits für die Tarife Pro, Max, Team und Unternehmensabos mit Benutzerlizenzen erhöht.

Opus 5.5 ist das erste Modell der neuen Generation. Claude Sonnet 5.5 und Claude Haiku 5.5 plant Anthropic, in den kommenden Wochen mit ähnlichen Verbesserungen bei Leistung, Effizienz und Sicherheit zu veröffentlichen.

MobiDevices folgen
Telegram