Anthropic hat Claude Sonnet 3.5 mit verbesserten Fähigkeiten in den Bereichen Programmierung, Datenanalyse und der Ausführung mehrstufiger Aufgaben vorgestellt.

Geschwindigkeit und Token-Einsparung

Im Vergleich zu Claude Sonnet 3.5 generiert das neue Modell Antworten um mehr als 30 % schneller, und die Kosten für die Ausführung von Aufgaben können laut Tests von Anthropic um bis zu 30 % sinken, ohne dass sich die Tarife ändern API.

Claude Sonnet 3.5 kombiniert Tool-Aufrufe effizienter und erledigt Aufgaben in weniger Schritten, wobei für ein vergleichbares Ergebnis weniger Token verbraucht werden.

Eine Million Kontext-Token

Sonnet 5.5 behält das Kontextfenster von 1 Mio. Token und eine maximale Antwortlänge von bis zu 128.000 Token bei. Dies ermöglicht die Arbeit mit umfangreichen Dokumenten, Codebasen und großen Datenmengen innerhalb einer einzigen Anfrage.

Das Modell verarbeitet Text und Bilder, einschließlich Screenshots, Grafiken und Benutzeroberflächen.

Verbesserungen in der Programmierung

Den deutlichsten Zuwachs verzeichnete Anthropic im Terminal-Bench 4.0-Test, der die Fähigkeit einer KI überprüft, eigenständig mit dem Terminal zu arbeiten und mehrstufige Aufgaben auszuführen. Claude Sonnet 5.5 erreichte 70,6 % gegenüber 10,3 % bei der vorherigen Sonnet 5.

Das Modell ist in der Lage, Code zu analysieren, Fehler zu beheben, Prüfungen auszuführen und die Arbeit fortzusetzen, ohne dass jeder nächste Schritt manuell vorgegeben werden muss.

Arbeit mit Dokumenten und Grafiken

Anthropic hat zudem die Erstellung von Tabellen, Präsentationen, JSON-Dateien und strukturierten Dokumenten verbessert. Vorläufigen Testergebnissen zufolge folgt Sonnet 5.5 komplexen Vorlagen präziser und erstellt Materialien, die weniger manuelle Korrekturen erfordern.

Die Erkennung visueller Informationen hat sich spürbar verbessert. Im Chartography-Test erreichte das Modell 61,6 % gegenüber 15,6 % bei Sonnet 5. Der Benchmark bewertet die Fähigkeit der KI, Grafiken und Diagramme ohne zusätzliche Werkzeuge zu verstehen.

Benchmark-Ergebnisse

Anthropic hat die Vergleichsergebnisse von Claude Sonnet 3.5 und dem Vorgänger Sonnet 3.5 in sieben Tests veröffentlicht, die Programmierung, Computerbedienung, Bildanalyse und die Lösung komplexer Aufgaben abdecken.

BenchmarkSonnet 5Sonnet 5.5
Terminal-Bench 4.0 (Programmierung)10,3 %70,6%
CursorBench 4.0 (Programmierung)34,1 %55,5%
GDPval-AA v2.1 (Arbeitsaufgaben, Index)14491844
AA-Briefcase v1.1 (Arbeitsaufgaben, Index)13591811
Die letzte Prüfung der Menschheit (mit Werkzeugen)54,9 %64,5%
OSWorld 2.1 (Computersteuerung, Teiltest)57,0 %80,1%
Chartography (Analyse von Diagrammen ohne Hilfsmittel)15,6 %61,6%

Alle Kennzahlen basieren auf den von Anthropic veröffentlichten Ergebnissen. Bei GDPval-AA und AA-Briefcase werden Indexpunkte verwendet, bei den übrigen Tests Prozentwerte. Ein höheres Ergebnis bedeutet eine bessere Erfüllung der Aufgaben im Rahmen des jeweiligen Benchmarks.

Verfügbarkeit und Preis

Claude Sonnet 3.5 wurde am 28.09.2026 veröffentlicht und ist bereits in den Claude-Apps, über die offizielle API, Amazon Web Services, Google Cloud sowie Microsoft Azure verfügbar.

Kosten für die Nutzung über API pro 1 Million Token:

  • Eingabetokens – $2;
  • Ausgabetoken – $10;
  • Lesen aus dem Cache – $0,20;
  • Cache-Schreibvorgang für 5 Minuten – $2,50;
  • Cache-Eintrag für 1 Stunde – $4.

Für Entwickler ist das Modell unter der Kennung claude-sonnet-5-5 verfügbar.

MobiDevices folgen
Telegram