Am 28. September 2026 stellte Anthropic Claude Sonnet 5.5 als zweites Modell der Claude-5.5-Familie vor. Das Unternehmen positioniert es für klar umrissene Alltagsaufgaben wie Programmieren, Fehlerbehebung, Dokumente und Tabellen. Anthropic erklärte, das Modell sei auf allen Plattformen verfügbar, darunter Amazon Web Services, Google Cloud und Microsoft Azure.
Was sich gegenüber Sonnet 5 ändern soll
Anthropic zufolge erzeugt Sonnet 5.5 Ausgaben mehr als 30 Prozent schneller als Sonnet 5 und kostet bei den meisten Aufgaben bis zu 30 Prozent weniger. Diese Angaben beziehen sich auf den Vergleich mit Sonnet 5. Die gelisteten API-Preise pro Token hat Anthropic dagegen nicht geändert:
- Eingabe-Tokens: 2 US-Dollar je Million
- Ausgabe-Tokens: 10 US-Dollar je Million
- Cache-Lesezugriffe: 0,20 US-Dollar je Million Tokens
- Cache-Schreibzugriffe: 2,50 US-Dollar je Million Tokens
Der Unterschied ist praktisch wichtig: Der Preis pro Token sagt nicht allein aus, was eine erledigte Aufgabe kostet. Dafür zählt auch, wie viele Tokens ein Modell für die jeweilige Aufgabe verbraucht. In einem unabhängigen Indexlauf wurden die Kosten pro Indexaufgabe für Sonnet 5.5 auf 7,60 US-Dollar und für Opus 5.5 auf 5,98 US-Dollar geschätzt. Ein anderer Testmix ergab die umgekehrte Reihenfolge. Solche Werte gelten jeweils für den konkreten Aufgabenmix und die gewählten Einstellungen.
In der Claude-App und in Claude Code ist die Standardeinstellung für den Denkaufwand mittel, auf der Claude Platform hoch. Der gewählte Aufwand beeinflusst, wie ein Benchmark-Ergebnis und die dabei anfallenden Kosten ausfallen.
Benchmark-Ergebnisse im Vergleich
Anthropics veröffentlichte Ergebnisse fallen je nach Test unterschiedlich aus. Bei CursorBench 4.0, einem Test mit mehrdeutigen Aufgaben über mehrere Dateien, lag Opus 5.5 vor Sonnet 5.5. Die Werte für GDPval-AA v2.1 sind Elo-artige Punktzahlen:
| Test | Claude Sonnet 5.5 | Claude Opus 5.5 |
| CursorBench 4.0 | 55,5 % | 57,8 % |
| GDPval-AA v2.1 | 1.844 Punkte | 1.846 Punkte |
Anthropic zufolge wurde Sonnet 5.5 für GDPval-AA mit einer Vorabversion getestet, die einen Fehler bei strukturierten Ausgaben hatte. Das Unternehmen erklärte, den Fehler vor der öffentlichen Vorstellung behoben zu haben, und erwartete nur geringe Auswirkungen auf die Werte.
Auch die Terminal-Bench-4.0-Zahlen lassen sich nicht als direkter Gleichstand der Testbedingungen lesen: Anthropic nennt 70,6 Prozent für Sonnet 5.5 und 66,4 Prozent für Opus 5.5; für Opus ist dabei ausdrücklich der Aufwand Xhigh angegeben. Ein einzelner Benchmark entscheidet also nicht, welches Modell bei jeder Programmieraufgabe besser abschneidet.
Verfügbarkeit und Haiku 5.5
Anthropic erklärte, Claude Sonnet 5.5 sei auf allen Plattformen verfügbar. Für Aufgaben mit hohem Cybersicherheitsrisiko greife laut Unternehmen sichtbar eine Rückfalloption auf Sonnet 5; gewöhnliche Softwareentwicklung bleibe möglich.
Am 28. September kündigte Anthropic außerdem an, Claude Haiku 5.5 solle in den folgenden Wochen zur Familie hinzukommen.