Ein am 26. September 2026 veröffentlichter API-Vergleich prüfte Claude Opus 5.5 und Claude Opus 5 mit drei Aufgaben. Beide Modelle lösten das Logikrätsel und das Steinspiel; bei einer Aufgabe zur eingeschränkten Reihenfolge blieb bei beiden eine Antwort aus.
Ergebnisse der drei Aufgaben
| Aufgabe | Claude Opus 5.5 | Claude Opus 5 |
| Logikrätsel | 28 von 28 Punkten | 28 von 28 Punkten |
| Steinspiel | Alle drei Fragen richtig beantwortet | Alle drei Fragen richtig beantwortet |
| Eingeschränkte Reihenfolge | Keine Antwort bei Ausgabelimits von 48.000 und 128.000 Tokens | Keine Antwort bei Ausgabelimits von 48.000 und 128.000 Tokens |
Das Logikrätsel ordnete sieben Ingenieure anhand von 22 Hinweisen Wochentagen, Programmiersprachen, Diensten und Städten zu. Beim Reihenfolgeproblem sollten die Modelle mögliche Anordnungen für sechs, acht und zehn Jobs zählen, ohne Jobs an ihrer festen Position zu platzieren oder aufeinanderfolgende Jobnummern nebeneinander anzuordnen. Im Steinspiel waren Züge mit zwei, fünf, sieben oder elf Steinen möglich; kein Spieler durfte den eigenen vorherigen Zug wiederholen.
So lief der API-Vergleich ab
Beide Modelle erhielten dieselben Prompts über die Anthropic-API. Aktiviert war „Adaptive Thinking“ mit der voreingestellten Aufwandsstufe. Jede Aufgabe wurde pro Modell einmal ausgeführt.
Gemessene Ausgaberate und Anthropic-Aussage
Über die Testaufrufe hinweg lag die gemessene Ausgaberate für Claude Opus 5.5 bei 103,4 Tokens pro Sekunde und für Claude Opus 5 bei 93,1 Tokens pro Sekunde. Das entspricht in diesem Vergleich einem Vorsprung von rund 11 Prozent.
Anthropic erklärte am 22. September 2026, Claude Opus 5.5 erzeuge Ausgabe mehr als 30 Prozent schneller als Claude Opus 5. Diese Unternehmensangabe und die gemessene Rate beziehen sich auf unterschiedliche Vergleichsbedingungen.