Anthropic ogłosiło Claude Sonnet 5.5 28 września 2026 r. jako drugi model z rodziny Claude 5.5. Firma pozycjonuje go do codziennych, dobrze określonych zadań, takich jak programowanie, poprawianie błędów czy przygotowywanie dokumentów. Deklaruje też, że model generuje odpowiedzi o ponad 30% szybciej i może kosztować do 30% mniej na zadanie niż Sonnet 5.
Drugi model z rodziny Claude 5.5
Anthropic przedstawia Sonnet 5.5 jako model do zadań o jasno określonym celu: od naprawiania błędów i pisania kodu po tworzenie dokumentów, prezentacji, arkuszy kalkulacyjnych i projektowanie interfejsów. Claude Opus 5.5 ma natomiast służyć do bardziej złożonych, otwartych zadań wymagających dłuższego, uważnego rozumowania.
Różnica między deklarowanym kosztem zadania a ceną tokenów jest istotna. Anthropic utrzymało stawki API z Sonnet 5, a niższy koszt wykonania zadania przypisuje mniejszemu zużyciu tokenów i sprawniejszej pracy modelu. To porównanie z Sonnet 5, nie z Opus 5.5.
Stawki API i koszt wykonania zadania
W cenniku API Anthropic podaje stawki w dolarach amerykańskich za milion tokenów:
- 2 USD za milion tokenów wejściowych;
- 10 USD za milion tokenów wyjściowych;
- 0,20 USD za milion tokenów odczytanych z pamięci podręcznej;
- 2,50 USD za milion tokenów zapisanych w pamięci podręcznej.
Te stawki nie określają same z siebie kosztu wykonania konkretnego zadania. W jednym indeksie szacowany koszt zadania wyniósł 7,60 USD dla Sonnet 5.5 i 5,98 USD dla Opus 5.5. W innym zestawie testowym koszty na test wyniosły odpowiednio 20,80 USD i 32,77 USD. To wyniki konkretnych konfiguracji i zadań, a nie stała taryfa za użycie modelu.
Anthropic ustawiło średni poziom effort domyślnie w aplikacji Claude i Claude Code, a wysoki — w Claude Platform. Poziom effort określa, jak intensywnie model ma pracować nad odpowiedzią; wybór ustawienia może więc zmienić zużycie tokenów i koszt zadania.
Wyniki Sonnet 5.5 i Opus 5.5 w testach
W wynikach opublikowanych przez Anthropic Opus 5.5 uzyskał 57,8% w CursorBench 4.0, a Sonnet 5.5 — 55,5%. W teście GDPval-AA v2.1 wyniki wyniosły odpowiednio 1846 i 1844 punkty w skali Elo.
| Test | Claude Sonnet 5.5 | Claude Opus 5.5 |
| CursorBench 4.0 | 55,5% | 57,8% |
| GDPval-AA v2.1, punkty Elo | 1844 | 1846 |
Anthropic podało, że przedpremierowa wersja Sonnet 5.5 użyta w testach GDPval-AA i AA-Briefcase miała błąd obsługi ustrukturyzowanych danych. Firma przekazała, że usunęła go przed publiczną premierą i spodziewa się niewielkiego wpływu na wyniki tych testów.
W Terminal-Bench 4.0 Anthropic podało 70,6% dla Sonnet 5.5 i 66,4% dla Opus 5.5. Wynik Opusa dotyczy ustawienia Xhigh, a porównanie tych dwóch rezultatów nie ma dopasowanych warunków effort. Nie rozstrzyga więc samo w sobie, który model wypada lepiej przy identycznych ustawieniach. W programistycznym CursorBench Opus 5.5 uzyskał wynik wyższy o 2,3 punktu procentowego.
Dostępność i kolejny model
Anthropic ogłosiło dostępność Sonnet 5.5 na wszystkich platformach, wymieniając także Amazon Web Services, Google Cloud i Microsoft Azure. Firma zapowiedziała również, że Claude Haiku 5.5 dołączy do rodziny w nadchodzących tygodniach, bez podania konkretnej daty.