Sprawni Cyfrowo
Sprawni Cyfrowo

Anthropic wypuścił Claude Sonnet 5.5. Szybszy i tańszy w pracy

Anthropic wypuścił Claude Sonnet 5.5. Szybszy i tańszy w pracy

Anthropic udostępnił Claude Sonnet 5.5, nową wersję swojego modelu średniej klasy. Premiera odbyła się 28 września. Według firmy model generuje odpowiedzi o ponad 30% szybciej niż Sonnet 5 i zużywa wyraźnie mniej tokenów na zadanie. W efekcie koszt typowej pracy ma spaść nawet o 30%, choć cena za token się nie zmienia.

Sonnet to w ofercie Anthropic środek stawki, pomiędzy lekkim Haiku a najmocniejszym Opusem. Poprzednik, Sonnet 5, pojawił się około trzech miesięcy temu. Nowa wersja działa w aplikacjach Claude, w API oraz na platformach AWS, Google Cloud i Microsoft Azure. Cennik API to 2 USD za milion tokenów wejściowych i 10 USD za milion tokenów wyjściowych. Simon Willison zauważa, że Sonnet 5.5 obsługuje też darmowy plan claude.ai. Anthropic zapowiada nową wersję Haiku w najbliższych tygodniach.

Claude Sonnet 5.5 blisko Opusa w testach

W tabeli opublikowanej przez Anthropic nowy model zbliża się do flagowego Opus 5.5, który zadebiutował tydzień wcześniej. W teście OSWorld 2.1, mierzącym samodzielną obsługę komputera, Sonnet 5.5 uzyskał 80,1%. Opus 5.5 ma tu 81,8%, a Sonnet 5 miał 57%. W CursorBench 4.0, zestawie zadań programistycznych, wynik wynosi 55,5% wobec 57,8% dla Opusa. TechCrunch zwraca uwagę, że w części zadań agentowego programowania Sonnet wypada nawet lepiej od droższego modelu. Prawdopodobny powód: w tym samym budżecie może uruchomić więcej agentów równolegle.

To także pierwszy Sonnet objęty tymi samymi zabezpieczeniami w obszarze cyberbezpieczeństwa co modele Opus i Fable. Zadania uznane za ryzykowne są według Anthropic kierowane do starszego Sonneta 5. Nie obyło się bez potknięć. Willison opisał przypadek, w którym w trybie najwyższego wysiłku rozumowania („max”) model zużył 128 tys. tokenów, wyczerpał kontekst i nie zwrócił żadnej odpowiedzi.

Co to znaczy dla firm w Polsce

Dla większości zastosowań biurowych i programistycznych liczy się dziś nie cena tokena, lecz koszt całego zadania. Model, który szybciej kończy pracę i zużywa mniej tokenów, obniża rachunek bez zmiany cennika. To szczególnie ważne przy agentach, które wykonują dziesiątki kroków i wywołań narzędzi. Jeśli Sonnet 5.5 rzeczywiście zbliża się do Opusa w pracy z kodem i obsłudze komputera, wiele firm może przenieść na tańszy model zadania, które dotąd rezerwowały dla flagowca.

Warto jednak podejść do tego metodycznie. Benchmarki to deklaracje dostawcy, więc przed zmianą modelu dobrze jest porównać wyniki i koszt na własnych, powtarzalnych zadaniach. Przypadek opisany przez Willisona pokazuje też, że najwyższy poziom rozumowania nie zawsze się opłaca. Firmy przetwarzające dane osobowe powinny sprawdzić warunki przechowywania danych. Anthropic oferuje opcję zerowej retencji, ale to do klienta należy weryfikacja umowy pod kątem RODO.

Źródło: Anthropic, Claude Sonnet 5.5 (EN, 28.09.2026). Kontekst rynkowy i porównanie z Opusem: TechCrunch (EN). Pierwsze testy i opis błędu w trybie „max”: Simon Willison (EN).

Pomożemy Ci wdrożyć sztuczną inteligencję w Twojej firmie.

Konsultacje i wdrożenia AI

Powiązane artykuły