W dniu 30 czerwca 2026 roku Anthropic wypuścił Claude Sonnet 5 (identyfikator modelu w API: claude-sonnet-5) i tego samego dnia stał się on powszechnie dostępny: jako model domyślny w planach Free i Pro, dostępny dla Max, Team i Enterprise, działający w Claude Code oraz na platformie Claude. Przekaz Anthropic jest bezpośredni: model został "zbudowany tak, by być najbardziej agentowym Sonnetem w historii", potrafi "tworzyć plany, korzystać z narzędzi takich jak przeglądarki i terminale oraz działać autonomicznie na poziomie, który jeszcze kilka miesięcy temu wymagał większych i droższych modeli".
To mocna deklaracja, a sformułowanie "najbardziej agentowy" to język marketingu, nie zmierzony fakt. Zrobiliśmy więc to, co zawsze: sięgnęliśmy do źródeł pierwotnych, czyli oficjalnej zapowiedzi, dokumentacji modelu, stron z cennikiem oraz karty systemowej, i podzieliliśmy wszystko na zweryfikowane fakty, benchmarki podane przez producenta oraz naszą własną analizę. W skrócie: specyfikacja i ceny są niepodważalne, benchmarki (wszystkie z karty systemowej Anthropic, bez opublikowanego jeszcze niezależnego pomiaru zewnętrznego) sytuują Sonnet 5 zaskakująco blisko znacznie droższego Opusa 4.8, a dla każdego, kto buduje agentów lub narzędzia do kodowania, to prawdopodobnie nowy model domyślny. Oto liczby.
Zweryfikowana specyfikacja
Najpierw fakty, które nie podlegają dyskusji, prosto z dokumentacji modelu Anthropic. Bez wymysłów, bez zaokrąglania na korzyść.
| Claude Sonnet 5, zweryfikowana specyfikacja | Szczegóły |
|---|---|
| Identyfikator modelu w API | claude-sonnet-5 (przypięty snapshot bez daty; AWS Bedrock anthropic.claude-sonnet-5, Google Cloud claude-sonnet-5) |
| Premiera | 30 czerwca 2026 roku, powszechnie dostępny we wszystkich planach i w Claude Code |
| Okno kontekstu | 1 mln tokenów |
| Maksymalny output | 128 tys. tokenów (do 300 tys. przez nagłówek batch beta) |
| Granica wiedzy | styczeń 2026 (wiarygodna granica wiedzy i danych treningowych) |
| Wejście / wyjście | tekst i obraz na wejściu z obsługą wizji, wielojęzyczność, tekst na wyjściu |
| Myślenie | adaptacyjne myślenie (zawsze dostępne), poziom wysiłku domyślnie ustawiony na wysoki w API i w Claude Code |
| Opóźnienie | niskie (pozycjonowany jako najlepszy balans szybkości i inteligencji) |
Najważniejsza jest kombinacja: okno kontekstu o pojemności miliona tokenów oraz granica wiedzy ze stycznia 2026 w modelu, który Anthropic jawnie stroi pod kątem szybkości i pracy agentowej. To profil konia roboczego, a ma to znaczenie, bo agenci spalają tokeny milionami, więc model, na którym je uruchamiasz, musi być zarazem sprawny i przystępny cenowo.
Cena: tania teraz, odrobinę mniej tania we wrześniu
To właśnie ta część przestawia domyślne wybory budujących. Standardowy cennik API dla Claude Sonnet 5 to 3 USD za milion tokenów wejściowych i 15 USD za milion tokenów wyjściowych. Jest jednak zniżka wprowadzająca: 2 USD / 10 USD za milion tokenów do 31 sierpnia 2026 roku, po czym od 1 września wchodzi standardowa stawka 3 USD / 15 USD. Batch API jest jeszcze tańsze, 1 USD / 5 USD w cenie wprowadzającej.
Żeby zobaczyć, dlaczego to agresywne posunięcie, zestawmy to z resztą obecnej oferty Claude. Sonnet 5 plasuje się na ułamku ceny poziomów Opus i Fable, a jednocześnie, jak zaraz zobaczymy, dorównuje im w kilku testach.
Cena wyjścia za milion tokenów, obecna oferta Claude (niżej znaczy taniej)
Źródło: dokumentacja modeli i cennika Anthropic, czerwiec 2026 (zweryfikowane). Cena wyjścia za milion tokenów. Jedno uczciwe zastrzeżenie: niezależne doniesienia zauważają, że Sonnet 5 korzysta z nowego tokenizera, który generuje nieco więcej tokenów na żądanie, więc zniżka wprowadzająca jest bliższa neutralności kosztowej niż prawdziwego obniżenia o połowę względem poprzedniego Sonneta.
| Model | Cena (we / wy za MTok) | Kontekst | Rola |
|---|---|---|---|
| Haiku 4.5 | 1 USD / 5 USD | 200 tys. | Najszybszy, blisko czołówki |
| Sonnet 5 | 3 USD / 15 USD (2 USD / 10 USD do 31 sierpnia) | 1 mln | Najlepszy balans szybkości i inteligencji |
| Opus 4.8 | 5 USD / 25 USD | 1 mln | Najmocniejszy z poziomu Opus |
| Fable 5 | 10 USD / 50 USD | 1 mln | Najmocniejszy z szeroko wydanych |
Benchmarki: domykanie dystansu do Opusa
Ważna uwaga o uczciwości: każda liczba poniżej pochodzi z karty systemowej samego Anthropic. W chwili pisania tego tekstu, w dniu premiery, żadna niezależna ewaluacja zewnętrzna (Artificial Analysis i podobne) nie opublikowała własnego pomiaru. Traktujcie je jako podane przez producenta, kierunkowo mocne, ale jeszcze niezależnie niepotwierdzone.
Benchmarki opowiadają spójną historię: Sonnet 5 to realny skok generacyjny względem Sonneta 4.6, a w kilku testach plasuje się o kilka punktów od Opusa 4.8, modelu, który na wyjściu kosztuje prawie dwukrotnie więcej. Na agentowym benchmarku kodowania SWE-bench Pro postęp widać wyraźnie.
SWE-bench Pro, kodowanie agentowe (dane podane przez producenta, wyżej znaczy lepiej)
Źródło: karta systemowa Claude Sonnet 5 za pośrednictwem The Decoder, czerwiec 2026 (dane podane przez producenta). Sonnet 5 domyka większość dystansu do Opusa 4.8 za ułamek ceny wyjścia.
W szerszych, droższych testach jest jeszcze ciaśniej. Spójrzcie, gdzie Sonnet 5 praktycznie remisuje z Opusem 4.8 mimo różnicy w cenie.
| Benchmark (dane podane przez producenta) | Sonnet 5 | Sonnet 4.6 | Opus 4.8 |
|---|---|---|---|
| SWE-bench Pro (kodowanie agentowe) | 63,2 % | 58,1 % | 69,2 % |
| Terminal-Bench 2.1 | 80,4 % | 67,0 % | nie podano |
| OSWorld-Verified (obsługa komputera) | 81,2 % | 78,5 % | nie podano |
| Humanity's Last Exam (z narzędziami) | 57,4 % | nie podano | 57,9 % |
| GDPval-AA v2 (praca umysłowa) | 1 618 pkt | nie podano | 1 615 pkt |
Przeczytajcie te dwa ostatnie wiersze jeszcze raz. Na Humanity's Last Exam z narzędziami (57,4 % wobec 57,9 %) oraz na teście pracy umysłowej GDPval (1 618 wobec 1 615 punktów) Sonnet 5 jest statystycznie na równi z Opusem 4.8, przy 15 USD za wyjście wobec 25 USD u Opusa. To cała teza tej premiery zawarta w dwóch liczbach. Skok na Terminal-Bench z 67 % do 80,4 % w obrębie jednej generacji Sonneta to drugi mocny akcent: realny postęp w uruchamianiu rzeczy w prawdziwej powłoce, czyli dokładnie tym, co robią agenci.
Kto już z tego korzysta
Zapowiedź opiera się na nazwanych klientach, a nie na anonimowych pochwałach, i lista jest wymowna, bo kilku z nich to narzędzia do kodowania z AI, zwykle przedstawiane jako zagrożenie dla zasiedziałych graczy. Anthropic cytuje Replit ("dobrze radzi sobie z długim kodowaniem, użyciem narzędzi i debugowaniem"), Cursor (błyszczy na "brownfield code" z solidnymi poprawkami), Lovable ("robi więcej mniejszym nakładem" i "czysto odmawia niebezpiecznych żądań"), Salesforce (ukończył wieloetapowe automatyzacje "od początku do końca", które wcześniej grzęzły), a do tego ClickHouse, Eve i Pace. Kiedy firmy budujące produkty agentowe ustawiają się w kolejce już pierwszego dnia, to sygnał, że model jest dostrojony dokładnie do tego rodzaju obciążenia.
Haczyki, o których trzeba pamiętać
To mocna premiera, ale wpis premierowy nie zacznie się od gwiazdek.
- Benchmarki pochodzą od samego Anthropic. Każda liczba tutaj jest z karty systemowej. Niezależni ewaluatorzy nie opublikowali pomiarów na premierę. Wartości są zapewne kierunkowo trafne, ale poczekajcie na potwierdzenie zewnętrzne, zanim uznacie je za ostateczne.
- Tania cena ma zegar. Stawka wprowadzająca 2 USD / 10 USD kończy się 31 sierpnia 2026 roku. Od 1 września będzie to 3 USD / 15 USD, czyli skok o 50 % po obu stronach. Planujcie budżet wokół ceny standardowej, nie wprowadzającej.
- Nowy tokenizer zaciemnia oszczędności. Niezależne doniesienia zauważają, że Sonnet 5 dzieli tekst na nieco więcej tokenów niż poprzedni Sonnet, więc dla danego zadania realny koszt jest bliższy niezmienionemu niż sugeruje nagłówkowa zniżka. Zmierzcie własne obciążenie.
- "Najbardziej agentowy Sonnet w historii" i "blisko Opusa" to narracja Anthropic. Dane potwierdzają mocny model, ale marketingowe superlatywy nie są niezależnymi werdyktami.
Nasza ocena: czy to nowy domyślny wybór dla budujących?
Poniżej znajduje się nasza analiza.
Dla większości obciążeń związanych z kodowaniem i pracą agentową tak, Sonnet 5 staje się rozsądnym wyborem domyślnym, a powodem jest stosunek kosztu do wydajności, a nie szczytowa surowa inteligencja. Jeśli model wypada o kilka punktów za Opusem 4.8 w najtrudniejszym teście kodowania, ale remisuje z nim w pracy umysłowej i rozumowaniu z użyciem narzędzi, kosztując przy tym 60 % ceny wyjścia Opusa (a w oknie wprowadzającym znacznie mniej), to dla żarłocznej na tokeny rzeczywistości uruchamiania agentów matematyka wskazuje na Sonnet 5. Opusa 4.8 i Fable 5 zostawiacie na naprawdę najtrudniejsze rozumowanie, a większość ruchu agentowego puszczacie przez Sonnet 5.
Głębszy wniosek, ten, który powtarzamy w tej serii, jest taki, że model to wymienny komponent, a nie produkt. Właściwa architektura umieszcza model za waszą własną abstrakcją, tak byście mogli przejść z Sonneta 4.6 na Sonnet 5, albo na tańszy model o otwartych wagach tam, gdzie jakość na to pozwala, jedną zmianą konfiguracji zamiast przebudowy. Tak właśnie wykorzystuje się premierę taką jak ta pierwszego dnia, a nie po kwartale. Dokładnie tak budujemy funkcje AI dla klientów: wybierane per zadanie pod kątem jakości, kosztu i nadzoru, na infrastrukturze, którą kontrolujecie (zobacz nasze realizacje). Jeśli chcecie pomocy w przekuciu Claude Sonnet 5 w agentów i funkcje produktu, które faktycznie trafiają na produkcję, oraz w stos, który podmieni najlepszy model, gdy tylko pojawi się kolejny, opowiedzcie nam o swoim projekcie albo napiszcie do nas, a odpowiemy w ciągu 48 godzin. Po więcej o szybko zmieniającym się krajobrazie modeli przeczytajcie nasze analizy GLM-5.2, najlepszego LLM o otwartych wagach, SpaceX kupującego Cursor (nazwanego klienta Sonneta 5) za 60 miliardów dolarów oraz Figma Motion wobec fali projektowania z AI.
Kluczowe liczby (stan na 30 czerwca 2026)
- 30 czerwca 2026 premiera Claude Sonnet 5, powszechnie dostępny tego samego dnia, identyfikator modelu
claude-sonnet-5. - 3 USD / 15 USD cena standardowa za milion tokenów, z ceną wprowadzającą 2 USD / 10 USD do 31 sierpnia 2026 roku.
- 1 mln tokenów okno kontekstu, 128 tys. maksymalnego outputu, granica wiedzy ze stycznia 2026.
- 63,2 % SWE-bench Pro (dane podane przez producenta), wobec 58,1 % dla Sonneta 4.6 i 69,2 % dla Opusa 4.8.
- 57,4 % wobec 57,9 % Sonnet 5 wobec Opusa 4.8 na Humanity's Last Exam z narzędziami, faktycznie remis.
- 80,4 % Terminal-Bench 2.1, w górę z 67,0 % u Sonneta 4.6.



