/ KRZEMIT
KRZEMIT AI 24 lipca 2026 · 3 min

Najmocniejszy model świata wpadł do abonamentu bez dopłaty, a i tak najbardziej cieszy mnie zwykły suwak

Najmocniejszy model świata wpadł do abonamentu bez dopłaty, a i tak najbardziej cieszy mnie zwykły suwak

Anthropic wypuścił 24 lipca Claude Opus 5 i przez pół dnia internet liczył punkty w rankingach. Mnie w tej premierze zainteresowało co innego: pierwszy raz od dawna nowy flagowiec nie przyszedł z podwyżką, za to przyszedł z suwakiem, którym użytkownik decyduje, ile model ma myśleć nad odpowiedzią. To brzmi jak drobiazg z ustawień zaawansowanych, a jest najbardziej praktyczną zmianą w całym komunikacie.

Cena stoi w miejscu, co samo w sobie jest newsem

W API Opus 5 kosztuje 5 dolarów za milion tokenów wejścia i 25 dolarów za milion tokenów wyjścia, czyli dokładnie tyle co poprzedni Opus 4.8. W abonamentach jest jeszcze prościej: w planie Max nowy model jest domyślny, w planie Pro to najmocniejsza pozycja na liście, a rachunek się nie zmienia. Kto płaci od miesiąca, dostał lepszy model za te same pieniądze.

Jest wyjątek: tryb szybki działa około dwa i pół raza szybciej i kosztuje dwa razy więcej. Ma to sens, gdy siedzicie przed ekranem i czekacie. Nie ma, gdy zadanie leci w tle.

Suwak wysiłku, czyli koniec jednego trybu dla wszystkiego

Do tej pory model albo myślał długo, albo nie myślał wcale, a użytkownik dostawał to, co producent uznał za sensowny kompromis. Kontrola wysiłku odwraca ten układ. Przy prostym poleceniu można kazać modelowi odpowiedzieć oszczędnie, przy trudnym podnieść poprzeczkę i zapłacić za dodatkowe rozumowanie.

Różnica jest odczuwalna w dwóch miejscach: w rachunku za tokeny i w czasie oczekiwania. Do przepisania notatki czy wyciągnięcia dat z umowy maksymalny wysiłek jest marnowaniem pieniędzy. Do zadania, w którym trzeba przejść piętnaście kroków bez pomyłki, oszczędzanie kończy się poprawianiem po modelu.

Pierwsze miejsce wygrane jednym punktem

W niezależnym rankingu Artificial Analysis Opus 5 zajął pierwsze miejsce z wynikiem 61 punktów. Za nim jest Claude Fable 5 z wynikiem 60, dalej GPT-5.6 Sol z 59. Warto przeczytać tę tabelę uczciwie: przewaga o jeden punkt to nie przepaść, tylko potwierdzenie, że czołówka stoi bardzo blisko siebie.

W tym samym zestawieniu jest liczba mniej efektowna, ale bardziej odczuwalna przy pracy: około 50,7 tokena na sekundę przy medianie 73,6 dla modeli z tej półki. Najmądrzejszy model świata jest jednocześnie jednym z wolniej piszących. Jeżeli ktoś nie znosi patrzenia na kursor, to poczuje to szybciej niż różnicę w jakości.

Benchmarki producenta i to, co w nich pominięto

Anthropic podaje serię wyników i trzeba je czytać jako deklarację producenta, bo nie są to pomiary niezależne. Firma twierdzi, że nowy model ponad dwukrotnie poprawia wynik poprzednika na teście Frontier-Bench v0.1, osiąga trzykrotność wyniku kolejnego modelu na ARC-AGI 3, a na CursorBench 3.2 mieści się w granicach pół procenta od najlepszego wyniku Fable 5 przy połowie kosztu zadania. Do tego 10,2 punktu procentowego poprawy w chemii organicznej i 7,7 punktu w przewidywaniu białek względem Opus 4.8.

Ciekawsze jest to, czego producenci zwykle nie piszą. Anthropic sam przyznaje, że Opus 5 zostaje w tyle za modelem Mythos 5 w badaniach biologicznych i w ofensywnym cyberbezpieczeństwie. W teście OSS-Fuzz wykrywa podatności podobnie skutecznie, ale znacznie gorzej buduje z nich działające exploity. Firma, która publikuje własne słabsze wyniki, kupuje sobie prawo, żeby uwierzyć w te lepsze.

Co z tego ma zwykły użytkownik

Jeżeli płacicie za Pro lub Max, nie musicie robić nic poza wybraniem modelu z listy. Jeżeli korzystacie z darmowego konta, flagowca tam nie ma i nic się dla was nie zmieniło. A jeżeli budujecie coś na API, najrozsądniejsze pytanie brzmi nie „czy stać mnie na najlepszy model”, tylko „czy moje zadanie w ogóle go potrzebuje”. Streszczanie, klasyfikowanie i przepisywanie tekstu obsłuży model kilkukrotnie tańszy, a różnicy nie zobaczycie.

Największa zmiana tej premiery nie jest więc w rankingu. Jest w tym, że decyzję o koszcie i czasie odpowiedzi przesunięto z producenta na użytkownika.

Komunikat producenta z pełnymi wykresami: Anthropic o Claude Opus 5.

— WIĘCEJ Z REDAKCJI KRZEMIT

— CZYTAJ TEŻ W SIECI SFAT