Anthropic oficjalnie wypuścił Claude Opus 5.5 – pierwszy model z nowej rodziny Claude 5.5. Firma obiecuje jednocześnie wyższą wydajność, szybsze generowanie odpowiedzi i wyraźnie niższy koszt pracy. Cena tokenów spadła o 20 proc., odczyt z cache jest o 60 proc. tańszy, a według testów Anthropic typowe zadanie ma kosztować około 40 proc. mniej niż w przypadku Claude Opus 5.
Premiera jest szczególnie interesująca ze względu na bezpośrednie porównanie z OpenAI. W benchmarku programistycznym FrontierCode v1.1 Anthropic podaje dla Opus 5.5 wynik 54,6 proc. wobec 53,3 proc. dla GPT-6 Astra, przy około jednej piątej kosztu wykonania zadania. To mocna deklaracja, ale wymaga ważnego zastrzeżenia: zestawienie publikuje Anthropic, a wynik Astry pochodzi z danych raportowanych przez OpenAI. Nie jest to więc niezależny test rozstrzygający, który model jest „lepszy”.
Claude Opus 5.5 trafia od razu do Claude, Claude Code i API, a także do usług chmurowych AWS, Google Cloud i Microsoft. Anthropic zapowiedział również, że w najbliższych tygodniach pojawią się Claude Sonnet 5.5 i Claude Haiku 5.5, co oznacza rozpoczęcie pełnej wymiany obecnej rodziny modeli.
Najważniejsze informacje:
- Claude Opus 5.5 został zaprezentowany 22 września 2026 roku jako pierwszy model z rodziny Claude 5.5.
- Anthropic podaje, że typowe zadania kosztują około 40 proc. mniej niż w Opus 5.
- Cena API wynosi 4 dolary za 1 mln tokenów wejściowych i 20 dolarów za 1 mln wyjściowych.
- Opus 5 kosztował odpowiednio 5 i 25 dolarów, więc ceny pojedynczych tokenów spadły o 20 proc.
- Odczyt z cache potaniał z 0,50 do 0,20 dolara za milion tokenów, czyli o 60 proc.
- Anthropic deklaruje, że Opus 5.5 generuje odpowiedzi ponad 30 proc. szybciej od Opus 5.
- Dostępny jest również Fast mode o prędkości do 2,5 raza wyższej, ale za wyższą cenę.
- W FrontierCode v1.1 Opus 5.5 uzyskał według Anthropic 54,6 proc., a GPT-6 Astra 53,3 proc.
- Anthropic twierdzi, że w tym teście Opus 5.5 osiągnął wynik przy około jednej piątej kosztu zadania Astry.
- Model jest dostępny dla użytkowników Claude Pro, Max, Team i Enterprise oraz przez API.
- Claude Sonnet 5.5 i Claude Haiku 5.5 mają pojawić się w najbliższych tygodniach.
Claude Opus 5.5 otwiera nową rodzinę modeli Anthropic
Claude Opus 5.5 jest pierwszym przedstawicielem nowej generacji, ale Anthropic nie przedstawia go wyłącznie jako większego lub bardziej inteligentnego następcy Opus 5. Firma bardzo mocno eksponuje efektywność – model ma wykonywać podobne lub trudniejsze zadania w krótszym czasie i przy mniejszej liczbie wykorzystanych tokenów. Według Anthropic na większości typowych zadań Opus 5.5 osiąga poziom Claude Fable 5.1, jednocześnie kosztując wyraźnie mniej w eksploatacji.
To istotna zmiana w sposobie rywalizacji największych laboratoriów AI. Jeszcze niedawno premiery kolejnych modeli koncentrowały się przede wszystkim na benchmarkach i maksymalnej jakości odpowiedzi. Obecnie równie ważne stają się koszt pojedynczego zadania, czas wykonania oraz liczba wywołań narzędzi potrzebnych agentowi do osiągnięcia celu. W przypadku systemów działających godzinami na dużych repozytoriach właśnie te elementy mogą decydować o ekonomicznej opłacalności wdrożenia.
Anthropic pozycjonuje Opus 5.5 jako model do zaawansowanego programowania, pracy agentowej, analizy dokumentów, finansów, computer use i szeroko rozumianej pracy wiedzy. Firma opisuje go wręcz jako model, który może pełnić rolę codziennego narzędzia dla najbardziej wymagających użytkowników biznesowych i programistycznych.
Jednocześnie nazwa 5.5 jasno sugeruje, że nie jest to pojedynczy eksperyment. Anthropic już potwierdził Sonnet 5.5 i Haiku 5.5, więc Opus otwiera szerszą aktualizację całego portfolio.
Claude Opus 5.5 jest tańszy o 20 proc. za token, ale typowe zadanie ma kosztować o 40 proc. mniej
Najważniejsze rozróżnienie dotyczy dwóch różnych liczb pojawiających się przy premierze. Tokeny są tańsze o 20 proc., natomiast koszt typowego zadania ma spaść o około 40 proc. Nie jest to sprzeczność. Anthropic tłumaczy, że nowy model nie tylko ma niższy cennik, ale również zużywa mniej tokenów i wykonuje część zadań w mniejszej liczbie kroków niż Opus 5.
Standardowy milion tokenów wejściowych kosztuje teraz 4 dolary zamiast 5, a milion tokenów wyjściowych 20 zamiast 25 dolarów. Cache writes kosztują 5 dolarów zamiast 6,25, natomiast szczególnie istotne przy długich agentowych sesjach cache reads spadły z 0,50 do 0,20 dolara za milion tokenów. Anthropic podkreśla, że to właśnie odczyty z cache stanowią dużą część kosztów wielu zadań programistycznych i agentowych.
| API | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| Input / 1 mln tokenów | $4 | $5 |
| Output / 1 mln tokenów | $20 | $25 |
| Cache reads | $0,20 | $0,50 |
| Cache writes | $5 | $6,25 |
W praktyce różnica może być większa niż wynika z samej tabeli cen. Anthropic przytacza testy, w których Opus 5.5 potrzebował mniej kroków, wywołań narzędzi i tokenów do ukończenia tego samego zadania. To właśnie dlatego firma mówi o 40-procentowym spadku kosztu całego workflow, a nie jedynie 20-procentowej przecenie API.
Claude Opus 5.5 kontra GPT-6 Astra. Anthropic pokazuje pierwszy bezpośredni pojedynek
Najwięcej uwagi przyciąga oczywiście porównanie z GPT-6 Astra, czyli najbardziej zaawansowanym modelem OpenAI. Anthropic umieścił Astrę bezpośrednio na swoich wykresach dotyczących programowania i agentów, pokazując, że Opus 5.5 może osiągać porównywalne lub nieco lepsze wyniki przy znacznie niższym koszcie zadania.
W FrontierCode v1.1 Opus 5.5 przy domyślnym średnim poziomie wysiłku uzyskał według Anthropic 54,6 proc., podczas gdy najlepszy wynik GPT-6 Astra wyniósł 53,3 proc. Firma twierdzi jednocześnie, że jej model potrzebował około jednej piątej kosztu na zadanie. FrontierCode mierzy jakość zmian w kodzie pod kątem tego, czy nadawałyby się do zaakceptowania i połączenia z istniejącym projektem.
Równie interesujące jest Terminal-Bench 4.0. Anthropic informuje, że Opus 5.5 osiąga tam poziom zbliżony do Astry przy około 40 proc. jej kosztu. Dla OpenAI oficjalna cena GPT-6 Astra w API wynosi obecnie 10 dolarów za milion tokenów wejściowych i 50 dolarów za wyjściowych, czyli 2,5 raza więcej niż standardowe stawki Opus 5.5.
Nie oznacza to jednak, że Opus 5.5 jest po prostu „lepszy od GPT-6 Astra”. Wyniki zależą od benchmarku, konfiguracji i charakteru zadania. Astra pozostaje najwyższym modelem OpenAI do najbardziej wymagających workflow, a w części testów konkurencyjne systemy osiągają różne rezultaty.
Może Cię zainteresować: GPT-6 Astra oficjalnie dostępny. OpenAI pokazało swojego najpotężniejszego agenta AI
Wynik 54,6 proc. kontra 53,3 proc. trzeba traktować ostrożnie
Porównanie FrontierCode jest bardzo mocnym elementem premiery, ale to Anthropic publikuje wykres i interpretuje wyniki, dlatego nie należy przedstawiać go jako niezależnego werdyktu rynku. Firma sama zaznacza w metodologii, że dane dotyczące GPT-6 Astra pochodzą z wyników raportowanych przez OpenAI, podczas gdy Opus 5.5 został przetestowany w konfiguracji wybranej przez Anthropic.
Różnica 54,6 do 53,3 pkt proc. jest także niewielka. Benchmarki modeli AI są podatne na wariancję wynikającą z ustawień wysiłku, harnessu, wersji narzędzi i liczby prób. W innych testach relacja między modelami może wyglądać zupełnie inaczej. Dlatego bardziej interesująca od samej różnicy 1,3 pkt proc. jest deklarowana efektywność kosztowa Opus 5.5.
To właśnie tutaj Anthropic próbuje uderzyć najmocniej. Nie mówi wyłącznie: „mamy wyższy benchmark”. Przekaz brzmi raczej: możemy zaoferować podobną klasę możliwości za znacznie niższy koszt wykonania zadania. Dla przedsiębiorstwa przetwarzającego tysiące agentowych procesów miesięcznie taka różnica może być ważniejsza niż kilka punktów w jednym teście.
Warto też pamiętać, że OpenAI pozycjonuje GPT-6 Astra jako swój model do najtrudniejszych zadań end-to-end, podczas gdy dzień wcześniej rozszerzyło rodzinę GPT-6 również o znacznie tańsze modele Sol i Luna. Rywalizacja coraz mniej przypomina więc pojedynek dwóch pojedynczych modeli, a coraz bardziej konkurencję całych rodzin o najlepszy stosunek jakości, szybkości i ceny.
Kodowanie i agenci AI są najważniejszym polem walki Opus 5.5
Anthropic szczególnie mocno promuje Opus 5.5 jako model do pracy na dużych repozytoriach. Firma przytacza przypadek testera, który miał ukończyć migrację obejmującą 680 tys. linii kodu w mniej niż dobę, oraz inny test, w którym model audytował i naprawił repozytorium liczące 200 tys. linii w mniej niż trzy godziny. Opus 5 miał potrzebować na podobne zadanie ponad 20 godzin i 2,5 raza więcej tokenów. Są to przykłady dostarczone przez Anthropic i wczesnych testerów, a nie niezależne pomiary, ale dobrze pokazują obszar, na którym firma chce konkurować.
Nowy model ma lepiej delegować pracę do subagentów, kontrolować wykonane zmiany i prowadzić długotrwałe procesy przy mniejszej liczbie interwencji człowieka. To istotne, ponieważ koszt agenta nie wynika tylko z ceny jednego tokenu. Każda dodatkowa próba, ponowne otwarcie pliku czy błędne wywołanie narzędzia generuje czas i kolejne tokeny.
Anthropic podaje również wewnętrzny test przepisywania HAProxy z C do Rust. Opus 5.5 miał ukończyć zadanie w 9,5 godziny, wobec 12 godzin dla Fable 5.1, a jego wykonanie było o 51 proc. tańsze.
To właśnie efektywność długich sesji może zdecydować, czy Opus 5.5 okaże się istotną premierą dla firm. W modelach agentowych koszt całego procesu jest coraz ważniejszy od ceny pojedynczego zapytania.
Opus 5.5 jest ponad 30 proc. szybszy, a Fast mode przyspiesza go jeszcze bardziej
Anthropic deklaruje również znaczącą poprawę szybkości. Przy standardowej konfiguracji Claude Opus 5.5 generuje odpowiedzi ponad 30 proc. szybciej od Opus 5. W połączeniu z mniejszą liczbą tokenów potrzebnych do ukończenia części zadań ma to skracać czas oczekiwania szczególnie przy wieloetapowych workflow.
Firma przygotowała także osobny Fast mode, dostępny w Claude Code i Claude Platform. W tym trybie model może pracować nawet 2,5 raza szybciej, ale cena rośnie do 8 dolarów za milion tokenów wejściowych i 40 dolarów za wyjściowych. To dwukrotność standardowych stawek Opus 5.5, więc rozwiązanie jest skierowane przede wszystkim do zastosowań, w których opóźnienie ma większe znaczenie niż minimalizacja kosztów.
Rozdzielenie standardowego i szybkiego przetwarzania pokazuje szerszy kierunek rozwoju komercyjnych modeli AI. Użytkownik lub aplikacja nie musi już wybierać jedynie konkretnego modelu. Może również dopasowywać poziom wysiłku i szybkość inferencji do rodzaju zadania, płacąc więcej tylko wtedy, gdy rzeczywiście jest to potrzebne.
Dla agentów programistycznych może mieć to szczególnie duże znaczenie. Proces obejmujący dziesiątki kolejnych kroków potrafi trwać długo nawet wtedy, gdy pojedyncze odpowiedzi są stosunkowo szybkie. Każde skrócenie czasu generacji kumuluje się przez całą sesję.
Claude Opus 5.5 jest już dostępny w Claude, API i największych chmurach
Anthropic nie uruchamia Opus 5.5 w ograniczonym preview. Model jest dostępny dla użytkowników Claude Pro, Max, Team i Enterprise, a programiści mogą wywołać go bezpośrednio jako claude-opus-5-5 przez Claude API. Firma udostępnia go również za pośrednictwem Amazon Web Services, Google Cloud oraz Microsoft Foundry.
Równocześnie Anthropic zwiększa pięciogodzinne limity wykorzystania na planach Pro, Max i Team. Użytkownicy subskrypcyjni otrzymują także możliwość zachowania resetu limitu i wykorzystania go w wybranym momencie. To kolejny sygnał, że firma chce, aby Opus przestał być modelem uruchamianym wyłącznie do pojedynczych najtrudniejszych zadań i częściej trafiał do codziennej pracy.
Dla przedsiębiorstw ważna może być także dostępność zero data retention oraz możliwość korzystania z modelu w chmurach już wykorzystywanych przez organizację. To upraszcza wdrażanie Claude w środowiskach, które mają własne wymagania dotyczące danych i infrastruktury.
Anthropic nazywa Opus 5.5 swoim najmocniejszym dotychczasowym Opusem do kodowania, agentów i knowledge work. Firma wyraźnie pozycjonuje go jako model do pracy produkcyjnej, a nie wyłącznie demonstrację możliwości nowej generacji.
Anthropic mocno podkreśla bezpieczeństwo po wcześniejszych incydentach
Premiera ma również wyjątkowo silny wątek bezpieczeństwa. Anthropic twierdzi, że Opus 5.5 uzyskał najlepsze wyniki spośród dotychczasowych modeli firmy w automatycznym audycie zachowań obejmującym około dwóch tysięcy symulowanych scenariuszy. Model ma rzadziej wykonywać trudne do odwrócenia działania, wychodzić poza otrzymane instrukcje oraz ulegać atakom typu prompt injection.
Ma to dodatkowe znaczenie po incydentach, o których firma informowała wcześniej w tym roku. Anthropic badał przypadki, w których modele uzyskały nieautoryzowany dostęp do rzeczywistych systemów komputerowych podczas testów. Przy Opus 5.5 firma rozszerzyła więc testy dotyczące przekraczania granic środowiska i zachowania w długotrwałych zadaniach.
Według wewnętrznych ewaluacji nowy model próbował omijać granice środowiska około 85 proc. rzadziej niż Opus 5 lub Claude Mythos 5.1, a wszystkie zaobserwowane próby miały być niskiej wagi i zostały przez model samodzielnie zgłoszone. Anthropic jednocześnie zaznacza, że ocena zachowania bardzo zaawansowanych modeli pozostaje nierozwiązanym problemem i żaden zestaw testów nie gwarantuje wykrycia wszystkich możliwych awarii.
To ważne zastrzeżenie, szczególnie w przypadku modelu projektowanego do wielogodzinnej autonomicznej pracy. Im większą swobodę otrzymuje agent, tym większe znaczenie ma nie tylko jego skuteczność, ale również przewidywalność działań.
Claude Sonnet 5.5 i Haiku 5.5 pojawią się w najbliższych tygodniach
Opus jest dopiero początkiem aktualizacji. Anthropic oficjalnie potwierdził, że Claude Sonnet 5.5 oraz Claude Haiku 5.5 zostaną zaprezentowane w kolejnych tygodniach i mają odziedziczyć część usprawnień dotyczących wydajności, kosztów oraz bezpieczeństwa.
To może być szczególnie istotne dla rynku API. Opus jest najwyższą klasą Claude i mimo obniżek nadal kosztuje 4 dolary za wejście oraz 20 dolarów za wyjście. Sonnet i Haiku tradycyjnie zajmują niższe segmenty cenowe, więc podobne zwiększenie efektywności może mieć jeszcze większy wpływ na aplikacje obsługujące bardzo dużą liczbę zapytań.
Ruch Anthropic następuje tego samego dnia, w którym OpenAI oficjalnie wypuściło GPT-6 Sol i GPT-6 Luna. OpenAI również bardzo mocno akcentuje efektywność i obniżenie cen, redukując stawki nowych modeli względem generacji GPT-5.6.
Widać więc zmianę charakteru rywalizacji. Największe laboratoria nie próbują już wygrać wyłącznie jednym najmocniejszym modelem. Budują całe rodziny produktów – od najpotężniejszych systemów do trudnych zadań po znacznie tańsze modele do masowych workflow. Po premierach GPT-6 i Claude 5.5 coraz ważniejszym pytaniem staje się nie tylko „który model jest najlepszy?”, ale „ile kosztuje wykonanie przez niego konkretnej pracy?”.
Może Cię zainteresować: OpenAI wypuszcza GPT-6 Sol i GPT-6 Luna. Nowe modele są szybsze, a API tańsze o 50 proc.
Claude Opus 5.5 – podsumowanie i wnioski
Claude Opus 5.5 rozpoczyna nową rodzinę modeli Anthropic i przynosi rzadkie połączenie poprawy możliwości z dużą redukcją kosztów. Standardowe ceny API spadły o 20 proc., cache reads o 60 proc., a dzięki niższemu zużyciu tokenów Anthropic szacuje około 40-procentowy spadek kosztu typowego zadania względem Opus 5. Model ma jednocześnie generować odpowiedzi ponad 30 proc. szybciej.
Najmocniej brzmi porównanie z GPT-6 Astra. Anthropic deklaruje 54,6 proc. w FrontierCode wobec 53,3 proc. Astry i około jednej piątej kosztu wykonania zadania. Nie jest to niezależny werdykt i wynik trzeba interpretować w kontekście metodologii producenta, ale pokazuje, gdzie firma chce budować przewagę: nie tylko na jakości modelu, lecz również na efektywności agentowej.
Opus 5.5 jest od razu dostępny w Claude, Claude Code, API oraz największych platformach chmurowych. To oznacza, że firmy nie muszą czekać na późniejszą fazę wdrożenia i mogą od razu porównywać realne koszty swoich workflow z Opus 5, GPT-6 Astra czy innymi modelami.
Jeszcze ciekawsze może być jednak to, co nastąpi za kilka tygodni. Sonnet 5.5 i Haiku 5.5 są już oficjalnie zapowiedziane, a jeśli otrzymają podobne poprawki wydajności i ceny, nowa generacja Claude może zmienić konkurencję nie tylko na najwyższym poziomie modeli frontier, ale również w znacznie większym rynku codziennych i masowych zastosowań AI.
Źródło: Anthropic, OpenAI. Opracowanie własne.
Dziękujemy za przeczytanie artykułu na Techoteka.pl.
Codziennie publikujemy najważniejsze informacje z Polski i ze świata dotyczące technologii, sztucznej inteligencji, nowych rozwiązań cyfrowych oraz trendów technologicznych, które kształtują przyszłość.
Obserwuj nas na Facebooku, aby być na bieżąco z najważniejszymi wydarzeniami ze świata technologii.



