Anthropic i OpenAI pokazały we wtorek 22 września 2026 roku, w odstępie około 90 minut, tańsze modele: Claude Opus 5.5 kosztuje 4 dolary za milion tokenów wejściowych i 20 dolarów za milion wyjściowych, czyli o 20 proc. mniej niż Opus 5, a GPT-6 Sol i GPT-6 Luna są o połowę tańsze od odpowiedników z serii GPT-5.6. Obie firmy tym razem nie obiecują przede wszystkim skoku inteligencji, tylko niższy rachunek za wykonanie tego samego zadania, co Financial Times opisuje jako zaostrzenie wojny cenowej między amerykańskimi laboratoriami AI a tańszą konkurencją z Chin.
- 22 września 2026 roku Anthropic i OpenAI w odstępie około 90 minut ogłosiły premiery tańszych modeli: Claude Opus 5.5 kosztuje 4 dolary za milion tokenów wejściowych i 20 dolarów za milion wyjściowych (o 20 proc. mniej niż Opus 5), a GPT-6 Sol i GPT-6 Luna są o 50 proc. tańsze od odpowiedników z serii GPT-5.6.
- Anthropic obniżył cenę odczytów z pamięci podręcznej (cache) o 60 proc. – z 0,50 do 0,20 dolara za milion tokenów – argumentując, że to właśnie odczyty z cache stanowią większość kosztów w pracy agentowej i przy programowaniu.
- Według Financial Times presja cenowa wynika nie tylko z rywalizacji Anthropic z OpenAI, ale też z konkurencji tanich chińskich laboratoriów – m.in. Alibaby, Moonshot AI i DeepSeek – których modele z otwartymi wagami wyznaczają górną granicę cen płatnych API.
Claude Opus 5.5 ma dorównywać Fable 5.1 i kosztować o 40 proc. mniej niż Opus 5
Anthropic twierdzi, że Claude Opus 5.5 w większości zadań pracuje na poziomie Claude Fable 5.1, najmocniejszego publicznie dostępnego modelu firmy, a na typowych obciążeniach kosztuje o 40 proc. mniej niż Opus 5. Opus 5.5 jest pierwszym modelem nowej rodziny Claude 5.5. Claude Sonnet 5.5 i Claude Haiku 5.5 mają pojawić się w najbliższych tygodniach.
Oszczędność 40 proc. nie wynika wyłącznie z cennika. Anthropic obniżył cenę tokena o 20 proc., a jednocześnie model zużywa mniej tokenów na jedno zadanie. Najmocniej potaniały odczyty z pamięci podręcznej (cache): z 0,50 do 0,20 dolara za milion tokenów, czyli o 60 proc. Według Anthropic to właśnie odczyty z cache stanowią większość kosztów w pracy agentowej i przy programowaniu.
Najważniejsze zmiany w Claude Opus 5.5 według Anthropic:
- tokeny wejściowe i wyjściowe kosztują 4 i 20 dolarów za milion (w Opusie 5 było to 5 i 25 dolarów),
- model generuje odpowiedzi o ponad 30 proc. szybciej niż Opus 5,
- tryb szybki, do 2,5 raza szybszy, kosztuje 8 dolarów za milion tokenów wejściowych i 40 dolarów za milion wyjściowych,
- Anthropic podniósł pięciogodzinne limity użycia w planach Pro, Max, Team i Enterprise z licencjami na stanowisko,
- model jest dostępny na Claude Platform oraz w Amazon Web Services, Google Cloud i Microsoft Azure.
Dla porównania Claude Fable 5.1 kosztuje według Business Standard 10 dolarów za milion tokenów wejściowych i 50 dolarów za milion wyjściowych. Jeśli deklaracje Anthropic potwierdzą się w praktyce, firmy dostaną wydajność zbliżoną do flagowca za 40 proc. jego stawki za token. Poprzednik, Claude Opus 5, trafił na rynek 24 lipca, więc Anthropic wymienił model w niecałe dwa miesiące.
OpenAI tnie ceny GPT-6 Sol i GPT-6 Luna o połowę
OpenAI obniżyło stawki w API o 50 proc. dla dwóch nowych modeli z rodziny GPT-6. GPT-6 Sol kosztuje 2 dolary za milion tokenów wejściowych i 10 dolarów za milion wyjściowych, a GPT-6 Luna odpowiednio 0,10 i 0,50 dolara. Oba modele wytrenowano metodami opracowanymi przy GPT-6 Astra, flagowcu OpenAI pokazanym na początku września. Astra pozostaje najmocniejszym modelem firmy.
OpenAI tłumaczy obniżkę postępem w obsłudze zapytań i w mechanizmie cache. Ponownie wykorzystywany kontekst wejściowy jest teraz tańszy o 90 proc. GitHub przekazał OpenAI, że w ciągu ostatnich miesięcy zmiany w cache zmniejszyły o ponad połowę udział tokenów wymagających ponownego przetworzenia w miliardach zapytań.
Jest jedno zastrzeżenie. OpenAI we własnym komunikacie liczy obniżkę względem cen promocyjnych GPT-5.6. Rzecznik firmy zapewnił VentureBeat, że nowe stawki są stałe, a nie wprowadzające.
| Model | Tokeny wejściowe (za 1 mln) | Tokeny wyjściowe (za 1 mln) | Poprzednik |
|---|---|---|---|
| Claude Opus 5.5 | 4 USD | 20 USD | Opus 5: 5 / 25 USD |
| Claude Fable 5.1 | 10 USD | 50 USD | bez zmian |
| GPT-6 Sol | 2 USD | 10 USD | GPT-5.6 Sol: 4 / 20 USD |
| GPT-6 Luna | 0,10 USD | 0,50 USD | GPT-5.6 Luna: 0,20 / 1,20 USD |
GPT-6 Sol i Luna trafiły do ChatGPT Work i Codex dla użytkowników planów Plus, Pro, Business, Enterprise i Edu. Użytkownicy darmowego planu i planu Go dostali GPT-6 Luna w aplikacji na komputer. OpenAI zapowiedziało, że będzie udostępniać modele stopniowo, żeby nie przeciążyć usługi.
Anthropic i OpenAI porównują koszt zadania, a nie cenę tokena
Obie firmy przekonują klientów, że liczy się koszt wykonanego zadania, bo tańszy token nic nie daje, jeśli model zużywa ich więcej. Każda przy tym dobiera porównania na swoją korzyść:
- Anthropic podaje, że w CursorBench 4.0 Opus 5.5 przy domyślnym ustawieniu uzyskał 52,5 proc. wobec najlepszego wyniku GPT-5.6 Sol wynoszącego 41,7 proc., za około jedną trzecią kosztu zadania.
- Anthropic twierdzi też, że w Terminal-Bench 4.0 Opus 5.5 dorównuje GPT-6 Astra za mniej więcej 40 proc. kosztu.
- OpenAI podaje, że w AutomationBench GPT-6 Sol uzyskał 33,2 proc. przy koszcie 0,27 dolara za zadanie, a Claude Opus 5 26,9 proc. przy koszcie 11,1 raza wyższym.
- OpenAI twierdzi, że w DeepSWE v1.1 GPT-6 Sol osiągnął 68,8 proc., o 1,1 pkt proc. mniej niż Claude Fable 5, przy koszcie zadania niższym o około 80 proc.
Porównania OpenAI zestarzały się w dniu publikacji. The New Stack zwrócił uwagę, że OpenAI zestawia swoje modele z Opusem 5, a Anthropic kilka godzin wcześniej wypuścił Opusa 5.5. Według tabeli Anthropic Opus 5.5 w AutomationBench, teście prowadzonym przez Zapier, uzyskał 40 proc. Sam Anthropic przyznaje w materiałach premierowych, że przy obecnym poziomie modeli różnice w benchmarkach coraz słabiej oddają różnice w realnej pracy. Faktem pozostaje, że w przeliczeniu na token GPT-6 Sol jest o połowę tańszy od Claude Opus 5.5.
Obserwuję ten wyścig od miesięcy i widzę w nim dwie rzeczy naraz. Dla każdego, kto płaci za API, to dobra wiadomość: w lipcu Opus 5 kosztował 25 dolarów za milion tokenów wyjściowych, dziś jego następca kosztuje 20, a GPT-6 Sol 10. Ale tabelkom producentów bym nie ufał. OpenAI porównuje Sola z Opusem 5, który w dniu premiery przestał być najnowszym modelem Anthropic, a Anthropic w części testów zestawia Opusa 5.5 z GPT-5.6 Sol. Jedyny test, który coś znaczy, to własne zadania firmy policzone od początku do końca, razem z czasem, jaki człowiek traci na poprawki.
Drugie pytanie jest mniej wygodne. Obie firmy niedawno mówiły o potrzebie spowolnienia rozwoju najmocniejszych modeli, a we wtorek wypuściły premiery w odstępie półtorej godziny. Spowolnienie wyścigu o możliwości nie wyklucza wyścigu o cenę i uważam, że to on rozstrzygnie teraz, kto zostanie domyślnym dostawcą AI dla firm. Tylko czy przy kurczących się marżach starczy pieniędzy na bezpieczeństwo, o którym obie firmy tyle mówią?
Piotr Wolniewicz, Redaktor Naczelny AIPORT.pl
Chińskie modele z otwartymi wagami wyznaczają sufit cen
Presja cenowa nie wynika tylko z rywalizacji Anthropic i OpenAI. Według Financial Times obie firmy odpowiadają też na konkurencję tanich chińskich laboratoriów, a CNBC wymienia wśród nich Alibabę, Moonshot AI i DeepSeek. Modele z otwartymi wagami można uruchomić na własnych serwerach, więc przy prostych zadaniach, takich jak streszczanie czy wyciąganie danych z dokumentów, wyznaczają one górną granicę tego, ile da się pobrać za płatne API.
Fortune zauważa, że to pierwsze premiery obu firm od czasu, gdy publicznie wezwały do spowolnienia prac nad najpotężniejszymi systemami AI. Ara Kharazian, główny ekonomista Ramp, amerykańskiej firmy od kart firmowych i kontroli wydatków, powiedział Fortune, że laboratoria walczą na dwóch frontach: wypuszczają tańsze modele, na które przechodzą firmy, i obniżają ceny najdroższych. Według Kharaziana optymistycznie nastawieni inwestorzy zakładają, że coraz lepsze modele będą coraz droższe.
„Ale nowe technologie zwykle nie trafiają na rynek w ten sposób” / „But that is not how normal technology makes it to market.”
Sanchit Vir Gogia, główny analityk Greyhound Research, w rozmowie z InfoWorld spodziewa się kolejnych obniżek i uważa, że stawka jest wyższa niż w zwykłej wojnie cenowej.
„To wyścig o to, przez kogo firmy będą domyślnie kupować inteligencję” / „It is a land grab for the default route through which enterprises buy intelligence”
Charlie Dai z Forrestera radzi w tym samym tekście, żeby dyrektorzy IT liczyli koszt osiągniętego wyniku biznesowego zamiast kosztu tokena, a Anushree Verma z Gartnera ocenia, że firmy zaczynają traktować modele ogólnego przeznaczenia jako wymienne.
Tańsze API trafia do Polski, gdzie z AI korzysta 8,4 proc. firm
Nowe modele obu firm są dostępne dla polskich użytkowników w tych samych planach i przez to samo API co na innych rynkach, a ceny podawane są w dolarach. Według Eurostatu w 2025 roku co najmniej jedną technologię AI stosowało 8,4 proc. polskich przedsiębiorstw zatrudniających 10 lub więcej osób. Średnia unijna wyniosła 20 proc., a w Danii 42 proc. Polska znalazła się w końcówce zestawienia.
Moim zdaniem niższe stawki same nie zmienią tego wyniku. Dla firmy, która jeszcze nie policzyła, gdzie AI mogłoby jej się opłacić, różnica między 25 a 20 dolarami za milion tokenów niewiele znaczy. Tańsze modele najbardziej pomogą tym, którzy już mają działające wdrożenia i płacą za tysiące wywołań dziennie: software house’om, zespołom obsługi klienta i firmom automatyzującym pracę na dokumentach. To oni powinni teraz sprawdzić swoje zadania na nowych modelach, zanim przedłużą umowy.
Dla użytkowników z Unii ma znaczenie jeszcze jeden szczegół. Anthropic podaje, że Opus 5.5, podobnie jak Fable 5.1, oznacza generowane treści znakiem wodnym, żeby spełnić wymogi unijnego AI Act.
Źródła i metodologia
Artykuł powstał na podstawie analizy redakcji AIPORT.pl oraz dodatkowych źródeł, w tym oficjalnych komunikatów Anthropic i OpenAI z dnia 22.09.2026 oraz publikacji Financial Times. Redakcja korzystała także z materiałów Fortune, InfoWorld, VentureBeat, The New Stack, CNBC i Business Standard. Dane o wykorzystaniu AI w polskich firmach pochodzą z badania Eurostatu, omówionego przez interaktywnie.com.
Cytaty Ary Kharaziana, głównego ekonomisty Ramp, i Sanchita Vira Gogii, głównego analityka Greyhound Research, zostały zweryfikowane z oryginalnym anglojęzycznym materiałem źródłowym.
Komentarz redakcyjny i ocena kontekstu branżowego: Piotr Wolniewicz, Redaktor Naczelny AIPORT.pl.
Artykuł będzie aktualizowany w miarę pojawiania się nowych informacji o cenach modeli Anthropic i OpenAI, w tym o premierach Claude Sonnet 5.5 i Claude Haiku 5.5.
