Chińska firma Moonshot AI pokazała w piątek na konferencji WAIC w Szanghaju model liczący 2,8 biliona parametrów, który w części testów pokonuje systemy Anthropic i OpenAI. Rynek zareagował natychmiast: akcje krajowych rywali Moonshota straciły w Hongkongu nawet 30 procent w ciągu jednego dnia.
Kluczowe fakty:
- Moonshot AI zaprezentował model Kimi K3 liczący 2,8 biliona parametrów, który zadebiutował 16 lipca 2025 roku, a pełne wagi w formule open source mają zostać udostępnione 27 lipca – czyniąc go największym modelem z otwartymi wagami w historii.
- K3 wykorzystuje architekturę mixture-of-experts, w której z 896 dostępnych ekspertów w danym zapytaniu aktywuje się jedynie 16 (około 1,8%), co znacząco obniża koszt wnioskowania pomimo ogromnej skali modelu.
- Niezależne testy wykazały, że K3 przewyższa Claude Opus 4.8 i GPT-5.5 w zadaniach kodowania, jednak nadal ustępuje najsilniejszym zamkniętym systemom – Claude Fable 5 i GPT-5.6 Sol.
Kimi K3 zadebiutował 16 lipca poprzez aplikację i API Moonshota, a pełne wagi modelu w formule open source mają trafić do sieci 27 lipca. Firma nazywa go swoim najbardziej zaawansowanym modelem w historii i pierwszym otwartym systemem z klasy trzech bilionów parametrów. Sama liczba robi wrażenie, ale w praktyce K3 to model rzadko aktywowany: z 896 dostępnych ekspertów w architekturze mixture-of-experts w danym zapytaniu włącza się zaledwie 16, czyli około 1,8 procent całości. Dzięki temu koszt wnioskowania jest znacznie niższy niż sugerowałaby sama skala modelu.
Architektura i liczby, które robią wrażenie
Moonshot wprowadził dwa nowe rozwiązania techniczne: Kimi Delta Attention, hybrydowy mechanizm uwagi przyspieszający dekodowanie przy bardzo długich kontekstach, oraz Attention Residuals, zmieniający sposób przepływu informacji między warstwami sieci. Model obsługuje okno kontekstu do miliona tokenów i ma wbudowane rozumienie obrazu. Sam Moonshot przekonuje, że dzięki nowej architekturze uzyskał około 2,5-krotny wzrost efektywności skalowania względem poprzedniej generacji K2.
Dla porównania, poprzednik K2.6 miał znacznie mniej parametrów, a konkurencyjny DeepSeek V4 Pro dysponuje 1,6 biliona. K3 jest więc od niego niemal dwukrotnie większy i zdecydowanie największym jak dotąd modelem udostępnianym z otwartymi wagami.
Wyniki niezależnych testów Artificial Analysis i Arena.ai pokazują, że model plasuje się blisko czołówki, choć sam Moonshot uczciwie przyznaje, że pod względem ogólnej wydajności wciąż ustępuje najsilniejszym zamkniętym systemom, czyli Claude Fable 5 od Anthropic i GPT-5.6 Sol od OpenAI. Jednocześnie K3 pokonał Claude Opus 4.8 oraz GPT-5.5 w zadaniach kodowania i agentowych. Najgłośniejszy wynik padł na benchmarku Frontend Code Arena, gdzie K3 zdobył 1679 punktów i zajął pierwsze miejsce, wyprzedzając Fable 5 (1631 pkt) i GPT-5.6 Sol (1618 pkt). To skok o 17 pozycji względem poprzednika K2.6, który plasował się na miejscu 18.
Zespół Arena.ai podsumował ten wynik na X tak: „Kimi K3 od @Kimi_Moonshot przesunął granicę Pareto dla Code Arena: Frontend” / „Kimi K3 from @Kimi_Moonshot has moved the Pareto Frontier for Code Arena: Frontend” — link do posta: https://twitter.com/arena/status/2077841092104646856
Giełda karze konkurentów Moonshota
Reakcja rynku była błyskawiczna i dotkliwa. Notowane w Hongkongu akcje Zhipu spadły o około 27–28 procent, a MiniMax straciło od 15 do 16,5 procent, w zależności od momentu sesji. Akcje Z.ai, kolejnego chińskiego rywala, zanurkowały nawet o 30 procent, co było najgorszą sesją w historii spółki od jej styczniowego debiutu giełdowego. Fala niepokoju przeniosła się też na producentów sprzętu: indeks półprzewodników w Azji stracił ponad 6 procent, tajwański Taiwan Semiconductor Manufacturing Company spadł o 7 procent mimo raportu o 77-procentowym wzroście zysku operacyjnego, a kontrakty terminowe na Nasdaq 100 przed otwarciem amerykańskiej sesji zniżkowały o 2 procent.
Część analityków porównuje ten moment do premiery DeepSeek R1 ze stycznia 2025 roku, która w jeden dzień starła z wyceny Nvidii około 590 miliardów dolarów. Analityk Bernstein, Robin Zhu, ocenił sytuację spokojniej, pisząc że K3 potwierdza dwa trendy: dalszy szybki rozwój najlepszych dostępnych modeli oraz zdolność chińskich laboratoriów do utrzymywania tempa ze światową czołówką i stopniowego przejmowania udziałów rynkowych.
Kimi K3 to kolejny dowód, że przewaga technologiczna w AI ma dziś krótki termin przydatności. Model wciąż ustępuje najlepszym systemom zamkniętym z USA, sam Moonshot to zresztą otwarcie przyznaje, ale odległość maleje z premiery na premierę, nie z roku na rok. Dla mnie ciekawsze niż same liczby jest to, jak rynek zareagował na darmowy, otwarty model zbliżony jakością do płatnych systemów: paniką wśród konkurentów z Chin i nerwowością wśród producentów układów. To pokazuje, że inwestorzy zaczynają liczyć się z tym, że przewaga kapitałowa i sprzętowa USA nie przekłada się automatycznie na trwałą przewagę produktową. Jednocześnie warto zachować dystans do samych benchmarków. Wygrana w jednym rankingu kodowania frontendowego to nie to samo co ogólna przewaga nad Claude czy GPT. Prawdziwy test dopiero przed K3, kiedy 27 lipca trafią do sieci pełne wagi modelu i deweloperzy na całym świecie zaczną go realnie testować poza kontrolowanymi warunkami premierowymi.
Piotr Wolniewicz, Redaktor Naczelny AIPORT.pl
Kontekst geopolityczny: cień eksportowych restrykcji
Premiera K3 zbiega się w czasie z niedawnym zamieszaniem wokół modeli Anthropic. Amerykański rząd nakazał na początku czerwca tymczasowe wycofanie modeli Fable i Mythos ze względu na obawy dotyczące bezpieczeństwa, a restrykcje eksportowe zniesiono dopiero pod koniec miesiąca. Ten epizod pokazał, że Waszyngton traktuje zaawansowane modele AI jako element infrastruktury krytycznej i zasób bezpieczeństwa narodowego podlegający ścisłej kontroli eksportu.
Tymczasem Moonshot, wspierany kapitałowo przez Alibabę i Tencent, buduje swój model mimo ograniczeń w dostępie do najnowszych układów Nvidii. Firma w kwietniu informowała, że jej roczne przychody powtarzalne przekroczyły 200 milionów dolarów, a w maju pozyskała rundę finansowania na poziomie około 2 miliardów dolarów przy wycenie 20 miliardów. Według doniesień Bloomberga trwają już rozmowy o kolejnej rundzie, tym razem przy wycenie sięgającej 30 miliardów dolarów.
Kilka faktów o skali zjawiska:
- K3 jest około 1,75 raza większy niż DeepSeek V4 Pro (1,6 biliona parametrów)
- Cennik API wynosi 3 dolary za milion tokenów wejściowych i 15 dolarów za milion tokenów wyjściowych, czyli najwyżej wśród chińskich laboratoriów, ale wciąż poniżej stawek Anthropic za model klasy Opus
- Pełne wagi modelu trafią do sieci 27 lipca 2026 roku na licencji open source
Co to oznacza dla polskich firm?
Dla firm w Polsce, które dopiero testują wdrożenia dużych modeli językowych, otwarty model klasy K3 oznacza realną alternatywę kosztową wobec amerykańskich systemów zamkniętych, o ile ktoś dysponuje infrastrukturą zdolną go uruchomić. To jednak duże zastrzeżenie: model wymaga sprzętu klasy centrum danych, więc dla większości mniejszych firm praktyczne znaczenie będzie miało raczej to, czy dostawcy chmurowi obecni na polskim rynku zaczną oferować K3 jako gotową usługę API, tak jak zrobili to już niektórzy zagraniczni agregatorzy modeli. Warto też pamiętać, że korzystanie z chińskich modeli open source rodzi pytania o zgodność z unijnymi regulacjami dotyczącymi AI, w tym z wymogami dokumentacyjnymi zbliżającego się terminu 2 sierpnia w ramach AI Act. Polskie firmy rozważające migrację do tańszych modeli powinny sprawdzić, czy dany dostawca API spełnia te same standardy transparentności co dotychczasowi partnerzy z USA.
Źródła i metodologia
Artykuł powstał na podstawie analizy redakcji AIPORT.pl oraz materiału BBC News z 17 lipca 2026 roku, a także dodatkowych źródeł, w tym VentureBeat, Tom’s Hardware oraz Fortune. Dane rynkowe i cytaty zweryfikowano dodatkowo w materiałach CNBC, Axios, Yahoo Finance i Arena.ai. Komentarz redakcyjny i ocena kontekstu branżowego: Piotr Wolniewicz, Redaktor Naczelny AIPORT.pl. Artykuł będzie aktualizowany po publikacji pełnych wag modelu Kimi K3, zaplanowanej na 27 lipca 2026 roku.
