Najlepsze chińskie modele AI ustępują amerykańskim w testach porównawczych już tylko o 3 proc., wynika z raportu Bloomberg Intelligence opublikowanego w poniedziałek 5 października 2026 r. Jeszcze w maju różnica wynosiła około 9 proc., a na początku roku 15 proc., i według autora raportu Roberta Lei stopniała do rekordowo niskiego poziomu po wrześniowej premierze modelu DeepSeek V4.1 Flash.
- Według raportu Bloomberg Intelligence z 5 października 2026 r. różnica w wynikach benchmarkowych między najlepszymi chińskimi a amerykańskimi modelami AI spadła do 3 proc., podczas gdy na początku 2026 r. wynosiła około 15 proc., a w maju około 9 proc.
- DeepSeek V4.1 Flash, który analityk Robert Lea wskazuje jako kluczowy czynnik zmniejszenia tej luki, ma 552 mld parametrów, architekturę Mixture-of-Experts i kosztuje zaledwie 0,15 dol. za milion tokenów wejściowych poza godzinami szczytu, a w teście Terminal-Bench 2.1 uzyskał wynik 90,6 – wyprzedzając OpenAI GPT-5.6 Sol (88,8) i DeepSeek V4 Pro (87,9).
- UODO już w lutym 2025 r. zalecił „daleko idącą ostrożność" w korzystaniu z usług DeepSeek ze względu na możliwe przekazywanie danych na serwery w Chinach, które Komisja Europejska nie uznaje za kraj zapewniający odpowiedni poziom ochrony danych osobowych.
Przewaga USA nad Chinami stopniała z 15 do 3 proc. w kilka miesięcy
Bloomberg Intelligence (dział analityczny agencji Bloomberg) ocenia, że przewaga amerykańskich firm AI nad chińskimi pod względem wyników modeli jest dziś najmniejsza w historii pomiarów. Robert Lea, starszy analityk Bloomberg Intelligence, wiąże ten spadek z postępami laboratoriów takich jak DeepSeek i prognozuje, że lepsze wyniki przełożą się na dalszy wzrost udziału chińskich dostawców w rynku.
Raport opisała 4 października Saritha Rai z Bloomberga. W dostępnej publicznie części depeszy nie ma informacji, na których konkretnie benchmarkach Bloomberg Intelligence oparł wyliczenie. Pełny raport jest dostępny dla klientów Bloomberga, dlatego 3 proc. traktuję jako szacunek analityka, a nie wynik jednego, powszechnie uznanego testu.
Tak wygląda zmiana różnicy według Bloomberg Intelligence:
- początek 2026 r.: około 15 proc.,
- maj 2026 r.: około 9 proc.,
- po premierze DeepSeek V4.1 Flash we wrześniu 2026 r.: 3 proc.
DeepSeek V4.1 Flash to najmniejszy model serii, który zastąpił flagowy V4 Pro
DeepSeek udostępnił V4.1 Flash w czwartek 10 września 2026 r. i twierdzi, że nowy model przewyższa poprzedni flagowy model firmy, a przy tym jest tańszy i szybszy. Od 14 września, od godz. 12:00 czasu pekińskiego, wszystkie zapytania kierowane do V4 Pro obsługuje V4.1 Flash, rozliczany według własnego, niższego cennika. Tak ma być do premiery V4.1 Pro, której daty DeepSeek nie podał.
Model korzysta z nowej architektury, którą DeepSeek nazywa Causal-Encoder-Decoder. Ma 552 mld parametrów, ale dzięki konstrukcji Mixture-of-Experts (zapytanie trafia tylko do wyspecjalizowanych podsieci) uruchamia 8 mld parametrów przy przetwarzaniu danych wejściowych i 16 mld przy generowaniu odpowiedzi. DeepSeek opisuje V4.1 Flash jako najmniejszy model nowej serii, z wbudowanym rozumieniem obrazu. Okno kontekstowe modelu to 1 048 576 tokenów.
Cennik API DeepSeek za milion tokenów wynosi 0,30 dol. za dane wejściowe i 1,20 dol. za wyjściowe w godzinach szczytu oraz 0,15 dol. i 0,60 dol. poza szczytem.
Wyniki w teście Terminal-Bench 2.1, który sprawdza pracę modeli AI na rzeczywistych zadaniach w terminalu, podaję za „South China Morning Post”:
| Model | Terminal-Bench 2.1 |
|---|---|
| DeepSeek V4.1 Flash | 90,6 |
| OpenAI GPT-5.6 Sol | 88,8 |
| Moonshot AI Kimi K3 | 88,3 |
| DeepSeek V4 Pro | 87,9 |
Jeden test nie daje pełnego obrazu. Bloomberg zaznaczał po premierze, że V4.1 Flash bije V4 Pro w programowaniu i zadaniach agentowych, ale w benchmarkach nadal ustępuje flagowym modelom Anthropic i OpenAI.
Trzy procent różnicy w benchmarkach brzmi jak remis, ale ja czytam tę liczbę ostrożnie. Nie wiemy, jakie testy weszły do wyliczenia Bloomberg Intelligence, a benchmarki od dawna mierzą głównie to, pod co laboratoria optymalizują swoje modele. Ciekawsze jest dla mnie coś innego: DeepSeek dogania czołówkę najmniejszym modelem z serii i sprzedaje go po 15 centów za milion tokenów. Jeśli model „prawie tak dobry” kosztuje wielokrotnie mniej, to pytanie nie brzmi już, kto ma najlepszy model, tylko kto zarobi na AI. Pytanie otwarte pozostaje to samo co rok temu: ile firm w Europie odważy się wysłać swoje dane do chińskiego API i ile z nich w ogóle będzie mogło to zrobić zgodnie z prawem.
Piotr Wolniewicz, Redaktor Naczelny AIPORT.pl
Chińskie modele obsługują większość ruchu na OpenRouter, ale nie większość wydatków
Dane o użyciu pokazują, że prognoza Roberta Lei o rosnącym udziale chińskich dostawców już się materializuje, przynajmniej wśród programistów. Według danych OpenRouter (pośrednik, przez który deweloperzy łączą się z wieloma modelami naraz) przytoczonych przez CNBC 26 września chińskie modele odpowiadały za 57-67 proc. tokenów w tygodniu od 14 września.
Udział w tokenach nie oznacza jednak udziału w przychodach. Vercel AI Gateway podał, że w czerwcu 2026 r. modele z otwartymi wagami odpowiadały za 29 proc. przetworzonych tokenów, ale tylko za 4 proc. wydatków. Dane z OpenRouter opisują ruch przez jedną bramkę, a nie cały rynek AI.
Presja cenowa uderza też w chińskich konkurentów DeepSeek. Firma analityczna Artificial Analysis mówi o „strefie śmierci” DeepSeek: konkurenci muszą albo zejść z ceną poniżej DeepSeek, albo wyraźnie przebić go możliwościami. Po premierze V4.1 Flash akcje Alibaby spadły o ponad 2 proc.
W kwietniu oceny były odwrotne: DeepSeek V4 nie zmniejszył dystansu
Raport Bloomberg Intelligence odwraca wnioski sprzed pół roku. Gdy w kwietniu DeepSeek pokazał wersje testowe modeli V4 Pro i V4 Flash, sam przyznawał, że V4 Pro traci do światowej czołówki od 3 do 6 miesięcy, a Bloomberg pisał, że długo oczekiwany model nie zmniejszył przewagi USA. Chris McGuire z Council on Foreign Relations szacował wtedy przewagę Stanów Zjednoczonych na około siedem miesięcy.
W Artificial Analysis Intelligence Index model V4 uzyskał wówczas 52 punkty, podczas gdy GPT-5.5 od OpenAI miał 60. Bloomberg Intelligence i Artificial Analysis liczą swoje wskaźniki inaczej, więc tych liczb nie da się bezpośrednio zestawić z dzisiejszymi 3 proc. Kierunek zmiany jest jednak ten sam.
UODO od lutego 2025 r. zaleca ostrożność wobec usług DeepSeek
Dla polskich firm tańszy i lepszy DeepSeek oznacza pokusę, ale też znany problem z danymi. W lutym 2025 r. Urząd Ochrony Danych Osobowych zalecił „daleko idącą ostrożność” w korzystaniu z chatbota i innych usług DeepSeek, bo dane użytkowników mogą trafiać na serwery w Chinach, a Komisja Europejska nie uznała Chin za państwo zapewniające odpowiedni stopień ochrony danych.
Zalecenie UODO dotyczy usług świadczonych przez DeepSeek, czyli aplikacji i API. V4.1 Flash jest modelem z otwartymi wagami, dopuszczonym do użytku komercyjnego. Moim zdaniem to właśnie ta droga, czyli uruchamianie modelu na własnej lub europejskiej infrastrukturze, będzie dla polskich firm realnym sposobem korzystania z chińskich modeli. Przy 552 mld parametrów wymaga to jednak poważnego zaplecza sprzętowego.
Źródła i metodologia
Artykuł powstał na podstawie analizy redakcji AIPORT.pl oraz dodatkowych źródeł, w tym depeszy Bloomberga z dnia 04.10.2026 opisującej raport Bloomberg Intelligence, publikacji South China Morning Post z dnia 10.09.2026, karty modelu w serwisie OpenRouter oraz danych CNBC, Vercel i Artificial Analysis. Polski kontekst na podstawie komunikatu UODO opisanego przez Bankier.pl.
Redakcja nie miała dostępu do pełnej treści raportu Bloomberg Intelligence. Dane z raportu podajemy za publicznie dostępną częścią depeszy Bloomberga.
Komentarz redakcyjny i ocena kontekstu branżowego: Piotr Wolniewicz, Redaktor Naczelny AIPORT.pl.
Artykuł będzie aktualizowany w miarę pojawiania się nowych informacji w temacie rywalizacji chińskich i amerykańskich modeli AI.
