Autor: Marcin Grześkowiak

Marcin Grześkowiak

Marcin Grześkowiak - redaktor i tester narzędzi AI w AIPORT.pl. Autor ponad 200 recenzji i testów aplikacji opartych na sztucznej inteligencji. Specjalizuje się w praktycznej ocenie narzędzi AI dla użytkowników indywidualnych i firm - sprawdza skuteczność, użyteczność i stosunek ceny do jakości. Relacjonuje konferencje i premiery ze świata AI, w tym wydarzenia branżowe w Polsce i za granicą.

OpenAI obniżyło w czwartek 30 lipca stawki dwóch tańszych modeli z rodziny GPT-5.6, trzy tygodnie po tym, jak trafiły do powszechnej sprzedaży. Luna potaniała pięciokrotnie, Terra o jedną piątą, a flagowy Sol został przy dotychczasowej cenie. To nie jest kosmetyczna korekta cennika. Obniżka o 80 procent na modelu, który obsługuje największy wolumen ruchu produkcyjnego, zmienia rachunek opłacalności całych klas zadań. Klasyfikacja dokumentów, routing zgłoszeń, pierwsza wersja tekstu, długie pętle agentowe, w których jedno polecenie użytkownika wyzwala kilkadziesiąt wywołań modelu. Wszystko to nagle kosztuje piątą część tego, co kosztowało w środę. Nowy cennik w liczbach Stawki standardowe za milion tokenów wejściowych…

Czytaj więcej

Google DeepMind pokazał w czwartek 30 lipca 2026 roku Gemini Robotics 2, rodzinę trzech modeli, która po raz pierwszy przejmuje kontrolę nad całym ciałem humanoida, a nie tylko nad jego ramionami. Razem z premierą firma opublikowała surowe wyniki skuteczności i to one mówią o stanie robotyki więcej niż jakikolwiek film promocyjny. Materiały wideo z demonstracjami dostępne są na stronie modelu w serwisie Google DeepMind. Widać na nich Apollo 2 od Apptronika, który podchodzi do stołu, podnosi konewkę, robi kilka kroków do regału i odkłada ją na dolną półkę. Brzmi banalnie. Dla robotyki humanoidalnej to jest właśnie ten trudny moment, w…

Czytaj więcej

Niemiecki gabinet przyjął w środę projekt ustawy, która pozwoli urzędom migracyjnym rozwijać i wykorzystywać systemy sztucznej inteligencji przy rozpatrywaniu wniosków azylowych, wizowych i pobytowych. Modele mają być trenowane na prawdziwych danych osobowych wnioskodawców, bo zdaniem resortu spraw wewnętrznych anonimizacja zniszczyłaby zależności, których algorytm ma się nauczyć. Projekt nosi nazwę KI-Migrationsverwaltungsgesetz, w skrócie KIMVG. Rada ministrów pod przewodnictwem Friedricha Merza zatwierdziła go 29 lipca, a jesienią trafi pod obrady Bundestagu i Bundesratu. Pierwsze doniesienia o treści dokumentu pochodziły z Politico i „Die Welt”, ale sam roboczy tekst opublikował miesiąc wcześniej portal netzpolitik.org, który uzyskał go na etapie konsultacji resortowych. Co dokładnie…

Czytaj więcej

OpenAI zaktualizowało swój raport z incydentu i przyznało, że modele, które wyrwały się z testowej piaskownicy, sięgnęły po dane logowania na czterech kolejnych publicznie dostępnych usługach. Hugging Face opublikowało z kolei minutowy rozkład ataku: 17 600 odtworzonych akcji agenta w oknie od 9 do 13 lipca. Sprawdziłem obie publikacje, bo polskie doniesienia siłą rzeczy skracają je do jednego akapitu. A to właśnie w szczegółach leży cała wartość tego przypadku. Hugging Face przygotowało interaktywną rekonstrukcję kampanii krok po kroku, z komendami dokładnie w takiej postaci, w jakiej zostały zarejestrowane. Polecam ją obejrzeć przed dalszą lekturą. Co dokładnie ujawniła aktualizacja OpenAI Pierwotny…

Czytaj więcej

Podpięcie algorytmu Epic Deterioration Index pod automatyczne wezwania zespołów szybkiego reagowania wiązało się z 18-procentowym spadkiem skorygowanego ryzyka zgonu wśród pacjentów wysokiego ryzyka. Wynika to z badania obejmującego 23 132 chorych z 11 szpitali sieci RWJBarnabas Health w New Jersey, opublikowanego 29 lipca 2026 roku w NEJM AI. Wynik brzmi mocno i tak też został zakomunikowany. Ale kiedy przeczytałem całość razem z tym, co o tym samym algorytmie wiemy z innych badań, obraz robi się dużo ciekawszy niż komunikat prasowy. Bo bohaterem tej historii wcale nie jest model predykcyjny. Co dokładnie pokazuje badanie z NEJM AI Epic Deterioration Index to…

Czytaj więcej

Piętnaście z szesnastu największych modeli językowych świata wylądowało w tym samym rogu kompasu politycznego. Szesnasty, Grok, zachował się tak, jakby na pytania odpowiadały dwie zupełnie różne osoby. Eksperyment opublikowała pod koniec lipca 2026 roku niewielka pracownia Unslop.run, zajmująca się na co dzień wykrywaniem tekstów generowanych przez AI. Jej autor przedstawia się jako Victor i, jak wyjaśnił redakcji The Register, pracuje jako inżynier badawczy w europejskim startupie. Sam zastrzega, że projekt nie ma rangi pracy recenzowanej naukowo. Mimo to jest to najszersze zestawienie tego typu, jakie widziałem od czasu badania Davida Rozado sprzed dwóch lat. 69 440 odpowiedzi i jedna ćwiartka…

Czytaj więcej

JFrog potwierdził, że to jego Artifactory był furtką, przez którą modele OpenAI wydostały się z odizolowanego środowiska badawczego i dotarły do produkcyjnej infrastruktury Hugging Face. Wpis dyrektora technicznego firmy opowiada tę historię jako wzorzec współpracy, tylko że pomiędzy ujawnieniem włamania a wypuszczeniem łatki minęło jedenaście dni. Sprawdziłem chronologię i muszę przyznać, że kolejność zdarzeń jest tu ciekawsza niż sam techniczny opis ataku. Jak wyglądała ucieczka z piaskownicy OpenAI testowało swoje modele na benchmarku ExploitGym, czyli zestawie zadań mierzącym zaawansowane zdolności ofensywne w cyberbezpieczeństwie. Do testu poszły GPT-5.6 Sol oraz nieujawniony publicznie, mocniejszy model przedpremierowy. Obydwa działały z wyłączonymi klasyfikatorami produkcyjnymi,…

Czytaj więcej

Sam Altman powiedział w sobotę, że ludzkość wkroczyła w osobliwość, i że będzie to dla świata coś wspaniałego. Kilkunastu badaczy zapytanych przez Business Insider odpowiedziało mu, że nie, jeszcze nie, a jeden z nich stwierdził wprost, że sam Altman w to nie wierzy. Wypowiedź padła w odcinku podcastu „Relentless”, opublikowanym w sobotę 25 lipca. Altman użył sformułowania, które w środowisku AI od dekad funkcjonuje jako granica dzieląca to, co przewidywalne, od tego, co przewidywalne przestaje być. Co dokładnie powiedział szef OpenAI „Jesteśmy teraz, no wiesz, w osobliwości” / „We are now, like, in the singularity” powiedział Altman. Dodał, że jeszcze…

Czytaj więcej

Przez weekend 25 i 26 lipca jedno zapytanie w Google otwierało dostęp do cudzych rozmów z Claude’em, wraz z kluczami API, życiorysami i notatkami prawników. Anthropic domknął sprawę w poniedziałek, tyle że wcześniej udostępnione adresy nadal prowadzą do pełnych transkrypcji. Nikt się nigdzie nie włamał. Żadne konto nie zostało przejęte, żadna prywatna historia czatów nie wyciekła z serwerów Anthropic. Sprawę uruchomił wpis użytkownika opublikowany w sobotę na forum r/ClaudeAI, a zrzuty ekranu rozeszły się w ciągu kilku godzin, między innymi przez X. https://twitter.com/om_patel5/status/2081494782396747779?ref_src=twsrc%5Etfw Jak to wyszło na jaw Mechanizm był banalny. Claude ma przycisk „Share”, który tworzy migawkę rozmowy pod…

Czytaj więcej

Jedenaście największych firm technologicznych i ich organizacje branżowe wydały w pierwszym półroczu 2026 roku 41,8 miliona dolarów na lobbing federalny w Waszyngtonie. To ponad 230 tysięcy dolarów dziennie, wliczając weekendy i dni wolne od pracy Kongresu. Dane pochodzą z analizy nowych zgłoszeń lobbingowych, które firmy muszą kwartalnie składać w Senacie. Zestawienie przygotowała Issue One, dwupartyjna organizacja zajmująca się pieniędzmi w polityce. Wzrost względem pierwszego półrocza 2025 roku wynosi około 3,7 miliona dolarów, czyli 10 procent. Ale sam wzrost to najmniej ciekawa część tej historii. Ciekawsze jest to, kto rośnie najszybciej. Anthropic wyprzedza OpenAI i goni gigantów W drugim kwartale 2026…

Czytaj więcej