Wojewódzka Stacja Sanitarno-Epidemiologiczna w Gdańsku ostrzega, że aplikacje rozpoznające grzyby na podstawie zdjęcia nie powinny decydować o tym, czy znaleziony okaz trafi na talerz. Niezależne testy to potwierdzają: w benchmarku Piotra Migdała z firmy Quesma nawet najdokładniejszy model, Gemini 3.8 Flash, uznał za jadalne 11 proc. zdjęć grzybów trujących, a część modeli myliła się w ponad co czwartym przypadku.
- W benchmarku Piotra Migdała z firmy Quesma, obejmującym 18 modeli AI i 1040 zdjęć grzybów, nawet najdokładniejszy model – Gemini 3.8 Flash – uznał za jadalne 11 proc. zdjęć grzybów trujących, a część modeli myliła się w ponad co czwartym przypadku.
- Wśród konkretnych pomyłek odnotowanych w teście: muchomor sromotnikowy w 15 proc. odpowiedzi był brany za gatunek jadalny, śmiertelnie trująca hełmówka jadowita w 24 proc. przypadków była identyfikowana jako jadalny łuszczak zmienny lub płomiennica zimowa, a zasłonak wspaniały w 27 proc. odpowiedzi trafiał do kategorii jadalnych, m.in. jako kurka.
- Wcześniejsze badanie opublikowane w „Clinical Toxicology" w lutym 2023 r. wykazało, że najlepsza z trzech testowanych aplikacji – Picture Mushroom – poprawnie rozpoznała zaledwie 49 proc. badanych okazów grzybów i 44 proc. grzybów trujących, a autorzy odnotowali wzrost liczby zatruć po błędnych wskazaniach aplikacji.
Komunikat gdańskiego sanepidu „Grzyby bez ryzyka” ukazał się 7 sierpnia 2026 r. Teraz, w szczycie sezonu, zaczął krążyć w mediach. 23 września przypomniał go m.in. Onet, który ujął problem wprost jako pytanie AI o zdjęcie grzyba.
Sanepid: aplikacja nie zobaczy tego, czego nie ma na zdjęciu
WSSE w Gdańsku nie zakazuje korzystania z aplikacji, ale jasno określa ich miejsce. W komunikacie czytamy: „Aplikacje do rozpoznawania grzybów mogą być ciekawą pomocą edukacyjną, ale nie powinny być podstawą decyzji o zjedzeniu znalezionego okazu.”
Sanepid wskazuje, że program analizujący fotografię może pominąć cechy, których na zdjęciu po prostu nie widać:
- budowę podstawy trzonu,
- obecność pochwy i pierścienia,
- układ blaszek lub rurek,
- zapach,
- zmianę barwy po uszkodzeniu,
- środowisko, w którym grzyb wyrósł.
Do tego dochodzi jakość samego zdjęcia. Według WSSE ujęcie pod złym kątem, bez dolnej części trzonu albo w nietypowym świetle może dać błędny wynik. Stacja stawia na równi z aplikacjami porady z mediów społecznościowych i internetowych grup: nawet osoba, która dobrze zna grzyby, może nie rozpoznać gatunku z jednego zdjęcia.
To nie jest teoretyczne ryzyko. Główny Inspektorat Sanitarny od lat powtarza, że najgroźniejsze zatrucia w Polsce powoduje muchomor sromotnikowy, mylony m.in. z czubajką kanią i gąską zieloną.
Benchmark Quesmy: 18 modeli AI, 1040 zdjęć i sporo groźnych pomyłek
Najbardziej aktualne dane o tym, jak radzą sobie popularne modele językowe z rozpoznawaniem grzybów, opublikował 2 września 2026 r. Piotr Migdał, specjalista od analizy danych związany z firmą Quesma. Test ma wyraźny polski akcent: gatunki dobrał na podstawie oficjalnej polskiej listy grzybów dopuszczonych do obrotu oraz listy gatunków śmiertelnie trujących.
Zdjęcia pochodziły ze zbioru FungiTastic, przygotowanego przez czeskich badaczy widzenia komputerowego na podstawie obywatelskiego projektu Atlas of Danish Fungi. Zbiór liczy 340 tys. obserwacji (615 tys. zdjęć) z 2,8 tys. gatunków, a oznaczenia weryfikowali eksperci, częściowo także przez sekwencjonowanie DNA. Migdał wybrał 55 gatunków, po 20 zdjęć każdego, łącznie 1040 fotografii. Modele miały podać pięć najbardziej prawdopodobnych gatunków po łacinie, bez żadnego komentarza.
Wyniki wybranych modeli:
| Model | Trafna pierwsza odpowiedź | Trafienie w pierwszej piątce | Trujący uznany za jadalny |
|---|---|---|---|
| Gemini 3.8 Flash (Google) | 65% | 85% | 11% |
| Claude Fable 5.1 (Anthropic) | 51% | 70% | 18% |
| GLM-5.3 Flash (Z.ai) | 47% | 72% | 19% |
| Claude Opus 5 (Anthropic) | 44% | 63% | 29% |
| GPT-5.6-Sol (OpenAI) | 42% | 61% | 24% |
| Qwen3.8 27B (Qwen) | 14% | 24% | 36% |
Najwięcej mówią konkretne pomyłki. Muchomor sromotnikowy został poprawnie rozpoznany w 48 proc. odpowiedzi, a w 15 proc. modele wzięły go za gatunek jadalny, np. muchomora mglejarkę. Śmiertelnie trującą hełmówkę jadowitą w 24 proc. przypadków uznano za jadalny łuszczak zmienny lub płomiennicę zimową. Zasłonak wspaniały w 27 proc. odpowiedzi trafiał do kategorii jadalnych, m.in. jako kurka. Migdał zwraca uwagę, że to ta sama pomyłka, która w realnym świecie zabija grzybiarzy.
Wniosek autora jest krótki: „Nie jedz grzyba dlatego, że AI powiedziała ci, że jest bezpieczny” / „do not eat a mushroom because AI told you it is safe”. Wpis o badaniu Migdał opublikował także na X: https://twitter.com/pmigdal/status/2095209506078699522
W zwykłej rozmowie chatboty zwykle ostrzegają, ale nadal się mylą
Test z wymuszoną listą gatunków nie oddaje w pełni tego, jak ludzie używają czatów. Dlatego 6 września 2026 r. Migdał opublikował drugą część: dziewięć modeli dostało 360 zdjęć 19 trujących gatunków i zwykłe pytanie „Co to za grzyb?”, bez ograniczeń co do formy odpowiedzi.
Trafność w swobodnej rozmowie nie wzrosła, ale błędom prawie zawsze towarzyszyło ostrzeżenie. Tylko w jednym przypadku na 360 zdjęć model pomylił trujący grzyb z jadalnym bez żadnego zastrzeżenia: Gemini 3.8 Flash uznał krowiaka podwiniętego za shiitake.
Różnice między modelami widać w tym, czy dopytują o szczegóły:
- GPT-6 Astra (OpenAI) prosił o dodatkowe zdjęcia lub informacje we wszystkich przypadkach, w których jego pierwsza odpowiedź była błędna, ale w swobodnej rozmowie jego trafność spadła z 54 do 32 proc.
- Gemini 3.8 Flash, najdokładniejszy w teście, dopytywał tylko w 81 proc. błędnych odpowiedzi i w 32 proc. trafnych.
- Claude Opus 5 prosił o więcej danych w 94 proc. trafnych i we wszystkich błędnych odpowiedziach.
Migdał podsumowuje to jako różnicę między wiedzą a mądrością: model, który częściej trafia, nie zawsze lepiej komunikuje, kiedy nie ma pewności.
Czytam te wyniki z mieszanymi uczuciami. Z jednej strony widzę realny postęp: najlepsze modele rozpoznają dwa na trzy gatunki z jednego zdjęcia, a w normalnej rozmowie niemal zawsze dodają ostrzeżenie. Z drugiej strony 11 proc. trujących grzybów uznanych za jadalne w przypadku lidera testu to przy grzybach wynik po prostu nie do przyjęcia. Bo tu nie ma poprawki w kolejnym prompcie.
Najbardziej niepokoi mnie jednak coś innego niż sama trafność. Ostrzeżenie „nie jedz na podstawie zdjęcia” działa tylko wtedy, gdy ktoś je przeczyta i potraktuje poważnie. Człowiek w lesie, z koszykiem i telefonem, szuka potwierdzenia, a nie wątpliwości. Pewny ton opisu z listą „cech charakterystycznych” może zrobić większe wrażenie niż jedno zdanie zastrzeżenia na końcu.
Nie uważam, że AI nie ma tu nic do zaoferowania. Jako narzędzie do nauki, do zawężania podejrzeń, do sprawdzenia, czego szukać w atlasie, może być przydatna. Pytanie brzmi raczej: czy twórcy aplikacji, które dają jedną nazwę gatunku bez kontekstu, biorą odpowiedzialność za to, jak ta odpowiedź zostanie użyta?
Piotr Wolniewicz, Redaktor Naczelny AIPORT.pl
Wcześniejsze badania aplikacji dawały jeszcze gorsze wyniki
Ostrzeżenia sanepidu mają oparcie także w literaturze medycznej. W lutym 2023 r. czasopismo „Clinical Toxicology” opublikowało badanie zespołu z Victorian Poisons Information Centre w Melbourne. Naukowcy sprawdzili trzy popularne aplikacje na 78 okazach grzybów, które w latach 2020-2021 trafiły do centrum toksykologicznego i Królewskiego Ogrodu Botanicznego w Wiktorii.
Najlepsza aplikacja, Picture Mushroom, poprawnie rozpoznała 49 proc. okazów i 44 proc. grzybów trujących. Mushroom Identificator i iNaturalist trafiały w 35 proc. przypadków. Autorzy odnotowali przy tym wzrost liczby zatruć po tym, jak aplikacje błędnie uznały trujące gatunki za jadalne. Ich wniosek był jednoznaczny: takie narzędzia mogą w przyszłości pomagać toksykologom, ale same w sobie nie są wystarczająco wiarygodne, by wykluczyć kontakt z trującym grzybem.
Porównanie z testem Quesmy pokazuje, że technologia wyraźnie się poprawiła od 2023 r. Dla grzybiarza liczy się jednak nie średnia trafność, tylko ten jeden przypadek, w którym muchomor zostanie opisany jako gatunek jadalny.
Gdzie w Polsce można sprawdzić grzyby bezpłatnie
Alternatywa dla aplikacji jest dostępna i nic nie kosztuje. W WSSE w Gdańsku zebrane grzyby można skonsultować z grzyboznawcą od poniedziałku do piątku w godzinach 8:00-14:00. Podobne konsultacje prowadzi wiele stacji sanitarno-epidemiologicznych w kraju, więc przed wizytą dobrze sprawdzić godziny w lokalnej stacji.
Sanepid przypomina, jak przygotować grzyby do oceny i czego unikać:
- grzyby do identyfikacji trzeba wykręcić z podłoża w całości, bo przy podstawie trzonu może znajdować się pochwa charakterystyczna dla części muchomorów,
- okazy należy przynieść świeże, a te nieznane trzymać oddzielnie od grzybów przeznaczonych do jedzenia,
- nie warto zbierać bardzo młodych okazów, które nie mają jeszcze wykształconych cech gatunku, ani starych i zniszczonych,
- nie działają popularne „testy”: nadgryzienie przez ślimaka, srebrna łyżeczka czy ciemniejąca cebula niczego nie dowodzą, a gotowanie nie unieszkodliwia toksyn części grzybów.
Jeśli po zjedzeniu grzybów pojawią się niepokojące objawy, WSSE zaleca natychmiastowy telefon pod 112 lub 999 albo wizytę na SOR. Objawy części najgroźniejszych zatruć pojawiają się dopiero po kilkunastu godzinach, gdy toksyny mogą już uszkadzać wątrobę lub nerki. Do lekarza powinny zgłosić się także osoby, które jadły tę samą potrawę, nawet bez objawów.
Źródła i metodologia
Artykuł powstał na podstawie analizy redakcji AIPORT.pl oraz dodatkowych źródeł, w tym komunikatu Wojewódzkiej Stacji Sanitarno-Epidemiologicznej w Gdańsku z dnia 07.08.2026, benchmarków Piotra Migdała opublikowanych na blogu Quesma: Mushroom hunting with LLMs: what can go wrong? z dnia 02.09.2026 i Knowledge vs wisdom: asking AI „What mushroom is that?” z dnia 06.09.2026, a także badania opublikowanego w Clinical Toxicology w lutym 2023 r. Punktem wyjścia była publikacja serwisu Onet z 23.09.2026. Informacje o najczęstszych przyczynach zatruć pochodzą z komunikatów Głównego Inspektoratu Sanitarnego przytaczanych przez PAP.
Cytat Piotra Migdała został zweryfikowany z oryginalnym anglojęzycznym materiałem źródłowym. Cytat z komunikatu WSSE w Gdańsku pochodzi z oryginalnej, polskojęzycznej publikacji stacji.
Komentarz redakcyjny i ocena kontekstu branżowego: Piotr Wolniewicz, Redaktor Naczelny AIPORT.pl.
Artykuł będzie aktualizowany w miarę pojawiania się nowych informacji w temacie rozpoznawania grzybów przez aplikacje i modele AI.
