Badanie na 3132 osobach: dostęp do AI zmniejszył gotowość do przyznania się do niewiedzy z 44 do 3 proc., mimo że AI często się myliło.

Źródło zdjęcia: The Decoder
Dostęp do sztucznej inteligencji sprawia, że ludzie prawie całkowicie przestają mówić „nie wiem” — wynika z nowego badania opisanego przez the-decoder.com. Zespół badawczy przeprowadził pięć eksperymentów z udziałem 3132 uczestników, sprawdzając, jak sama możliwość skonsultowania się z modelem językowym zmienia gotowość ludzi do przyznania się do niewiedzy.
Do testów wykorzystano model Step 3.5 Flash, celowo skonfrontowany z pytaniami, na które prawie zawsze odpowiadał źle – dotyczącymi drobnych szczegółów wizualnych z filmów, na przykład koloru stroju drużyny w „Gramy jak Beckham”. Według autorów badania takie detale rzadko pojawiają się w tekstach online, co czyni je podatnymi na halucynacje modeli. Dla porównania GPT-5.5, Claude 4.6 Sonnet i Gemini 3.5 Flash radziły sobie z większością pozostałych pytań, myląc się jedynie przy najtrudniejszych.
Ponieważ podpowiedzi AI w większości były błędne, obserwowanego efektu nie można wyjaśnić rozsądnym powierzeniem sprawy wiarygodnemu narzędziu. Badacze wciąż widzą tendencję ludzi do ulegania odpowiedziom AI, choć pozostaje otwarte pytanie, czy zjawisko trzyma się równie silnie poza kontekstem filmowych ciekawostek.
W pierwszych dwóch badaniach (1a i 1b) uczestnicy mogli sami decydować, czy zapytać AI o pomoc. Skala spadku wstrzymywania się od odpowiedzi – z 36 i 44 proc. do 6 i 3 proc. – pokazuje, jak silnie sama dostępność narzędzia zmienia zachowanie. W badaniu 2, prowadzonym bez zachęt finansowych, pewność siebie uczestników korzystających z AI wzrosła prawie trzykrotnie, mimo że jednocześnie odsetek poprawnych odpowiedzi spadł o ponad połowę – z 27,6 do 10,0 proc. Uczestnicy byli więc znacznie bardziej przekonani o swojej racji, choć mylili się częściej.
We wszystkich badaniach łącznie, bez zachęt finansowych, grupa z dostępem do AI odpowiadała poprawnie na 9,2 proc. pytań, a grupa bez AI – na 27,5 proc. Innymi słowy, osoby korzystające z AI udzielały więcej odpowiedzi, ale trafnych było wśród nich zaledwie około jednej trzeciej tego, co bez pomocy modelu.
W badaniach od 2 do 4 wprowadzono zachęty pieniężne: 10 centów za każdą poprawną odpowiedź, strata 10 centów za błędną i zero za wybór „nie wiem”. Badacze wcześniej zarejestrowali hipotezę, że zachęty zwiększą gotowość do wstrzymania się od odpowiedzi, a dostęp do AI będzie tę tendencję słabić. Żadne z trzech badań nie wykazało statystycznie istotnej interakcji między tymi dwoma czynnikami.
Zgodnie z wynikami badania dostęp do AI i zachęty finansowe działały w dużej mierze niezależnie od siebie. Zachęty sprawiały, że uczestnicy rzadziej pytali AI o radę – w badaniu 3 średnio 4,53 razy wobec 5,27 z sześciu możliwych zapytań – i częściej odpowiadali poprawnie, gdy AI było dostępne. Wstrzymywanie się od odpowiedzi nieco wzrosło przy zachętach, ale pozostało wyraźnie poniżej poziomu grupy kontrolnej bez dostępu do AI.
Jak przyznają autorzy, efekt zachęt był realny, ale skromny. Nie wiadomo, czy większe nagrody finansowe lub mechanizmy oparte na reputacji zniwelowałyby różnicę w większym stopniu.
W badaniu 4 odpowiedź AI wyświetlano uczestnikom automatycznie, bez konieczności pytania o nią – badacze wskazują, że odzwierciedla to coraz powszechniejszą rzeczywistość, w której wyszukiwarki pokazują podsumowania generowane przez AI, a asystenci pisania podsuwają niechciane sugestie. Efekt niemal się nie zmienił: bez zachęt finansowych wstrzymywanie się od odpowiedzi spadło z 35 proc. (bez AI) do 1 proc. (z automatycznie wyświetlaną odpowiedzią AI), a z zachętami – z około 39 do 7 proc.
Badacze umieszczają swoje wyniki w kontekście pojęcia „Epistemii” – tendencji do przyjmowania odpowiedzi AI, ponieważ brzmią przekonująco, a nie dlatego, że są faktycznie zweryfikowane. Model językowy zawsze musi wygenerować odpowiedź. Nigdy się nie zatrzymuje, nawet gdy czegoś nie wie. Kiedy użytkownicy oddają mu swój osąd, mogą przejmować tę cechę – brak wstrzemięźliwości, piszą autorzy.
Efekt jest też odwrotny do tego, co pokazują badania nad korzystaniem z porad („advice use”). Zwykle ludzie niedoszacowują wartości zewnętrznych porad i przesuwają swoją opinię tylko o około jedną trzecią w stronę stanowiska radzącego. Uczestnicy tego badania robili coś wręcz przeciwnego, twierdzą autorzy.
Badacze wnioskują nawet, że dostęp do AI zmienił niektóre odpowiedzi, które byłyby poprawne, w błędne. W warunkach bez zachęt finansowych grupa z AI odpowiadała na więcej pytań niż grupa kontrolna, ale uzyskała mniej poprawnych odpowiedzi.
W miarę jak odpowiedzi AI stają się wszędobylskie i coraz częściej pojawiają się bez proszenia o nie, gotowość do powiedzenia „nie wiem” może być jedną z pierwszych ofiar interakcji człowiek-AI, piszą autorzy badania. Czy ludzki osąd wytrzyma rozprzestrzenianie się systemów AI, może zależeć nie tyle od uczynienia modeli dokładniejszymi, ile od tego, czy ludzie nadal będą rozpoznawać i respektować granice własnej wiedzy.
Coraz więcej badań wskazuje, że korzystanie z AI wpływa na osąd i zdolności poznawcze ludzi. Badanie przeprowadzone przez Swiss Business School na 666 uczestnikach pokazało silną negatywną korelację między korzystaniem z AI a krytycznym myśleniem – im bardziej ludzie ufają AI, tym częściej delegują zadania poznawcze, co tworzy cykl dalej słabiący krytyczne myślenie.
Dowody eksperymentalne pokazują, że już dziesięć-piętnaście minut pracy z asystentem AI może mierzalnie osłabić zdolność rozwiązywania problemów i wytrwałość w kolejnych zadaniach wykonywanych już bez AI. Uczestnicy, którzy korzystali z AI tylko po wyjaśnienia albo je ignorowali, nie wykazywali takiego spadku.
Do podobnych wniosków doszło badanie Microsoftu, które wykazało, że korzystanie z AI stawia wysokie wymagania metakognitywne – wobec zdolności monitorowania i kierowania własnym myśleniem.
Wyniki opisanego badania sugerują, że sama obecność AI – niezależnie od jego rzeczywistej trafności – potrafi radykalnie zmienić sposób, w jaki ludzie oceniają własną wiedzę, skłaniając ich do rzadszego przyznawania się do niewiedzy, nawet gdy oznacza to więcej błędnych odpowiedzi.

David Robinson rzuca pracę w OpenAI, oceniając, że kultura firmy jest „zepsuta”, a branża AI nie jest wystarczająco ostrożna wobec zagrożeń.

Trump powołał Super Intelligence Force z Jayem Claytonem na czele, by koordynować politykę USA wobec sztucznej inteligencji i uniknąć nadmiernej regulacji.

Anthropic aktualizuje politykę użytkowania Claude, zakazując okrutnego traktowania modelu, propagandy, inwigilacji i rozwoju broni.