Dlaczego AI zmyśla, nawet kiedy brzmi bardzo pewnie?

Dlaczego AI zmyśla, nawet kiedy brzmi bardzo pewnie?
Udostępnij

Zdarza się, że pytasz sztuczną inteligencję o źródła lub informacje na temat, który cię interesuje. Dostajesz odpowiedź od AI bez zawahania. Źródła posiadają tytuł, autora, rok czasem jak poprosisz również link, jednak problem polega na tym, że te źródła realnie nie istnieją a same informacje mogą być nieprawdziwe.

15 milionów euro kary za kreację z AI. Co zmienia artykuł 50 AI Act
2 sierpnia 2026 roku, bez wielkiego hałasu w polskich mediach branżowych, weszły w życie przepisy, które bezpośrednio dotyczą każdej kampanii wykorzystującej AI do tworzenia obrazu, wideo, głosu czy tekstu i docierającej do odbiorców w Unii Europejskiej. Artykuł 50 unijnego AI Act nakłada obowiązki transparentności, których złamanie kosztuje nawet 15 milionów

Takie sytuacje nazywa się halucynacjami AI. Modele AI, generują informację, które wyglądają bardzo wiarygodnie, jednak są wymyślone i nieprawdziwe. Dlaczego zatem zamiast wymyślania odpowiedzi AI nie powie że nie ma dostępu do źródeł albo że one nie istnieją.

Dlaczego modele AI zgadują?
OpenAI wskazuje, że halucynację wynikają w pewnym stopniu ze sposobu trenowania modeli. Uczą się one przewidywać słowa, ale nie zawsze umieją rozróżnić informację prawdziwą od wiarygodnej. Sposób oceniania informacji pogłębiają ten problem, zgadywanie odpowiedzi daję jakąś szansę na trafienie zamiast podania braku odpowiedzi.

SimpleQA jest to test, który sprawdza czy model AI podaje prawdziwe informacje i czy jest tego pewny. Ma pomóc on w ocenie poprawności odpowiedzi AI i rozpoznawaniu, kiedy nie zna on odpowiedzi. Test składa się z 4326 krótkich pytań, z różnych kategorii ale z jedną odpowiedzią. Wyniki testów pokazują tendencję, że coraz bardziej zaawansowane modele zwykle radzą sobie lepiej z halucynacjami. 

Czy można pozbyć się halucynacji?

Halucynacji AI nie da się obecnie pozbyć całkowicie. Można jednak mocno ograniczać ich liczbę. OpenAI ukazuje, że między innymi uczenie modeli by częściej wskazywały niepewność zamiast zgadywać odpowiedź, jest jednym z rozwiązań. 

Innym rozwiązaniem jest grounding, czyli oparcie odpowiedzi na konkretnych swoich źródłach takich jak dokumenty, bazy danych, książki itp. Model w takim wypadku nie musi polegać na wyszukiwaniach i generowania odpowiedzi ale dostaje gotowe źródła, z których odpowiedzi ma brać. 

Grounding jednak nie oznacza, że odpowiedź będzie bezbłędna. Nadal AI może źle zinterpretować źródła, pominąć ważne fragmenty danego materiału lub połączyć podane informacje w niewłaściwy sposób.

Jak sprawdzać odpowiedzi wygenerowane przez AI?

Trzeba pamiętać, że nie powinny być od razu traktowane jak potwierdzone i prawdziwe informację. Gdy AI poda źródła, warto zawsze wejść w link i zobaczyć czy faktycznie działa, prowadzi do prawdziwej strony. Dobrym rozwiązaniem jest też porównywanie odpowiedzi AI z wynikami z przeglądarki internetowej czy wrzucania takiego samego prompta do innego modelu sztucznej inteligencji. Warto też zaznaczyć, że gdy chcemy pomocy AI w bardzo ważnych sprawach  powinniśmy zachować szczególną ostrożność i nie traktować odpowiedzi jako ostateczną decyzję a raczej jako wskazówkę w ostateczności.

Słowniczek

Halucynacje AI - z pozoru wiarygodnie wyglądające, ale fałszywe stwierdzenia przez modele językowe.

Grounding - sposób ograniczania halucynacji, dzięki oparciu odpowiedzi na dostarczonych przez użytkownika źródeł. 

Model AI - złożony system, który korzysta z algorytmów uczenia maszynowego do analizowania dużych ilości danych.

Źródła

Dlaczego modele językowe halucynują? | OpenAI

Introducing SimpleQA | OpenAI

FACTS Grounding: A new benchmark for evaluating the factuality of large language models — Google DeepMind

Nie Wierz We Wszystko, Co Powie AI - Jak Weryfikować Odpowiedzi Sztucznej Inteligencji



Budujemy przestrzeń, w której media spotykają się z technologią. Śledź najnowsze trendy, analizy i aktualności z branży.

Branża się zmienia co tydzień.

Nasz newsletter zbiera to, co naprawdę warto wiedzieć i trafia do Ciebie zanim temat stanie się mainstreamem.

Subskrybuj