Zdarza się, że pytasz sztuczną inteligencję o źródła lub informacje na temat, który cię interesuje. Dostajesz odpowiedź od AI bez zawahania. Źródła posiadają tytuł, autora, rok czasem jak poprosisz również link, jednak problem polega na tym, że te źródła realnie nie istnieją a same informacje mogą być nieprawdziwe.

Takie sytuacje nazywa się halucynacjami AI. Modele AI, generują informację, które wyglądają bardzo wiarygodnie, jednak są wymyślone i nieprawdziwe. Dlaczego zatem zamiast wymyślania odpowiedzi AI nie powie że nie ma dostępu do źródeł albo że one nie istnieją.
Dlaczego modele AI zgadują?
OpenAI wskazuje, że halucynację wynikają w pewnym stopniu ze sposobu trenowania modeli. Uczą się one przewidywać słowa, ale nie zawsze umieją rozróżnić informację prawdziwą od wiarygodnej. Sposób oceniania informacji pogłębiają ten problem, zgadywanie odpowiedzi daję jakąś szansę na trafienie zamiast podania braku odpowiedzi.
SimpleQA jest to test, który sprawdza czy model AI podaje prawdziwe informacje i czy jest tego pewny. Ma pomóc on w ocenie poprawności odpowiedzi AI i rozpoznawaniu, kiedy nie zna on odpowiedzi. Test składa się z 4326 krótkich pytań, z różnych kategorii ale z jedną odpowiedzią. Wyniki testów pokazują tendencję, że coraz bardziej zaawansowane modele zwykle radzą sobie lepiej z halucynacjami.
Czy można pozbyć się halucynacji?
Halucynacji AI nie da się obecnie pozbyć całkowicie. Można jednak mocno ograniczać ich liczbę. OpenAI ukazuje, że między innymi uczenie modeli by częściej wskazywały niepewność zamiast zgadywać odpowiedź, jest jednym z rozwiązań.
Innym rozwiązaniem jest grounding, czyli oparcie odpowiedzi na konkretnych swoich źródłach takich jak dokumenty, bazy danych, książki itp. Model w takim wypadku nie musi polegać na wyszukiwaniach i generowania odpowiedzi ale dostaje gotowe źródła, z których odpowiedzi ma brać.
Grounding jednak nie oznacza, że odpowiedź będzie bezbłędna. Nadal AI może źle zinterpretować źródła, pominąć ważne fragmenty danego materiału lub połączyć podane informacje w niewłaściwy sposób.
Jak sprawdzać odpowiedzi wygenerowane przez AI?
Trzeba pamiętać, że nie powinny być od razu traktowane jak potwierdzone i prawdziwe informację. Gdy AI poda źródła, warto zawsze wejść w link i zobaczyć czy faktycznie działa, prowadzi do prawdziwej strony. Dobrym rozwiązaniem jest też porównywanie odpowiedzi AI z wynikami z przeglądarki internetowej czy wrzucania takiego samego prompta do innego modelu sztucznej inteligencji. Warto też zaznaczyć, że gdy chcemy pomocy AI w bardzo ważnych sprawach powinniśmy zachować szczególną ostrożność i nie traktować odpowiedzi jako ostateczną decyzję a raczej jako wskazówkę w ostateczności.
Słowniczek
Halucynacje AI - z pozoru wiarygodnie wyglądające, ale fałszywe stwierdzenia przez modele językowe.
Grounding - sposób ograniczania halucynacji, dzięki oparciu odpowiedzi na dostarczonych przez użytkownika źródeł.
Model AI - złożony system, który korzysta z algorytmów uczenia maszynowego do analizowania dużych ilości danych.
Źródła
Dlaczego modele językowe halucynują? | OpenAI
Nie Wierz We Wszystko, Co Powie AI - Jak Weryfikować Odpowiedzi Sztucznej Inteligencji
