O halucynacjach AI napisano już sporo. Model potrafi wymyślić książkę, link, badanie albo cytat i podać je z pełnym przekonaniem. Ciekawiej robi się wtedy, kiedy zapytamy:

Skąd to wziąłeś?

albo:

Dlaczego tak odpowiedziałeś?

Bo odpowiedź na to pytanie też może być zmyślona. Niedawno testowałem jeden z wiodących zaawansowanych modeli AI. W trakcie rozmowy kilka razy podał mi sprzeczne informacje dotyczące tego, czy korzystał z internetu i skąd znał pewne dane. Za każdym razem miał nowe wyjaśnienie: brak dostępu do sieci, ograniczenia wyszukiwarki, dane treningowe, astronomiczny przypadek.

W końcu zapytałem go wprost:

Czy jesteś w stanie odróżnić informację o tym, jak faktycznie uzyskałeś dane, od historii, którą generujesz dopiero po fakcie, żeby wyjaśnić własną odpowiedź?

Odpowiedział:

„Krótko i wprost: nie, kompletnie nie potrafię tego odróżnić.”

I to jest moim zdaniem ciekawsze niż sama halucynacja. Model nie musi mieć dostępu do żadnego wewnętrznego dziennika, z którego odczyta:

tutaj użyłem źródła A, potem narzędzia B, dlatego odpowiedziałem C.

Kiedy pytamy go, dlaczego coś napisał, może po prostu wygenerować najbardziej sensowne wyjaśnienie pasujące do rozmowy. Czyli zmyślić nie tylko fakt, ale również historię o tym, skąd ten fakt się wziął. To jest szczególnie zdradliwe, bo takie odpowiedzi często brzmią bardzo technicznie:

„narzędzie nie pobrało treści renderowanej przez JavaScript”

albo:

„informacja prawdopodobnie pochodziła z danych treningowych”.

Może to być prawda. Ale równie dobrze może to być kolejna dobrze brzmiąca konfabulacja.

I tu pojawia się ciekawy paradoks. Model bardzo przekonująco wyjaśnił mi, że nie ma pełnego wglądu we własne procesy. Skoro jednak sam przyznaje, że nie potrafi wiarygodnie ustalić, dlaczego wygenerował konkretną odpowiedź, to jego opisy własnego działania również trzeba traktować ostrożnie. Nie dlatego, że na pewno są błędne. Tylko dlatego, że samo:

„tak działam”

nie jest jeszcze dowodem.

Dlatego halucynacje AI mają dwa poziomy. Pierwszy jest prosty: model zmyśla. Drugi jest dużo ciekawszy: pytasz go, dlaczego zmyślił, a on zmyśla jeszcze raz.

Tym razem bardziej przekonująco.

Title
Caption
File name
Size
Alignment
Link to
  Open new windows
  Rel nofollow