Přeskočit na obsah
ejaj.cz

Návod

Proč si AI vymýšlí fakta — a jak si to ověřit

Aktualizováno · ~8 min čtení · Redakce ejaj.cz

Zeptáte se AI na něco a dostanete odpověď, která zní naprosto sebejistě — a přesto je špatně. Nejde o výjimku ani o špatně zvolený nástroj. Je to vlastnost způsobu, jakým tyhle nástroje texty vytvářejí, a vyplatí se vědět, kdy si na ni dát pozor a jak si odpověď rychle ověřit.

Tenhle text nemá AI nástroje zatracovat, spíš naopak. Čím dřív pochopíte, kde občas selhávají, tím líp je využijete tam, kde jsou opravdu dobré, a vyhnete se nepříjemnému překvapení z jednoho vymyšleného čísla.

Proč si AI něco vymyslí

Když se na něco zeptáte AI chatbota, model se nikam „ven“ nedívá hledat odpověď. Nemá databázi faktů, kterou by si otevřel a zkontroloval, a bez výslovného pokynu neprochází ani internet. Dělá v podstatě jedinou věc: podle obrovského množství textů, které kdysi zpracoval, odhaduje, jaké slovo by mělo s nejvyšší pravděpodobností následovat po tom předchozím.

Tohle překvapivě dobře funguje, protože nejpravděpodobnější pokračování věty se ve většině případů shoduje se skutečností — model se přece „naučil“ i na spoustě správných informací. Jenže když si na konkrétní otázku přesnou odpověď nepamatuje, nezastaví se a neřekne, že neví. Pokračuje stejným způsobem dál a zvolí nejpravděpodobnější slova, i kdyby výsledkem měl být smyšlený údaj.

Tomuhle jevu se říká halucinace. Je to trochu zavádějící slovo — model si nic nepředstavuje ani se ve skutečném slova smyslu neplete, jen bez zastavení dokončí větu způsobem, který zní jako fakt, i když fakt není. Platí to stejně u ChatGPT jako u ostatních konverzačních nástrojů — mechanismus je stejný bez ohledu na značku.

Proč to nepoznáte na první pohled

Jádro problému není v tom, že by se AI někdy spletla — to dělá každý zdroj informací, včetně lidí. Potíž je v tom, že vymyšlená odpověď je napsaná úplně stejně sebevědomě jako správná. Model nemá vnitřní pocit nejistoty, který by se dal přenést do tónu odpovědi — buď odpověď zformuluje, nebo ne, a když ji zformuluje, zní stejně hladce bez ohledu na to, jestli je pravdivá.

U člověka se nejistota obvykle nějak projeví: zaváhá, přizná, že si není jistý, odkáže vás na někoho jiného. U vymyšlené odpovědi AI podobný signál většinou chybí. Věta s neexistujícím zákonem, cenou nebo studií vypadá stylisticky úplně stejně jako věta se skutečným faktem, a přesně proto se dá jedno od druhého těžko rozeznat pouhým čtením.

Kde to bolí nejvíc

Riziko není u každého dotazu stejné. Když AI pomáhá formulovat e-mail nebo shrnout text, který jste jí sami dodali, nemá moc prostor si něco vymýšlet — pracuje s tím, co vidí před sebou. Nebezpečné jsou naopak chvíle, kdy se ptáte na fakt mimo zadaný text a spoléháte, že si ho model „pamatuje“ správně. Konkrétně jde nejčastěji o tohle:

Kde vymyšlená odpověď škodí nejvíc
OblastCo se může stát
Čísla a cenyModel uvede částku, procento nebo limit, který zní přesně, ale je vymyšlený nebo dávno neplatný.
Citace a studieVytvoří název studie, knihy nebo autora, který nikdy neexistoval, a zní to jako skutečná odborná práce.
Právní ustanoveníOdkáže na paragraf nebo zákon, který neříká to, co model tvrdí, nebo neexistuje vůbec.
Jména a fakta o lidechPřiřadí výrok, funkci nebo čin nesprávné osobě.
OdkazyVygeneruje adresu, která vypadá důvěryhodně, ale nikam nevede nebo vede úplně jinam.
Historická dataUvede datum události, které je věrohodné, ale neodpovídá skutečnosti.
Kde vymyšlená odpověď škodí nejvíc

Společný jmenovatel je jednoduchý: čím konkrétnější a ověřitelnější údaj potřebujete, tím větší je riziko, že se s ním AI netrefí. Platí to i pro podklady k práci — třeba v kategorii výzkum a věda, kde je v katalogu 142 nástrojů, nebo u textů kolem smluv, kde přichází na řadu právní asistent a jemu podobných 20 nástrojů. AI tam bývá dobrý první krok k rychlejší práci, ne poslední krok před odesláním.

Jak si odpověď ověřit

Ověření nemusí trvat dlouho a nevyžaduje žádné technické znalosti. Stačí zvyknout si na pár kroků, které fungují bez ohledu na to, jaký konkrétní nástroj zrovna používáte.

  1. Nechte si od AI uvést konkrétní zdroj a ten zdroj si sami otevřete. Odkaz, který model uvede, ale nikdo neotevře, nic neověřuje — a stává se, že vede jinam nebo vůbec nikam.
  2. Stejnou otázku položte znovu, nejlépe v novém okně nebo o pár minut později, a odpovědi porovnejte. Když se detaily jako čísla, jména nebo data mezi odpověďmi liší, aspoň jedna z verzí je špatně.
  3. Zeptejte se na něco, co už sami jistě víte, jako na rychlý test důvěryhodnosti. Pokud si model plete i fakt, který dobře znáte, buďte opatrnější i u zbytku odpovědi.
  4. U čísel, cen a jiných statistik jděte vždy k primárnímu zdroji — oficiálnímu ceníku, textu zákona, samotné studii — ne k tomu, co o nich řekla AI. Přepis z druhé ruky je přesně místo, kde vzniká chyba.
  5. Pro rozhodnutí s reálnými důsledky, jako je smlouva, investice nebo zdraví, berte odpověď AI jako první návrh k prověření, ne jako hotovou radu.
Prompt, který snižuje riziko

Než odpovíte, rozmyslete si, jak jistá jsou fakta, čísla a zdroje, které chcete uvést. Pokud si nejste jistí, napište to otevřeně místo dohadu. Neuvádějte žádný zdroj, odkaz ani citaci, kterou byste sami nedokázali dohledat — v takovém případě radši napište, že zdroj nemáte. U čísel a dat vždy uveďte, k jakému datu platí, a upozorněte, pokud jde o odhad.

AI novinky do e-mailu

Každý pátek 3 vybrané AI nástroje, prompt týdne a to nejdůležitější ze světa AI — přehledně, česky a bez balastu.

Jeden z nejstarších pravidelných českých AI newsletterů.

Jednou týdně, v pátek. Žádný spam — odhlásíte se jedním klikem.

Tohle není chyba, kterou někdo zapomněl opravit

Je lákavé myslet si, že jde o dětskou nemoc, která zmizí s příští aktualizací. Nezmizí. Vychází to přímo z principu, jakým tyhle modely text vytvářejí — z odhadování pravděpodobného pokračování, ne z nedodělané funkce, kterou by šlo jednoduše doladit.

Nové generace modelů dělají tuhle chybu o něco méně než ty první, které se dostaly k širokému publiku. Ani nejnovější verze to ale úplně neodstranily a nic nenasvědčuje tomu, že by šlo tenhle jev odstranit beze zbytku. Rozumné je počítat s tím, že ověřování bude potřeba i u příští generace nástrojů.

Ověřování proto nemá být výjimka, kterou si vyhradíte jen pro „horší“ nebo neznámé nástroje — má to být návyk, který používáte pořád, u čísel a faktů, na kterých vám skutečně záleží, bez ohledu na to, jak sebejistě odpověď zní. Pokud teprve začínáte s AI nástroji a chybí vám základ, doporučujeme návod pro úplné začátečníky k ChatGPT — tenhle text na něj volně navazuje.

Časté otázky

Vymýšlí si AI fakta schválně?

Ne. Model nemá záměr ani vědomí toho, že tvrdí něco nepravdivého — jen dokončuje text podle toho, co je statisticky nejpravděpodobnější pokračování věty. Lež předpokládá vědomí pravdy, kterou by mluvčí vědomě zatajil, a to model nemá.

Proč AI lže, i když se ptám na jednoduchou věc?

Nejde o lež v pravém slova smyslu, protože model nemá žádnou vnitřní pravdu, kterou by vědomě skrýval. I na jednoduchou otázku odpovídá stejným způsobem jako na složitou — odhaduje nejpravděpodobnější pokračování věty, a když si přesný fakt „nepamatuje“, odhad může být vedle.

Je ChatGPT spolehlivý?

Pro formulaci textu, shrnutí nebo nápady ano, protože tam pracuje hlavně s tím, co mu sami dodáte. U konkrétních čísel, citací a jmen mimo zadaný text počítejte s tím, že se může splést, a ověřte si je — stejné pravidlo platí i pro ostatní podobné nástroje, nejen pro ChatGPT.

Jak poznám, že si AI něco vymyslela?

Podle tónu odpovědi to nepoznáte — vymyšlená věta zní stejně sebejistě jako pravdivá. Jediný spolehlivý způsob je ověřit si odpověď u zdroje, který s ní nemá nic společného: oficiálního ceníku, textu zákona nebo jiné důvěryhodné stránky.

Halucinuje AI častěji u nových témat, nebo u starších?

Obecně platí, že čím míň má model k tématu spolehlivých podkladů — ať jde o čerstvou událost, úzkou specializaci nebo málo zdokumentovaný detail — tím nejistější je odhad. Míra se navíc liší nástroj od nástroje a v čase se mění, takže jedno univerzální číslo by bylo zavádějící.

Pomůže, když AI požádám o zdroj?

Pomůže to jen tehdy, když si ten zdroj skutečně otevřete. Model umí vygenerovat odkaz nebo název studie, která vypadá věrohodně, a přitom neexistuje — o zdroj je tedy potřeba požádat a zároveň si ho sami zkontrolovat, ne mu automaticky věřit.

Mám přestat AI používat pro práci s fakty?

Ne, stačí posunout roli, kterou jí dáváte — z posledního slova na první návrh. AI vám ušetří čas s formulací i rešerší, ale klíčové číslo, citaci nebo jméno si před použitím ověřte u primárního zdroje.

Odstraní tenhle problém příští verze AI?

Novější modely dělají tuhle chybu o něco méně často než ty první veřejně dostupné, ale plyne to z podstaty toho, jak texty vytvářejí, ne z nedodělané funkce, kterou by šlo snadno doladit. Rozumné je počítat s tím, že ověřování bude potřeba i u budoucích verzí.

Kam dál