Zeptáte se AI na něco a dostanete odpověď, která zní naprosto sebejistě — a přesto je špatně. Nejde o výjimku ani o špatně zvolený nástroj. Je to vlastnost způsobu, jakým tyhle nástroje texty vytvářejí, a vyplatí se vědět, kdy si na ni dát pozor a jak si odpověď rychle ověřit.
Tenhle text nemá AI nástroje zatracovat, spíš naopak. Čím dřív pochopíte, kde občas selhávají, tím líp je využijete tam, kde jsou opravdu dobré, a vyhnete se nepříjemnému překvapení z jednoho vymyšleného čísla.
Proč si AI něco vymyslí
Když se na něco zeptáte AI chatbota, model se nikam „ven“ nedívá hledat odpověď. Nemá databázi faktů, kterou by si otevřel a zkontroloval, a bez výslovného pokynu neprochází ani internet. Dělá v podstatě jedinou věc: podle obrovského množství textů, které kdysi zpracoval, odhaduje, jaké slovo by mělo s nejvyšší pravděpodobností následovat po tom předchozím.
Tohle překvapivě dobře funguje, protože nejpravděpodobnější pokračování věty se ve většině případů shoduje se skutečností — model se přece „naučil“ i na spoustě správných informací. Jenže když si na konkrétní otázku přesnou odpověď nepamatuje, nezastaví se a neřekne, že neví. Pokračuje stejným způsobem dál a zvolí nejpravděpodobnější slova, i kdyby výsledkem měl být smyšlený údaj.
Tomuhle jevu se říká halucinace. Je to trochu zavádějící slovo — model si nic nepředstavuje ani se ve skutečném slova smyslu neplete, jen bez zastavení dokončí větu způsobem, který zní jako fakt, i když fakt není. Platí to stejně u ChatGPT jako u ostatních konverzačních nástrojů — mechanismus je stejný bez ohledu na značku.
Proč to nepoznáte na první pohled
Jádro problému není v tom, že by se AI někdy spletla — to dělá každý zdroj informací, včetně lidí. Potíž je v tom, že vymyšlená odpověď je napsaná úplně stejně sebevědomě jako správná. Model nemá vnitřní pocit nejistoty, který by se dal přenést do tónu odpovědi — buď odpověď zformuluje, nebo ne, a když ji zformuluje, zní stejně hladce bez ohledu na to, jestli je pravdivá.
U člověka se nejistota obvykle nějak projeví: zaváhá, přizná, že si není jistý, odkáže vás na někoho jiného. U vymyšlené odpovědi AI podobný signál většinou chybí. Věta s neexistujícím zákonem, cenou nebo studií vypadá stylisticky úplně stejně jako věta se skutečným faktem, a přesně proto se dá jedno od druhého těžko rozeznat pouhým čtením.
Kde to bolí nejvíc
Riziko není u každého dotazu stejné. Když AI pomáhá formulovat e-mail nebo shrnout text, který jste jí sami dodali, nemá moc prostor si něco vymýšlet — pracuje s tím, co vidí před sebou. Nebezpečné jsou naopak chvíle, kdy se ptáte na fakt mimo zadaný text a spoléháte, že si ho model „pamatuje“ správně. Konkrétně jde nejčastěji o tohle:
| Oblast | Co se může stát |
|---|---|
| Čísla a ceny | Model uvede částku, procento nebo limit, který zní přesně, ale je vymyšlený nebo dávno neplatný. |
| Citace a studie | Vytvoří název studie, knihy nebo autora, který nikdy neexistoval, a zní to jako skutečná odborná práce. |
| Právní ustanovení | Odkáže na paragraf nebo zákon, který neříká to, co model tvrdí, nebo neexistuje vůbec. |
| Jména a fakta o lidech | Přiřadí výrok, funkci nebo čin nesprávné osobě. |
| Odkazy | Vygeneruje adresu, která vypadá důvěryhodně, ale nikam nevede nebo vede úplně jinam. |
| Historická data | Uvede datum události, které je věrohodné, ale neodpovídá skutečnosti. |
Společný jmenovatel je jednoduchý: čím konkrétnější a ověřitelnější údaj potřebujete, tím větší je riziko, že se s ním AI netrefí. Platí to i pro podklady k práci — třeba v kategorii výzkum a věda, kde je v katalogu 142 nástrojů, nebo u textů kolem smluv, kde přichází na řadu právní asistent a jemu podobných 20 nástrojů. AI tam bývá dobrý první krok k rychlejší práci, ne poslední krok před odesláním.
Jak si odpověď ověřit
Ověření nemusí trvat dlouho a nevyžaduje žádné technické znalosti. Stačí zvyknout si na pár kroků, které fungují bez ohledu na to, jaký konkrétní nástroj zrovna používáte.
- Nechte si od AI uvést konkrétní zdroj a ten zdroj si sami otevřete. Odkaz, který model uvede, ale nikdo neotevře, nic neověřuje — a stává se, že vede jinam nebo vůbec nikam.
- Stejnou otázku položte znovu, nejlépe v novém okně nebo o pár minut později, a odpovědi porovnejte. Když se detaily jako čísla, jména nebo data mezi odpověďmi liší, aspoň jedna z verzí je špatně.
- Zeptejte se na něco, co už sami jistě víte, jako na rychlý test důvěryhodnosti. Pokud si model plete i fakt, který dobře znáte, buďte opatrnější i u zbytku odpovědi.
- U čísel, cen a jiných statistik jděte vždy k primárnímu zdroji — oficiálnímu ceníku, textu zákona, samotné studii — ne k tomu, co o nich řekla AI. Přepis z druhé ruky je přesně místo, kde vzniká chyba.
- Pro rozhodnutí s reálnými důsledky, jako je smlouva, investice nebo zdraví, berte odpověď AI jako první návrh k prověření, ne jako hotovou radu.
Než odpovíte, rozmyslete si, jak jistá jsou fakta, čísla a zdroje, které chcete uvést. Pokud si nejste jistí, napište to otevřeně místo dohadu. Neuvádějte žádný zdroj, odkaz ani citaci, kterou byste sami nedokázali dohledat — v takovém případě radši napište, že zdroj nemáte. U čísel a dat vždy uveďte, k jakému datu platí, a upozorněte, pokud jde o odhad.
AI novinky do e-mailu
Každý pátek 3 vybrané AI nástroje, prompt týdne a to nejdůležitější ze světa AI — přehledně, česky a bez balastu.
Jeden z nejstarších pravidelných českých AI newsletterů.
Tohle není chyba, kterou někdo zapomněl opravit
Je lákavé myslet si, že jde o dětskou nemoc, která zmizí s příští aktualizací. Nezmizí. Vychází to přímo z principu, jakým tyhle modely text vytvářejí — z odhadování pravděpodobného pokračování, ne z nedodělané funkce, kterou by šlo jednoduše doladit.
Nové generace modelů dělají tuhle chybu o něco méně než ty první, které se dostaly k širokému publiku. Ani nejnovější verze to ale úplně neodstranily a nic nenasvědčuje tomu, že by šlo tenhle jev odstranit beze zbytku. Rozumné je počítat s tím, že ověřování bude potřeba i u příští generace nástrojů.
Ověřování proto nemá být výjimka, kterou si vyhradíte jen pro „horší“ nebo neznámé nástroje — má to být návyk, který používáte pořád, u čísel a faktů, na kterých vám skutečně záleží, bez ohledu na to, jak sebejistě odpověď zní. Pokud teprve začínáte s AI nástroji a chybí vám základ, doporučujeme návod pro úplné začátečníky k ChatGPT — tenhle text na něj volně navazuje.
Časté otázky
Vymýšlí si AI fakta schválně?
Ne. Model nemá záměr ani vědomí toho, že tvrdí něco nepravdivého — jen dokončuje text podle toho, co je statisticky nejpravděpodobnější pokračování věty. Lež předpokládá vědomí pravdy, kterou by mluvčí vědomě zatajil, a to model nemá.
Proč AI lže, i když se ptám na jednoduchou věc?
Nejde o lež v pravém slova smyslu, protože model nemá žádnou vnitřní pravdu, kterou by vědomě skrýval. I na jednoduchou otázku odpovídá stejným způsobem jako na složitou — odhaduje nejpravděpodobnější pokračování věty, a když si přesný fakt „nepamatuje“, odhad může být vedle.
Je ChatGPT spolehlivý?
Pro formulaci textu, shrnutí nebo nápady ano, protože tam pracuje hlavně s tím, co mu sami dodáte. U konkrétních čísel, citací a jmen mimo zadaný text počítejte s tím, že se může splést, a ověřte si je — stejné pravidlo platí i pro ostatní podobné nástroje, nejen pro ChatGPT.
Jak poznám, že si AI něco vymyslela?
Podle tónu odpovědi to nepoznáte — vymyšlená věta zní stejně sebejistě jako pravdivá. Jediný spolehlivý způsob je ověřit si odpověď u zdroje, který s ní nemá nic společného: oficiálního ceníku, textu zákona nebo jiné důvěryhodné stránky.
Halucinuje AI častěji u nových témat, nebo u starších?
Obecně platí, že čím míň má model k tématu spolehlivých podkladů — ať jde o čerstvou událost, úzkou specializaci nebo málo zdokumentovaný detail — tím nejistější je odhad. Míra se navíc liší nástroj od nástroje a v čase se mění, takže jedno univerzální číslo by bylo zavádějící.
Pomůže, když AI požádám o zdroj?
Pomůže to jen tehdy, když si ten zdroj skutečně otevřete. Model umí vygenerovat odkaz nebo název studie, která vypadá věrohodně, a přitom neexistuje — o zdroj je tedy potřeba požádat a zároveň si ho sami zkontrolovat, ne mu automaticky věřit.
Mám přestat AI používat pro práci s fakty?
Ne, stačí posunout roli, kterou jí dáváte — z posledního slova na první návrh. AI vám ušetří čas s formulací i rešerší, ale klíčové číslo, citaci nebo jméno si před použitím ověřte u primárního zdroje.
Odstraní tenhle problém příští verze AI?
Novější modely dělají tuhle chybu o něco méně často než ty první veřejně dostupné, ale plyne to z podstaty toho, jak texty vytvářejí, ne z nedodělané funkce, kterou by šlo snadno doladit. Rozumné je počítat s tím, že ověřování bude potřeba i u budoucích verzí.
