Přeskočit na obsah
ejaj.cz

Návod

Jak poznat text od AI — a proč se detektorům nedá slepě věřit

Aktualizováno · ~8 min čtení · Redakce ejaj.cz

Zeptejte se učitelů, personalistů nebo editorů, jestli si někdy nebyli jistí, kdo text napsal – člověk, nebo AI. Skoro každý přikývne.

Nejjednodušší řešení pak zní lákavě: vložit text do detektoru a nechat si vypsat procento. Realita je bohužel míň uklidňující, než by si člověk přál.

Tenhle článek vám takové jisté procento nedá, protože ho podle všeho nemá nikdo. Místo toho poctivě vysvětlíme, co detektory AI textu doopravdy dělají a proč jejich výsledek – ať jde o text z ChatGPT, nebo jiného nástroje – nikdy není důkaz. Řekneme si i to, co dělat, když na tom, jestli text napsal člověk, nebo AI, něco reálně závisí.

Co detektory vlastně měří

Detektor AI textu nečte obsah a nehledá v něm přiznání. Odhaduje pravděpodobnost podle toho, jak text plyne slovo za slovem. AI totiž při psaní v každém kroku vybírá další slovo, které je z jejího pohledu nejpravděpodobnějším pokračováním – výsledek proto bývá plynulý a rovnoměrný, bez velkých výkyvů ve stylu.

Lidé píšou nepravidelněji. Střídají běžná slova s neobvyklými obraty, odbočují, občas zvolí míň elegantní, zato osobitější formulaci. Detektor se snaží zachytit právě tenhle rozdíl v pravidelnosti a spočítat z něj skóre nebo procento.

Jenže je to jen odhad pravděpodobnosti, ne ověření faktu. Pečlivý autor, který si text několikrát projde a učeše, se svým stylem statisticky přiblíží tomu, jak píše AI. A text od AI, který si člověk upraví a přepíše pár vět, se zase přiblíží člověku. Čím víc se dnes texty upravují – ať už AI pomáhá člověku, nebo člověk dolaďuje AI – tím rozmazanější je hranice mezi nimi.

Co s češtinou a dalšími jazyky

U češtiny je nejistota o kus vyšší než u angličtiny. Detektory se primárně vyvíjejí a testují na anglických textech, čeština má jinou stavbu vět i slovosled, takže přenos stejného postupu na český text je z principu méně prozkoumaná půda. Přesnou míru chyby nikdo spolehlivě nezměřil, a radši než si číslo vymyslet, zůstáváme u jednoduchého doporučení: u češtiny a dalších neanglických jazyků buďte s výsledkem ještě opatrnější než u angličtiny.

Proč je obvinění z AI na základě detektoru riskantní

Tohle je nejdůležitější věta celého článku: výsledek detektoru sám o sobě není důvod někoho obvinit. Když nástroj označí text jako pravděpodobně napsaný AI a ve skutečnosti ho napsal člověk, dostane se nevinný člověk do pozice, ze které se těžko obhajuje – jak dokázat, že jste sami napsali něco, co jste sami napsali.

Psaní s pomocí AI je dnes běžné a samo o sobě to není problém – ostatně i my máme návod pro úplné začátečníky s ChatGPT. Potíž nastává, až když se z nejistého odhadu detektoru udělá obvinění.

V praxi jde o konkrétní škodu: student obviněný z podvádění, uchazeč o práci vyřazený kvůli průvodnímu dopisu, zaměstnanec podezřelý, že si nechal napsat zprávu AI. Ve všech třech případech stojí proti sobě jistota nástroje, který jistotu z principu dát nemůže, a reálný dopad na hodnocení, pověst nebo zaměstnání konkrétního člověka. Čím vyšší je dopad rozhodnutí, tím méně by mělo záležet na jediném čísle z jediného nástroje.

Signály, kterých si můžete všimnout sami

Bez jakéhokoli nástroje si můžete všimnout pár věcí, které se u textů od AI objevují častěji. Berte je ale jako podnět k otázce, ne jako odpověď:

  • Text je hladký a gramaticky bezchybný, ale chybí mu osobní pohled nebo konkrétní detail – jméno, číslo, vlastní zkušenost.
  • Věty mají podobnou délku a rytmus, chybí přirozené střídání krátké a rozvitější formulace.
  • Objevují se otřepané obraty a spojky jako „je důležité zmínit“ nebo „v neposlední řadě“, a to víc, než by člověk běžně použil.
  • Text působí vyváženě až neutrálně k oběma stranám tématu, aniž by nakonec zaujal jasné stanovisko.
  • Struktura kopíruje šablonu – úvod, tři body, závěr – i tam, kde to daný typ textu obvykle nemívá.

Ani jeden z těchhle signálů není důkaz. Vyvážený, gramaticky čistý text bez otřepaných frází umí napsat i pečlivý člověk, obzvlášť když psal podle osnovy ze školy nebo píše v cizím jazyce. A text od AI, který si autor přečetl a trochu učesal, tyhle stopy setře skoro úplně. Signály fungují nanejvýš jako důvod se zeptat, nikdy jako rozsudek.

Časté signály a co doopravdy znamenají
Co si všimneteCo to ve skutečnosti znamená
Text je hladký a bez chybStejně tak vypadá text pečlivého autora po korektuře.
Věty mají podobný rytmusČasté u AI, ale i u lidí píšících podle šablony nebo v cizím jazyce.
Chybí konkrétní detaily a jménaUkazuje na obecnost podkladů, ne nutně na původ textu.
Nástroj jako ZeroGPT ukáže vysoké procentoJe to odhad pravděpodobnosti podle vzorce, ne ověřený fakt o autorovi.
Časté signály a co doopravdy znamenají

Co dělat místo detekce

Pokud jako učitel, personalista nebo vedoucí týmu potřebujete vědět, jestli práci udělal opravdu ten, kdo si ji přisvojuje, detekce není nejsilnější nástroj, který máte k dispozici. Silnější je změnit, jak práci zadáváte a jak se na ni ptáte.

Zadejte práci tak, aby na výsledku nezáleželo

Když úkol vyžaduje konkrétní místní kontext, vlastní zkušenost, práci s podklady, které AI nemá k dispozici, nebo reakci na něco, co se stalo přímo ve třídě či na poradě, obecný text z AI na něj neodpoví dobře – bez ohledu na to, jestli ho někdo použil. Nezáleží pak na tom, čím byl text napsaný, ale na tom, jestli odpovídá na položenou otázku.

Ptejte se na proces, ne jen na výsledek

Požádejte o mezikroky – poznámky, osnovu, starší verzi, krátké ústní shrnutí toho, jak k závěru autor došel. Kdo text opravdu napsal sám, tohle obvykle zvládne bez přípravy. Je to přirozenější a spravedlivější ověření, než spoléhat na to, co ukáže detektor.

Pomoct může i AI samotná – v katalogu najdete kategorii nástrojů pro vzdělávání (141 nástrojů), mezi nimi i pomocníky pro tvorbu zadání a zpětné vazby, které se soustředí na proces, ne jen na finální text.

AI novinky do e-mailu

Každý pátek 3 vybrané AI nástroje, prompt týdne a to nejdůležitější ze světa AI — přehledně, česky a bez balastu.

Jeden z nejstarších pravidelných českých AI newsletterů.

Jednou týdně, v pátek. Žádný spam — odhlásíte se jedním klikem.

Detektory v katalogu ejaj.cz

Katalog ejaj.cz eviduje přes 3 200 AI nástrojů a dá se procházet i přes vyhledávání. Máme v něm i vlastní kategorii detektorů AI obsahu – aktuálně 10 nástrojů. Jména jako Turnitin, GPTZero nebo ZeroGPT patří mezi nejznámější v oboru, ale i u nich platí to, co popisujeme výše: číslo, které ukážou, je odhad pravděpodobnosti, ne rozsudek o tom, kdo text napsal.

Časté otázky

Jak detektory AI textu vlastně poznávají, že text napsala AI?

Nečtou obsah, ale statistické vzorce v tom, jak text plyne slovo za slovem – jak pravidelně nebo nepravidelně se řadí slova a věty. AI bývá v tomhle ohledu pravidelnější, lidé nepravidelnější. Detektor z téhle pravidelnosti spočítá skóre nebo procento, ale nejde o čtení podpisu ani o ověření faktu.

Je vysoké procento z nástroje jako ZeroGPT důkaz, že text napsala AI?

Ne. Jde o odhad pravděpodobnosti nad statistickým vzorem, ne o ověřený fakt o původu textu. Platí to pro ZeroGPT stejně jako pro kterýkoli podobný nástroj – číslo, které ukáže, berte jako podnět k otázce, ne jako rozsudek.

Pozná detektor spolehlivě text napsaný v ChatGPT?

Nemáme doloženo, jak spolehlivě který konkrétní detektor rozpoznává text z konkrétního nástroje, a takové číslo bychom si nechtěli vymýšlet. Obecně platí, že jakákoli lidská úprava textu – přepsání pár vět, sjednocení stylu – rozpoznávání dál ztěžuje.

Funguje detekce AI textu i v češtině?

Nejistoty je tu ještě víc než u angličtiny. Detektory se primárně vyvíjejí a testují na anglických textech, čeština má jinou stavbu vět i slovosled, takže přenos na český text je méně prozkoumaná půda. Přesnou míru chyby nikdo spolehlivě nezměřil, proto místo čísla platí jednoduché doporučení: buďte u češtiny ještě opatrnější.

Existuje způsob, jak poznat text od AI se stoprocentní jistotou?

Ne, a to ani pomocí nástroje, ani pouhým okem. Styl AI textu a lidského psaní se navzájem přibližují – lidé si nechávají textem od AI poradit, výstupy AI zase lidé upravují – takže jednoznačná hranice mezi nimi z principu neexistuje.

Co mám dělat, když mě někdo neprávem obviní, že jsem text napsal pomocí AI?

Požádejte o vysvětlení, na čem obvinění stojí – jestli jen na dojmu, nebo na výsledku z detektoru, který sám o sobě nic nedokazuje. Nabídněte mezikroky své práce, poznámky nebo starší verze, a buďte připraveni obsah vlastními slovy obhájit – to zvládne jen ten, kdo ho opravdu napsal sám.

Jaké nástroje na detekci AI obsahu najdu v katalogu ejaj.cz?

V kategorii detektorů AI obsahu máme aktuálně 10 nástrojů. Uvádíme je jako přehled toho, co na trhu existuje, ne jako doporučení konkrétního řešení – přistupujte k nim se stejnou opatrností, jakou popisujeme v tomhle článku.

Jak mám jako učitel nebo zadavatel ověřit, že práci opravdu udělal ten, kdo si ji přisvojuje?

Silnější než detekce je změnit zadání a způsob ověření: požadovat konkrétní kontext, který AI nemá k dispozici, a ptát se na proces – poznámky, mezikroky, krátké ústní shrnutí. Kdo práci udělal sám, tohle obvykle zvládne bez přípravy.

Kam dál