Jak funguje detekce AI textu

Sedm detektorů, sedm různých otázek. Co každý z nich měří, z čeho vychází a kde má hranice.

DetekceGPT pošle text naráz sedmi detektorům a skóre každého z nich ukáže zvlášť, na stupnici od 0 do 100. Pět z nich běží přímo u nás a každý měří jednu vlastnost: odchylku od vašich dřívějších textů, věrnost šabloně zvoleného typu textu, fráze typické pro AI, strojový rytmus vět a skryté znaky. Další dva jsou samostatné modely, OpenAI a ZeroGPT. Do jednoho čísla je neslučujeme, protože každý měří jinou vlastnost textu a jejich rozpor je sám o sobě informace. K číslům patří barevná mapa textu a věty, které jednotlivé detektory označily. Žádný detektor AI textu nemá stoprocentní přesnost, takže výsledek je podklad, ne verdikt.

Co se s textem stane před detekcí

Nejdřív se pozná jazyk textu — čeština, slovenština, angličtina, nebo němčina — podle písmen typických pro daný jazyk a nejběžnějších slov. Podle jazyka se vybírají seznamy frází, ukázky pro porovnání i měřítka stylu. U jiných jazyků nemá část detektorů s čím porovnávat a výsledek je jen orientační.

Potom se z textu vyřadí části, které autor nepsal vlastními slovy nebo které mají předepsanou podobu: seznam literatury, citace, poznámky pod čarou, popisky obrázků a tabulek, obsah, abstrakt v jiném jazyce, poděkování, čestné prohlášení, opakované záhlaví stránek a u e-mailů a dopisů oslovení, podpis a citovaná předchozí zpráva. Kdyby zůstaly, zkreslily by skóre. Typ textu, který vyberete, určuje, co se vyřadí a podle jaké šablony se text posoudí.

Sedm detektorů

Všech sedm běží současně. Když některý neodpoví, ostatní čísla platí dál a chybí jen to jedno.

Odchylka stylu

Jak moc se styl textu liší od vašich dřívějších textů. Porovnává vlastnosti, které člověk vědomě skoro nemění: délku vět a slov a jejich rozptyl, bohatost slovní zásoby, podíl dlouhých a krátkých slov, interpunkci, podíl velkých písmen, diakritiky a číslic a četnost nejběžnějších slov jazyka. Úseky, které se odchylují nejvíc, se zvýrazní fialově.

Z čeho vychází:Vaše vlastní texty ve stejném jazyce: až padesát posledních kontrol stejného typu textu a nahrané vzorové texty, které mají dvojnásobnou váhu. Kontroly, u kterých ZeroGPT, Fráze AI nebo samotná Odchylka stylu přesáhly 50, se do základny nepočítají, aby se neučila z textů od AI.

Hranice:Naskočí až od šesti textů delších než 250 znaků. Měří změnu stylu, ne AI — jiný styl může mít i jiný důvod, třeba spoluautora, jiné téma nebo důkladnou korekturu.

Šablona typu

Jak přesně text sedí na osnovu typu, který jste vybrali. Sleduje stejně dlouhé odstavce, rozsekání na mnoho krátkých odstavců, odrážky se stejně dlouhými položkami, nadpisy, řádky ve tvaru „Pojem: vysvětlení“, výčty po třech, hashtagy a nedostatek konkrétních údajů, jako jsou čísla a vlastní jména.

Z čeho vychází:Pravidla pro deset typů textu: esej, odborná práce, úvaha, vypravování, blog, příspěvek, recenze, e-mail, motivační dopis a zpráva. Každý typ váží signály jinak — u eseje hrají hlavní roli rovnoměrné odstavce, výčty po třech a obecnost, u zprávy nadpisy, odrážky a krátké odstavce.

Hranice:Nula neznamená, že psal člověk, a člověk, který píše podle přísné osnovy, třeba zprávu nebo odbornou práci, může vyjít vysoko. U němčiny se nedostatek konkrétních údajů neměří, protože se v ní všechna podstatná jména píšou s velkým písmenem.

Fráze AI

Kolik je v textu obratů a formátování typických pro jazykové modely — například „v dnešní době“, „je důležité si uvědomit“ nebo „v neposlední řadě“, ale také dlouhé pomlčky, šipky, tučné zvýraznění, nadpisy a tabulky v markdownu nebo emoji. Nalezené fráze se zvýrazní žlutě.

Z čeho vychází:Seznam více než 5 600 frází v češtině, slovenštině, angličtině a němčině, ve kterém silné fráze mají dvojnásobnou váhu. Nálezy se přepočítávají na sto slov, takže delší text nevyjde výš jen proto, že je delší.

Hranice:Vidí jen to, co je na seznamu. Člověk, který píše ustáleným úředním stylem, může vyjít vysoko, a text od AI, ze kterého někdo fráze vyškrtal, nízko. Jedna fráze nic nedokazuje, rozhoduje jejich hustota.

Strojový dojem

Jak strojově působí stavba textu. Z poloviny ho určuje to, jak podobně dlouhé jsou věty, ze třiceti procent obehrané obraty a z dvaceti procent slova a trojice slov, které se v textu opakují.

Z čeho vychází:Statistika samotného textu, bez porovnání s jinými texty. Stejné číslo ukazuje humanizace, takže je vidět, jak se strojový dojem po přepisu změnil.

Hranice:Krátký text má málo vět na to, aby šel rytmus spolehlivě změřit. Strohý odborný nebo úřední styl s podobně dlouhými větami může působit strojově, i když ho psal člověk.

Skryté znaky

Neviditelné znaky, které se přenesou kopírováním: nulové mezery, řídicí a směrové znaky, neobvyklé druhy mezer a písmena s diakritikou složená ze dvou znaků. U nahraného souboru navíc hledá podepsaný záznam o původu podle standardu C2PA.

Z čeho vychází:Počet takových znaků na tisíc znaků textu. Některé z nich se v běžném psaní nevyskytují vůbec a jediný stačí na 100. Na 100 vyjde i soubor, jehož záznam o původu s platným podpisem uvádí, že obsah vytvořila AI.

Hranice:Nula neznamená, že psal člověk — stačí text přepsat nebo vložit jako prostý text a znaky zmizí. Některé z nich naopak vznikají i bez AI, třeba při kopírování z PDF.

OpenAI

Jazykový model OpenAI přečte text jako celek a odhadne, jaká jeho část pochází od AI. Vrátí i věty, které ho k tomu vedly, a ty se zvýrazní modře.

Z čeho vychází:Porovnání s ukázkami. Model dostane osm textů stejného typu a jazyka, o kterých se ví, že je napsala AI, a k nim ukázky lidského psaní z jazykových korpusů. Stejný text dostane vždy stejné ukázky. Dlouhý text se posuzuje po částech do dvanácti tisíc znaků a výsledek se váží jejich délkou.

Hranice:Je to úsudek jiného jazykového modelu, ne měření, a může se mýlit oběma směry. U textu na hraně se jeho odhad může mezi dvěma kontrolami mírně lišit.

ZeroGPT

Samostatný detektor služby ZeroGPT. Vrátí podíl textu, který považuje za AI, a věty, které označil; ty se zvýrazní červeně.

Z čeho vychází:Vlastní model služby ZeroGPT. Delší text se posílá po částech do dvanácti tisíc znaků a výsledek se váží jejich délkou.

Hranice:Jak skóre počítá a na jakých textech se učil, služba nezveřejňuje, takže jeho číslo nejde vysvětlit zevnitř. Je to další nezávislý pohled vedle ostatních, ne rozhodčí.

Jak výsledek číst

Každé číslo se čte zvlášť a říká jen to, co měří jeho detektor. Šedesát u Frází AI znamená hustý výskyt typických obratů, ne že šedesát procent textu napsala AI. Když se detektory shodnou na stejných pasážích, máte silnější podklad. Když každý ukazuje jinam, je text hraniční a rozhodnutí je potřeba opřít o něco dalšího.

Barvy v textu ukazují, kdo co označil: fialově úseky s největší odchylkou od vašeho stylu, žlutě fráze AI, modře věty od OpenAI a červeně věty od ZeroGPT. Když stejný nebo upravený text kontrolujete znovu, ukáže se u čísel i změna oproti minulé kontrole.

Spolehlivost klesá u krátkých textů, u překladů, u textů nerodilých mluvčích a u textů, které AI jen upravila. Výsledek je proto podklad k rozhovoru nebo k dalšímu ověření, ne důkaz.

Zkuste to na vlastním textu

Vložte text nebo nahrajte soubor a podívejte se na skóre i na konkrétní věty, které vyšly podezřele.

Spustit detekci