Slovník pojmů

Pojmy, na které narazíte u detektorů AI textu, vysvětlené krátce a bez žargonu.

Detektor AI textu
Nástroj, který odhaduje, jestli text napsal člověk, nebo jazykový model. Autora neověřuje, jen měří, nakolik se text podobá tomu, co zná jako strojové psaní, a žádný nemá stoprocentní přesnost.
Skóre detektoru
Číslo, obvykle od 0 do 100, kterým detektor vyjadřuje, nakolik text odpovídá jeho představě strojového psaní. Každý nástroj ho počítá jinak, takže šedesát v jednom neznamená totéž co šedesát v druhém.
Jazykový model
Program naučený na velkém množství textu, který píše tak, že postupně volí pravděpodobná další slova. Patří sem ChatGPT, Claude nebo Gemini a jejich texty jsou to, co detektory hledají.
Perplexita
Míra toho, jak předvídatelné je pro jazykový model každé další slovo textu. Nízká perplexita znamená, že model by text napsal skoro stejně, což je typické pro AI, ale i pro šablonovité lidské texty.
Burstiness
Míra toho, jak moc se v textu střídají krátké a dlouhé věty. Lidské psaní bývá nepravidelné a text od AI rovnoměrnější; u nás tuhle vlastnost měří detektor Strojový dojem.
Stylometrie
Měření autorského stylu podle vlastností, které člověk vědomě skoro nemění — délky vět a slov, interpunkce nebo četnosti nejběžnějších slov. Používá se k určování autorství a u nás na ní stojí detektor Odchylka stylu.
Osobní stylová základna
Profil vašeho psaní spočítaný z vašich dřívějších textů, se kterým se porovnává každý nový text. U nás se staví z posledních až padesáti kontrol a z nahraných vzorů a naskočí od šesti textů.
Fráze typické pro AI
Obraty, které jazykové modely používají výrazně častěji než lidé, například „v dnešní době“ nebo „je důležité si uvědomit“. Jedna taková fráze nic nedokazuje, protože je používají i lidé; význam má jejich hustota.
Falešně pozitivní výsledek
Případ, kdy detektor označí za AI text, který napsal člověk. U detekce AI textu je to nejzávažnější chyba, protože může vést k neoprávněnému obvinění.
Falešně negativní výsledek
Případ, kdy detektor nepozná text od AI a vyhodnotí ho jako lidský. Typicky se to stává u textů, které někdo po AI ručně přepsal nebo humanizoval.
Humanizace
Přepis textu tak, aby působil méně strojově — s nepravidelnějším rytmem vět a bez obratů typických pro AI. Naše humanizace zachová fakta, čísla i tón a ukáže, jak se změnil strojový dojem.
Watermark (vodoznak)
Skrytá značka, kterou do textu vloží sám generátor, aby šlo později poznat, že text vytvořila AI. U textu je křehký: přepsání nebo překlad ho obvykle odstraní, takže se na něj detekce nemůže spoléhat sama.
Skryté znaky
Neviditelné znaky Unicode, jako jsou nulové mezery, směrové značky nebo neobvyklé druhy mezer, které se přenesou kopírováním. V lidském psaní jsou vzácné, a proto je počítáme v samostatném detektoru.
C2PA
Otevřený standard pro podepsaný záznam o původu obsahu, který se vloží přímo do souboru. Když takový záznam s platným podpisem uvádí, že obsah vytvořila AI, ukáže detektor Skryté znaky 100.

Zkuste to na vlastním textu

Vložte text nebo nahrajte soubor a podívejte se na skóre i na konkrétní věty, které vyšly podezřele.

Spustit detekci