Slovník pojmů
Pojmy, na které narazíte u detektorů AI textu, vysvětlené krátce a bez žargonu.
- Detektor AI textu
- Nástroj, který odhaduje, jestli text napsal člověk, nebo jazykový model. Autora neověřuje, jen měří, nakolik se text podobá tomu, co zná jako strojové psaní, a žádný nemá stoprocentní přesnost.
- Skóre detektoru
- Číslo, obvykle od 0 do 100, kterým detektor vyjadřuje, nakolik text odpovídá jeho představě strojového psaní. Každý nástroj ho počítá jinak, takže šedesát v jednom neznamená totéž co šedesát v druhém.
- Jazykový model
- Program naučený na velkém množství textu, který píše tak, že postupně volí pravděpodobná další slova. Patří sem ChatGPT, Claude nebo Gemini a jejich texty jsou to, co detektory hledají.
- Perplexita
- Míra toho, jak předvídatelné je pro jazykový model každé další slovo textu. Nízká perplexita znamená, že model by text napsal skoro stejně, což je typické pro AI, ale i pro šablonovité lidské texty.
- Burstiness
- Míra toho, jak moc se v textu střídají krátké a dlouhé věty. Lidské psaní bývá nepravidelné a text od AI rovnoměrnější; u nás tuhle vlastnost měří detektor Strojový dojem.
- Stylometrie
- Měření autorského stylu podle vlastností, které člověk vědomě skoro nemění — délky vět a slov, interpunkce nebo četnosti nejběžnějších slov. Používá se k určování autorství a u nás na ní stojí detektor Odchylka stylu.
- Osobní stylová základna
- Profil vašeho psaní spočítaný z vašich dřívějších textů, se kterým se porovnává každý nový text. U nás se staví z posledních až padesáti kontrol a z nahraných vzorů a naskočí od šesti textů.
- Fráze typické pro AI
- Obraty, které jazykové modely používají výrazně častěji než lidé, například „v dnešní době“ nebo „je důležité si uvědomit“. Jedna taková fráze nic nedokazuje, protože je používají i lidé; význam má jejich hustota.
- Falešně pozitivní výsledek
- Případ, kdy detektor označí za AI text, který napsal člověk. U detekce AI textu je to nejzávažnější chyba, protože může vést k neoprávněnému obvinění.
- Falešně negativní výsledek
- Případ, kdy detektor nepozná text od AI a vyhodnotí ho jako lidský. Typicky se to stává u textů, které někdo po AI ručně přepsal nebo humanizoval.
- Humanizace
- Přepis textu tak, aby působil méně strojově — s nepravidelnějším rytmem vět a bez obratů typických pro AI. Naše humanizace zachová fakta, čísla i tón a ukáže, jak se změnil strojový dojem.
- Watermark (vodoznak)
- Skrytá značka, kterou do textu vloží sám generátor, aby šlo později poznat, že text vytvořila AI. U textu je křehký: přepsání nebo překlad ho obvykle odstraní, takže se na něj detekce nemůže spoléhat sama.
- Skryté znaky
- Neviditelné znaky Unicode, jako jsou nulové mezery, směrové značky nebo neobvyklé druhy mezer, které se přenesou kopírováním. V lidském psaní jsou vzácné, a proto je počítáme v samostatném detektoru.
- C2PA
- Otevřený standard pro podepsaný záznam o původu obsahu, který se vloží přímo do souboru. Když takový záznam s platným podpisem uvádí, že obsah vytvořila AI, ukáže detektor Skryté znaky 100.
Zkuste to na vlastním textu
Vložte text nebo nahrajte soubor a podívejte se na skóre i na konkrétní věty, které vyšly podezřele.
Spustit detekci