Co je AI watermark a proč se na něj u textu nedá spolehnout
AI watermark je skrytá značka, kterou do vygenerovaného textu zabuduje sám model — buď jako neviditelné znaky, nebo jako záměrnou odchylku ve výběru slov. Statistickou značku dnes přidává Gemini a od srpna 2026 i Claude, takže počítat s tím, že vygenerovaný text žádnou nemá, už nejde. Pro nezávislý nástroj se tím ale nic nemění: takovou značku ověří jen provozovatel modelu, který drží klíč, a viditelnou stopu po sobě v textu nenechá. Watermark je proto doplněk k detekci, ne test sám o sobě.
Dva druhy značek
První druh jsou neviditelné znaky. Do textu se vloží nulová mezera, měkký spojovník nebo netypická varianta mezery — nic z toho na obrazovce nevidíte, ale ve znakové podobě textu to zůstane. Přenese se to i tehdy, když text kopírujete z chatu do dokumentu, takže se s ním dostane až do odevzdané práce.
Druhý druh je statistický. Model při generování mírně nakloní výběr mezi stejně dobrými slovy podle skrytého klíče, takže výsledný text nese vzorec, který jde spočítat zpátky. Do textu se přitom nic nepřidá, nepřibude ani jediný znak — mění se jen to, podle čeho model vybírá mezi rovnocennými pokračováními. Přesně takhle pracuje technika SynthID, kterou používá Gemini a od srpna 2026 i Claude.
Proč zmizí dřív, než ho začnete hledat
Neviditelné znaky spolehlivě odstraní každý průchod prostým textem: vložení bez formátování, přepis do jiného editoru, převod do PDF a zpátky. Statistický vzorec je odolnější — lehkou redakci většinou přežije, ale přepsání věty po větě, překlad do jiného jazyka nebo zamíchání s vlastním textem ho rozloží. Silný navíc nevznikne všude: krátký text, výčet dat nebo pasáž s pevným zněním model nemá jak označit, protože v nich nemá mezi čím vybírat, a u kódu se watermark nepoužívá vůbec.
K tomu se přidává praktická překážka: statistický watermark umí ověřit jen ten, kdo zná klíč, tedy provozovatel modelu. Anthropic detekční API teprve chystá, Google svoje pouští jen omezeně — nezávislý nástroj tedy s takovou značkou pracovat nemůže, i kdyby v textu byla. Absence nálezu proto o původu textu neříká vůbec nic.
Jak s tím pracovat v praxi
Nález berte jako silnou indicii pro konkrétní úsek textu, ne jako verdikt nad celým dokumentem — znaky se do něj mohly dostat i s citací odjinud. Nenález neberte nijak; nedokazuje, že text psal člověk. DetekceGPT proto hledá skryté znaky zvlášť vedle skóre, takže se na ně přijde i u textu, který jinak čte úplně přirozeně.
Rozhodnutí stavějte na víc vrstvách najednou: obecné skóre, konkrétní podezřelé věty, odchylka od dřívějších textů autora a teprve k tomu skryté znaky. Když se vrstvy shodnou, máte o čem mluvit. Když se rozcházejí, je na řadě rozhovor s autorem, ne obvinění.
Časté dotazy
Poznám neviditelné znaky sám?
V editoru, který umí zobrazit skryté znaky, ano. Snadno se ale přehlédnou a jejich nepřítomnost nic nedokazuje, takže ruční kontrola nahradí detektor jen zčásti.
Odstraní watermark humanizace textu?
Neviditelné znaky ano, statistický vzorec ve většině případů také. Přepis ale zároveň mění styl, takže se posune i obecné skóre — obojí se pozná jinou cestou.
Označuje své texty ChatGPT?
OpenAI u ChatGPT žádné značkování textu veřejně nespustil. Claude a Gemini značku přidávají, ověřit ji ale umí jen jejich provozovatel — z textu samotného se to nepozná ani u jednoho z nich.
Zkuste to na vlastním textu
Vložte text nebo nahrajte soubor a podívejte se na skóre i na konkrétní věty, které vyšly podezřele.
Spustit detekci