Čo je AI watermark a prečo sa naň pri texte nedá spoliehať
AI watermark je skrytá značka, ktorú do vygenerovaného textu zabuduje sám model — buď ako neviditeľné znaky, alebo ako zámernú odchýlku vo výbere slov. Štatistickú značku dnes pridáva Gemini a od augusta 2026 aj Claude, takže rátať s tým, že vygenerovaný text žiadnu nemá, sa už nedá. Pre nezávislý nástroj sa tým však nič nemení: takú značku overí len prevádzkovateľ modelu, ktorý drží kľúč, a viditeľnú stopu po sebe v texte nenechá. Watermark je preto doplnok k detekcii, nie test sám o sebe.
Dva druhy značiek
Prvý druh sú neviditeľné znaky. Do textu sa vloží nulová medzera, mäkký spojovník alebo netypický variant medzery — nič z toho na obrazovke nevidíte, ale v znakovej podobe textu to zostane. Prenesie sa to aj vtedy, keď text kopírujete z chatu do dokumentu, takže sa s ním dostane až do odovzdanej práce.
Druhý druh je štatistický. Model pri generovaní mierne nakloní výber medzi rovnako dobrými slovami podľa skrytého kľúča, takže výsledný text nesie vzorec, ktorý sa dá spočítať späť. Do textu sa pritom nič nepridá, nepribudne ani jediný znak — mení sa len to, podľa čoho model vyberá medzi rovnocennými pokračovaniami. Presne takto pracuje technika SynthID, ktorú používa Gemini a od augusta 2026 aj Claude.
Prečo zmizne skôr, než ho začnete hľadať
Neviditeľné znaky spoľahlivo odstráni každý prechod obyčajným textom: vloženie bez formátovania, prepis do iného editora, prevod do PDF a späť. Štatistický vzorec je odolnejší — ľahkú redakciu väčšinou prežije, ale prepísanie vety po vete, preklad do iného jazyka alebo zamiešanie s vlastným textom ho rozložia. Silný navyše nevznikne všade: krátky text, výpočet dát alebo pasáž s pevným znením model nemá ako označiť, lebo v nich nemá medzi čím vyberať, a pri kóde sa watermark nepoužíva vôbec.
K tomu sa pridáva praktická prekážka: štatistický watermark vie overiť len ten, kto pozná kľúč, teda prevádzkovateľ modelu. Anthropic detekčné API ešte len chystá, Google svoje púšťa len obmedzene — nezávislý nástroj teda s takou značkou pracovať nemôže, aj keby v texte bola. Absencia nálezu preto o pôvode textu nehovorí vôbec nič.
Ako s tým pracovať v praxi
Nález berte ako silnú indíciu pre konkrétny úsek textu, nie ako verdikt nad celým dokumentom — znaky sa doň mohli dostať aj s citáciou odinakiaľ. Nenález neberte nijako; nedokazuje, že text písal človek. DetekceGPT preto hľadá skryté znaky zvlášť vedľa skóre, takže sa na ne príde aj pri texte, ktorý inak číta úplne prirodzene.
Rozhodnutie stavajte na viacerých vrstvách naraz: všeobecné skóre, konkrétne podozrivé vety, odchýlka od skorších textov autora a až k tomu skryté znaky. Keď sa vrstvy zhodnú, máte o čom hovoriť. Keď sa rozchádzajú, je na rade rozhovor s autorom, nie obvinenie.
Časté otázky
Spoznám neviditeľné znaky sám?
V editore, ktorý vie zobraziť skryté znaky, áno. Ľahko sa však prehliadnu a ich neprítomnosť nič nedokazuje, takže ručná kontrola nahradí detektor len sčasti.
Odstráni watermark humanizácia textu?
Neviditeľné znaky áno, štatistický vzorec vo väčšine prípadov tiež. Prepis ale zároveň mení štýl, takže sa posunie aj všeobecné skóre — oboje sa pozná inou cestou.
Označuje svoje texty ChatGPT?
OpenAI pri ChatGPT žiadne značkovanie textu verejne nespustil. Claude a Gemini značku pridávajú, overiť ju však vie len ich prevádzkovateľ — z textu samotného sa to nepozná ani pri jednom z nich.
Skúste to na vlastnom texte
Vložte text alebo nahrajte súbor a pozrite sa na skóre aj na konkrétne vety, ktoré vyšli podozrivo.
Spustiť detekciu