Slovník pojmov
Pojmy, na ktoré narazíte pri detektoroch AI textu, vysvetlené stručne a bez žargónu.
- Detektor AI textu
- Nástroj, ktorý odhaduje, či text napísal človek, alebo jazykový model. Autora neoveruje, len meria, nakoľko sa text podobá tomu, čo pozná ako strojové písanie, a žiadny nemá stopercentnú presnosť.
- Skóre detektora
- Číslo, zvyčajne od 0 do 100, ktorým detektor vyjadruje, nakoľko text zodpovedá jeho predstave strojového písania. Každý nástroj ho počíta inak, takže šesťdesiat v jednom neznamená to isté čo šesťdesiat v druhom.
- Jazykový model
- Program naučený na veľkom množstve textu, ktorý píše tak, že postupne volí pravdepodobné ďalšie slová. Patria sem ChatGPT, Claude alebo Gemini a ich texty sú to, čo detektory hľadajú.
- Perplexita
- Miera toho, aké predvídateľné je pre jazykový model každé ďalšie slovo textu. Nízka perplexita znamená, že model by text napísal takmer rovnako, čo je typické pre AI, ale aj pre šablónovité ľudské texty.
- Burstiness
- Miera toho, ako veľmi sa v texte striedajú krátke a dlhé vety. Ľudské písanie býva nepravidelné a text od AI rovnomernejší; u nás túto vlastnosť meria detektor Strojový dojem.
- Štylometria
- Meranie autorského štýlu podľa vlastností, ktoré človek vedome takmer nemení — dĺžky viet a slov, interpunkcie alebo početnosti najbežnejších slov. Používa sa na určovanie autorstva a u nás na nej stojí detektor Odchýlka štýlu.
- Osobná štýlová základňa
- Profil vášho písania vypočítaný z vašich skorších textov, s ktorým sa porovnáva každý nový text. U nás sa stavia z posledných až päťdesiatich kontrol a z nahraných vzorov a nabehne od šiestich textov.
- Frázy typické pre AI
- Obraty, ktoré jazykové modely používajú výrazne častejšie ako ľudia, napríklad „v dnešnej dobe“ alebo „je dôležité si uvedomiť“. Jedna taká fráza nič nedokazuje, pretože ich používajú aj ľudia; význam má ich hustota.
- Falošne pozitívny výsledok
- Prípad, keď detektor označí za AI text, ktorý napísal človek. Pri detekcii AI textu je to najzávažnejšia chyba, pretože môže viesť k neoprávnenému obvineniu.
- Falošne negatívny výsledok
- Prípad, keď detektor nespozná text od AI a vyhodnotí ho ako ľudský. Typicky sa to stáva pri textoch, ktoré niekto po AI ručne prepísal alebo humanizoval.
- Humanizácia
- Prepis textu tak, aby pôsobil menej strojovo — s nepravidelnejším rytmom viet a bez obratov typických pre AI. Naša humanizácia zachová fakty, čísla aj tón a ukáže, ako sa zmenil strojový dojem.
- Watermark (vodoznak)
- Skrytá značka, ktorú do textu vloží samotný generátor, aby sa neskôr dalo poznať, že text vytvorila AI. Pri texte je krehká: prepísanie alebo preklad ju zvyčajne odstráni, takže sa na ňu detekcia nemôže spoliehať sama.
- Skryté znaky
- Neviditeľné znaky Unicode, ako sú nulové medzery, smerové značky alebo nezvyčajné druhy medzier, ktoré sa prenesú kopírovaním. V ľudskom písaní sú zriedkavé, a preto ich počítame v samostatnom detektore.
- C2PA
- Otvorený štandard pre podpísaný záznam o pôvode obsahu, ktorý sa vloží priamo do súboru. Keď taký záznam s platným podpisom uvádza, že obsah vytvorila AI, ukáže detektor Skryté znaky 100.
Skúste to na vlastnom texte
Vložte text alebo nahrajte súbor a pozrite sa na skóre aj na konkrétne vety, ktoré vyšli podozrivo.
Spustiť detekciu