Zpět na interaktivní verzi

Vodoznak v textu od Claude, textová verze ukázky

Tohle je celý obsah interaktivní ukázky z vodoznak-anthropic.pprojects.cz v textové podobě, bez animace a bez čekání.

Ověřeno k 16. srpnu 2026. Autor Pavel Horák. Zdrojem je studie na saioai.cz.

Shrnutí v pěti větách.

1. Jak vzniká text

Zadání do chatu zní: napiš mi dvě věty o včerejším počasí.

Model skládá odpověď slovo po slově. Na třech místech přitom má několik možností, které znamenají prakticky totéž:

Výsledná věta zní: Včera bylo celý den zataženo a k večeru se přidal neustávající déšť, který přestal až nad ránem.

Věta by fungovala s kteroukoli z těch možností. Takových míst je v každém delším textu spousta.

2. Odkud se bere volba

Normálně losem. U takového místa si model obrazně hodí kostkou. Proto když stejné zadání pošlete dvakrát, dostanete pokaždé o něco jinou větu. Tři pokusy po sobě mohou dát zataženo, pod mrakem a šedivo.

Vodoznak nedělá nic jiného, než že tu kostku vymění. Místo náhody nastoupí tajný klíč a pár předchozích slov. Tři pokusy po sobě pak dají pokaždé stejné slovo.

Anthropic to přirovnává k deskové hře, ve které se místo házení kostkou postupuje podle číslic čísla pí. Hra vypadá úplně stejně a hráčům je to jedno, ale kdo zná pí, pozná zpětně, že se hrálo podle něj.

Do textu se tím nic nepřidá, nic se nezdraží a nic nezpomalí. Mění se jen to, odkud se bere náhoda.

3. Jak se to pozná zpátky

Kdo má ten klíč, může to spočítat. Projde text a u každého místa, kde byla volba, se podívá, jestli padlo právě to slovo, které by klíč vybral. Čím víc shod, tím jistější výsledek.

Z toho plynou dvě věci. Čím delší text, tím víc takových míst a tím spolehlivější odpověď, zatímco u dvou vět se nedá říct v podstatě nic. A detektor nečte, o čem text je, jen počítá shody.

Ve značce nejsou žádné údaje o uživateli. Nedá se z ní zjistit, kdo si o text řekl, kdy to bylo ani v jaké konverzaci. Odpovídá na jedinou otázku, tedy jestli se textu nejspíš dotkl Claude.

4. V textu není nic schovaného

Nejrozšířenější omyl zní, že umělá inteligence schovává do textu neviditelné znaky, které se dají najít a smazat. Není to pravda.

Když se hotová věta rozloží na jednotlivé znaky, najdete v ní písmena, mezery a tečku. Nic dalšího tam není a být nemůže, protože značka je ve výběru slov, ne ve znacích.

Má to dva důsledky. Značka vydrží zkopírování a vložení kamkoli, protože slova zůstanou stejná. A nedá se odstranit hledáním a nahrazením, protože není co hledat.

5. Kdy značka vzniká a kdy z ní nic nezbude

Značka žije jen tam, kde slova vybírá model. Čtyři běžné situace vedle sebe:

Nejzajímavější je překlad. Myšlenky ani formulace nejsou modelu vlastní, a značku přesto nese naplno, protože slova vybíral on. To je celý rozdíl mezi tím, kdo text vymyslel, a tím, kdo vybral slova. Vodoznak odpovídá na druhou otázku, ne na první.

6. Co značku smaže

Přepsání vlastními slovy. Vymění se přesně ta slova, na kterých značka stála, text říká pořád totéž a značka je pryč.

Nezávislý výzkum z července 2026 na tohle došel taky. Po přepsání zmizela značka téměř ve všech případech, kde ji předtím našli. Stejný výzkum našel i opačnou chybu, tedy texty psané člověkem označené jako umělé.

Text a obrázky jsou dvě úplně jiné věci

U textu značka vydrží zkopírování a vložení jinam i změnu formátování, zmizí po přepsání vlastními slovy a u krátkého textu nefunguje spolehlivě.

U obrázků nejde o vodoznak v obraze, ale o podepsanou poznámku připojenou k souboru. Zmizí při snímku obrazovky, při převodu do jiného formátu i při běžné optimalizaci souboru.

V článcích se obojí často slučuje pod jedno slovo. To je věcná chyba.

7. Co si z toho vzít

Nejčastější omyly a jak to je

Omyl: AI schovává do textu neviditelné znaky. V textu není nic navíc. Značka je v tom, která slova padla, ne v tom, co je napsáno.
Omyl: Vodoznak prozradí, kdo text napsal. Ve značce nejsou žádné údaje o uživateli. Odpovídá jen na otázku, jestli se textu nejspíš dotkl model.
Omyl: Vodoznak se dá odstranit hledáním a nahrazením. Není co hledat. Odstraní ho ale přepsání textu vlastními slovy.
Omyl: Nalezená značka je důkaz podvodu. Není. Nese ji i překlad cizí myšlenky a naopak chybí u všeho přepsaného i u krátkých textů.
Omyl: Vodoznak v textu a značení obrázků jsou totéž. Nejsou. U obrázků jde o podepsanou poznámku v souboru, kterou běžné zpracování odstraní.

Co tahle stránka netvrdí

Ukázka je zjednodušení určené laikům. Není to skutečný algoritmus a nespouští žádný model. Slova, poměry a ukazatele síly jsou ilustrativní, protože přesná čísla nikdo nezveřejnil. Pořadí situací podle síly značky ale odpovídá tomu, co o své metodě uvádí sám Anthropic.

Doložená tvrzení, zdroje, akademickou kritiku a regulatorní souvislosti obsahuje studie na saioai.cz, ze které tahle ukázka vychází.

O autorovi

Pavel Horák. Stavím nástroje s pomocí AI a píšu o tom, co s nimi funguje a co ne. AI-first, ne AI-only.

Studii, ze které tahle ukázka vychází, jsem si zadal, napsal ji Claude, nezávisle ji oponoval Gemini a já jsem vybral úhel, ověřil zdroje, zamítl, co neobstálo, a ručím za výsledek.

Další, co dělám: pprojects.cz je sbírka funkčních experimentů a nástrojů. saioai.cz nabízí longitudinální studie a praktické testy LLM modelů. hodinovyvibecoder.cz je placená hodinová pomoc s tím, co si chcete postavit sami. claude-limits.pprojects.cz je analyzátor efektivního kontextového okna Claude. claude-nacitani-web-stranek.pprojects.cz je starší ukázka o tom, proč Claude ve skutečnosti nečte webové stránky.