Anthropic a jeho vodoznak v generovaných textech. Jak to funguje?
Anthropic začal do textů z Claude schovávat neviditelnou značku. Vysvětlím polopaticky, kde v textu vlastně je, proč ji zatím nikdo neumí přečíst a co dělat, když vás někdo obviní, že jste si text nechali napsat.

🎧 Poslechnout článek
5:41Namluveno mým hlasem přes AI
Anthropic začal značit texty z Claude neviditelným vodoznakem. Modely vydané 2. srpna a později ho mají rovnou od startu, u starších se doplňuje. Platí to všude, kde Claude používáte: v aplikaci, přes API i v Claude Code. A platí to celosvětově, i když důvod je evropský: označování obsahu podle AI Actu.
Za pár dní se kolem toho strhla debata, ve které se skoro nic z toho, co si lidi předávají dál, nedá ověřit. Tak jsem si to protřídil.
V textu není nic navíc. Vodoznak = specifický výběr slov
U fotky si vodoznak umíme představit: průsvitný nápis přes obraz. V textu nic takového není. Žádný skrytý znak, žádná neviditelná poznámka.
Funguje to jinak. Model při psaní pořád volí mezi slovy, která se do věty hodí zhruba stejně: „velký“, nebo „rozsáhlý“? „proto“, nebo „tudíž“? Tuhle volbu nově řídí tajný klíč. Jedno slovo nic neprozradí, ale na delším textu se ze stovek takových rozhodnutí složí vzor, který jde s klíčem spočítat.
Vodoznak tedy k textu není přilepený. Vodoznak JE ten text.
Proto přežije kopírování a vložení jinam: kopírujete přesně ta samá slova. A proto slábne s každým přepsáním, parafrází nebo překladem. Anthropic to sám říká opatrně: vodoznak „může přežít některé úpravy“.
U obrázků je to jednodušší: ty od Claude dostanou neviditelnou průvodku souboru se záznamem, čím vznikly. Na textu taková průvodka nedrží, proto ta oklika přes slova.
Detektor Anthropic slíbil, ale zatím nevydal
V dokumentaci stojí, že na možnosti detekce pro uživatele a třetí strany se teprve pracuje a podrobnosti přijdou později. Takže máme metodu, kterou zatím nikdo mimo Anthropic neumí přečíst. A to je myslím to podstatné.
Dokud není veřejný nástroj na rozpoznání vodoznaku, je vlastně úplně mimo řešit to, čeho byl tenhle týden plný internet. Viděl jsem spoustu obsahu na téma „už to někdo zlomil“, ale to je věc, která se nedá ověřit.
Nástroje, co slibují odstranění, mažou něco jiného
Během několika dní vznikl celý trh nástrojů na odstranění vodoznaku. Ten nejpopulárnější, watermarks-remover, nasbíral přes 10 tisíc hvězd na GitHubu a v dokumentaci si sám poctivě přiznává, že textový vodoznak „žije ve volbě slov“ a jeho odstranění je „best effort“, ne jistota.
Co takový nástroj doopravdy udělá? Vyčistí dvě věci: znaky, které se v textu nezobrazí, ale v souboru jsou, a zmíněnou průvodku souboru.
Stejně vedle jsou i rady, co kolují po sítích:
- Zkopírovat text do Poznámkového bloku. Odstraní formátování. Slova nechá být.
- Udělat screenshot a přečíst ho OCR. Vrátí vám ta samá slova.
- Poslat si to přes tři aplikace. Text se cestou nemění.
„Vodoznak“ naruší až přepsání jiným modelem nebo pořádná parafráze. Tedy práce, po které to už není ten text, který jste chtěli.
Vodoznak neříká „napsala to AI“. Říká „prošlo to modelem“
Když si necháte svůj vlastní odstavec jen učesat nebo přeložit, vodoznak v něm nejspíš bude. Když ho po AI ještě dvakrát přepíšete, nejspíš nebude. S tím, kdo text vymyslel, to nesouvisí ani v jednom směru. Anthropic to sám přiznává: nález vodoznaku není důkaz původu a jeho absence neznamená, že text od AI není.
A jde to i naopak. Výzkumníci z ETH Zurich ukázali, že se dá levně napodobit i text, který z modelu nikdy nevyšel, a přesto se tváří jako značkovaný. Marek Prokop to na LinkedInu shrnul přesně: budou existovat texty od AI, které se jako AI nepoznají, i texty, které detektor označí neprávem.
Co to pro vás znamená
Odstraňovat vodoznak nemá smysl. Spolehlivě to nejde a je to práce navíc.
Marketingový text označovat nemusíte. Tohle je nejčastější nedorozumění. Povinnost dopadá jen na text vydaný proto, aby informoval veřejnost o věcech veřejného zájmu: o politice, zdraví, právu, veřejné správě. Produktový popisek, prodejní stránka, newsletter s nabídkou ani post o vlastním produktu tam nespadají. U obrázků a videa jsou pravidla jiná a přísnější, projděte si průvodce k označování obsahu podle AI Actu.
Když vás někdo obviní, že jste text nepsali, vodoznak vám nepomůže ani neuškodí. Přečíst ho (zatím) stejně nikdo neumí. Co pomůže, je ukázat, jak text vznikal: rozepsané verze, poznámky, zdroje.
Pro vaši práci se tak nemění nic. Píšete dál, jen s vědomím, že text, který prošel modelem, si tu stopu nese s sebou. Podepsaný pod ním jste pořád vy.
Tenhle týden je mimochodem pěkná ukázka toho, jak to kolem AI chodí: hromada obsahu, minimum ověřených faktů. Vyznat se v tom a hlavně AI opravdu používat učím v kurzu AI First. Konkrétní postupy, jak pomocí vibe codingu stavět weby a aplikace, nastavovat analytiku nebo řídit marketingové kanály.