Umělá inteligence společnosti Anthropic, známá jako Claude, učinila krok vpřed v oblasti transparentnosti obsahu. Společnost oznámila, že všechny modely vydané od 2. srpna budou do generovaného textu zahrnovat systém neviditelného značkování. Toto opatření, které bude zavedeno globálně, si klade za cíl sladit se s požadavky Evropské unie týkajícími se identifikace syntetického obsahu.
Hlavním cílem je, aby jakýkoli text vytvořený Claudem byl identifikovatelný jako takový, aniž by si uživatel všiml jakéhokoli rozdílu v kvalitě nebo čitelnosti. Vodoznak není viditelný pouhým okem, ale zůstává v textu vložený i při jeho kopírování a vkládání na jiné platformy. Tato iniciativa reaguje na Kodex osvědčených postupů pro transparentnost obsahu generovaného umělou inteligencí, který podepsalo více než 190 organizací, a na zákon EU o umělé inteligenci, který od srpna vyžaduje vodoznak pro tento typ obsahu.
Rozhodnutí společnosti Anthropic není náhodné. Evropské předpisy vyžadují, aby společnosti zabývající se umělou inteligencí označovaly syntetický obsah , aby jej uživatelé mohli odlišit od obsahu vytvořeného člověkem. Článek 50.2 zákona o umělé inteligenci stanoví, že poskytovatelé musí zajistit, aby výstupy jejich systémů byly označeny ve strojově čitelném formátu. Anthropic spolu s dalšími významnými technologickými společnostmi, jako jsou OpenAI, Google, Meta a Microsoft, tento kodex transparentnosti podepsala, ačkoli se společnosti jako xAI Elona Muska dosud nepřipojily.
Společnost vysvětlila, že vodoznak se provádí dvěma způsoby: pro obrázky a grafiku se používají metadata založená na standardu C2PA (Coalition for Content Provenance and Authenticity); pro text se používá neviditelný vodoznak, který je integrován do samotného procesu generování. Tento vodoznak nemění význam ani kvalitu odpovědí a je přenášen spolu s textem při jeho kopírování, exportu nebo sdílení prostřednictvím API.
Systém je založen na sekvenci tokenů generovaných modelem. Místo přidávání skrytých znaků nebo viditelných metadat je vodoznak kódován ve výběru slov, pokud je k dispozici několik stejně platných možností. Například pro frázi „obloha byla…“ by model mohl zvolit „zataženo“ nebo „šedá“. U vodoznaku tato volba není náhodná, ale spíše závisí na kryptografickém klíči a předcházejících slovech. Kdokoli, kdo klíč vlastní, tedy může statisticky určit, zda text vygeneroval Claude.
Tato metoda, která se již používá v jiných systémech, jako je například SynthID od Googlu, nepřidává do procesu ani náklady, ani latenci. Detekce vodoznaku není spolehlivá : pokud je text upraven, parafrázován, přeložen nebo smíchán s jiným obsahem, vodoznak může zmizet. Signál je navíc slabší ve velmi krátkých fragmentech nebo v kódu. Anthropic uznává, že absence vodoznaku neznamená, že obsah nebyl generován umělou inteligencí, a že přítomnost vodoznaku není rozhodující pro skutečné autorství.
Společnost upřesnila, že vodoznak se vztahuje na všechny modely vydané od 2. srpna a že starší modely budou aktualizaci dostávat postupně. Toto opatření je globální, nejen pro Evropu , a týká se všech produktů Claude, včetně API, Claude Code, Claude Cowork a platforem třetích stran, jako je infrastruktura AWS , Google Cloud a Microsoft Foundry. Veřejná detekce však zatím není k dispozici: Anthropic oznámil, že během několika týdnů vydá nástroj, který uživatelům a třetím stranám umožní zkontrolovat, zda text obsahuje vodoznak.
Dalším významným omezením je, že vodoznak neidentifikuje uživatele ani původní konverzaci. Také nerozlišuje, zda byl text vytvořen od nuly, nebo zda Claude pouze pomohl opravit, přeložit nebo shrnout existující obsah. To vyvolalo kritiku, protože evropské předpisy výslovně vylučují standardní editační úkoly, přesto Anthropic vodoznak používá na všechna použití. Navzdory těmto nedostatkům představuje toto opatření pokrok v boji proti dezinformacím a zneužívání umělé inteligence.
Rozhodnutí společnosti Anthropic je součástí širšího hnutí v tomto odvětví. OpenAI, Google, Meta, Microsoft a Mistral také podepsaly Kodex transparentnosti a zavádějí podobné systémy. Absence jednotného standardu a technická omezení však znamenají, že detekce není dokonalá. Například pořízení snímku obrazovky obrázku může odstranit metadata C2PA a úplné přepsání textu může smazat vodoznak.
Ve vzdělávacím a profesním prostředí by tyto nástroje pro označování mohly být užitečné pro identifikaci děl generovaných umělou inteligencí, ale odborníci varují, že nepředstavují definitivní řešení. Anthropic sám zdůrazňuje, že označení není důkazem autorství, ale spíše ukazatelem pravděpodobnosti. S vývojem technologie se pravděpodobně dočkáme robustnějších systémů, ale prozatím zůstává transparentnost výzvou.
Stručně řečeno, přidání neviditelných vodoznaků do Claude představuje důležitý krok k dodržování evropských předpisů a poskytování uživatelům více informací o původu obsahu. Přestože systém má svá omezení, je to významný krok správným směrem. Technologická komunita bude pozorně sledovat detekční nástroj, který Anthropic slibuje brzy spustit, a také to, jak se ostatní společnosti přizpůsobí této nové realitě.