Budoucí modely Claude budou do generovaných textů přidávat neviditelný vzorec. Ten má pomoci určit, zda se na jejich vytvoření podílela umělá inteligence. Označení nebude obsahovat údaje o konkrétním uživateli ani o jeho konverzaci.
Společnost Anthropic oznámila, že vodoznak zavede do budoucích modelů Claude. Postupně jej chce přidat také do starších verzí. Změna se bude týkat všech uživatelů, nejen těch v Evropské unii.
Firma tím reaguje na evropský akt o umělé inteligenci. Povinnost označovat obsah vytvořený pomocí AI začala platit 2. srpna. K příslušnému kodexu se připojilo přibližně 190 organizací, mezi nimi také Google, Meta, Microsoft, OpenAI nebo Mistral.
Jak bude vodoznak v textech Claude fungovat
Claude nebude do odpovědí vkládat skryté znaky ani zvláštní značky. Vodoznak vznikne prostřednictvím drobných změn při výběru slov. Pokud má model k dispozici několik výrazů se stejným významem, zvolí jeden z nich podle předem stanoveného vzorce.
Výsledný text se proto nemá lišit kvalitou, obsahem ani čitelností. Označení také nezvýší počet použitých tokenů a nemá zpomalit generování odpovědí. Vodoznak nepůjde spojit s konkrétním účtem, firmou nebo jednotlivým chatem.
Společnost zároveň upřesnila, že lehké úpravy pravděpodobně celý vzorec neodstraní. Úplné přepsání textu už jej ale zničit může. Kontrola bude méně spolehlivá také u krátkých nebo převážně faktických pasáží, ve kterých má model omezený prostor pro volbu slov.
Claude připraví nástroj pro kontrolu textů
Anthropic plánuje zpřístupnit rozhraní, přes které půjde vodoznak ověřit. Výsledek však nebude definitivním důkazem autorství. Systém pouze vyhodnotí pravděpodobnost, že se Claude podílel na napsání nebo rozsáhlejší úpravě textu.
U programovacího kódu bude označení slabší, protože funkční zápis často neumožňuje volit mezi různými výrazy. Objevit se může například v komentářích. Překlady vytvořené Claudem naopak vodoznak obsahovat budou, protože model v jejich případě vybírá všechna slova.