Watermarking u Claude Code je tu

Sdílet

AI vodoznak Autor: Root.cz s použitím ChatGPT

Anthropic začal do textových výstupů Claude zavádět strojově detekovatelný watermark. Týká se i výstupů z API a Claude Code. Nejde o metadata ani skryté Unicode znaky – značka vzniká přímo při generování textu a je rozprostřena ve statistických vlastnostech posloupnosti tokenů. Watermark neobsahuje identifikaci uživatele, organizace ani konkrétní konverzace. Jeho zavádění souvisí s požadavky evropského AI Actu.

Claude používá variantu technologie SynthID-Text od Google DeepMind, jejíž princip byl publikován v Nature. SynthID-Text používá tzv. Tournament sampling: z kandidátních tokenů vzorkovaných podle původního pravděpodobnostního rozdělení modelu vybírá pomocí pseudonáhodných funkcí odvozených od watermarkovacího klíče a předchozího kontextu. Tím do posloupnosti vloží statistický signál, který lze se znalostí klíče detekovat. Podle Anthropicu funguje detekce lépe u delších a kreativnějších textů, zatímco u krátkých odpovědí, faktických pasáží a zdrojového kódu je signál slabší. Výraznější přeformulování může watermark odstranit.

(zdroj: slashdot)

Tato zprávička byla zaslána čtenářem serveru Root.cz pomocí formuláře Přidat zprávičku. Děkujeme!

Našli jste v článku chybu?

Autor zprávičky