Budúce modely Claude dostanú neviditeľný textový vodoznak SynthID-Text
Anthropic plánuje v budúcich modeloch Claude globálne nasadiť štatistický vodoznak odvodený od SynthID-Text a neskôr sprístupniť detekčné API. Značka nemá identifikovať používateľa, no pri krátkom, faktografickom, preloženom alebo dôkladne prepísanom texte môže byť jej detekcia neistá.
Za text zodpovedá Redakcia AI Feed. Zodpovedný editor: Marek Považský. Ako používame AI.
- Typ zdroja
- Oficiálny zdroj
- Zdroj / autorita
- Anthropic
Ako vznikol tento text
Redakcia spracovala verejné podklady do slovenského kontextu. Za výber, pravidlá kvality a prípadné opravy zodpovedá Marek Považský.
Text je zaradený v sekcii AI novinky a opiera sa o 4 zdroje. Konkrétne odkazy sú uvedené pod článkom; podrobnosti o AI postupe vysvetľuje metodika redakcie.
Čo Anthropic skutočne zavádza
Anthropic oznámil, že budúce modely Claude budú pri generovaní textu vytvárať štatisticky detegovateľný vodoznak. Nejde o viditeľnú poznámku, skryté znaky ani metadáta pripojené k dokumentu. Vzor vznikne priamo počas výberu ďalších tokenov a človek ho pri bežnom čítaní nemá rozpoznať. Firma ho chce pri spustení používať globálne, pretože podľa vlastného vysvetlenia zatiaľ nemá trvalý spôsob, ako funkciu spoľahlivo obmedziť iba na Európsku úniu. Anthropic zároveň pracuje na doplnení označovania do starších modelov uvedených pred 2. augustom 2026, pri ktorých sa podľa firmy uplatňuje prechodné obdobie.
Oproti prvému stručnému oznámeniu sú dôležité najmä prevádzkové podrobnosti. Anthropic pripravuje detekčné API, ale ešte nezverejnil termín, prístupové pravidlá, cenový model ani prahy, pri ktorých detektor označí výsledok za dostatočne presvedčivý. Vodoznak nebude obsahovať identifikátor účtu, organizácie alebo konkrétnej konverzácie. Pozitívny výsledok má preto znamenať iba to, že Claude sa pravdepodobne podieľal na vzniku alebo výraznej úprave textu. Nemá dokazovať, kto model použil, komu text patrí ani či jeho použitie porušilo školské, pracovné alebo publikačné pravidlá.
Pri podporovaných obrazových a ďalších súboroch plánuje Anthropic odlišný mechanizmus. Súbor vo formáte ako PNG, JPG alebo SVG môže dostať kryptograficky podpísaný záznam C2PA v metadátach. Takýto záznam je čitateľný kompatibilnými nástrojmi, no môže sa stratiť pri odstránení metadát alebo pri niektorých spôsoboch ďalšieho spracovania. Textový SynthID-Text je naproti tomu zakódovaný vo voľbách modelu počas generovania. Tieto dve techniky preto nemožno zamieňať: jedna opisuje pôvod súboru prostredníctvom pripojeného záznamu, druhá hľadá pravdepodobnostný vzor v samotnej sekvencii slov.
Ako sa značka dostane do viet
Jazykový model pri každom kroku vyhodnocuje viac možných pokračovaní. Ak sú viaceré slová obsahovo porovnateľné, generátor môže ich výber mierne usmerniť pomocou tajného kľúča a predchádzajúceho kontextu. V dlhšom texte sa tak nazbiera vzor, ktorý vie detektor so zodpovedajúcou konfiguráciou štatisticky vyhodnotiť. Google opisuje SynthID-Text ako procesor logitov aplikovaný v generovacom reťazci; nevyžaduje dodatočný tréning modelu. Anthropic tvrdí, že jeho implementácia nepridáva tokeny, má zanedbateľný vplyv na rýchlosť a nemení cenu používania Claude.
Tvrdenie o nezmenenej kvalite sa opiera o interné testy Anthropicu a o pôvodný výskum Google DeepMind. Google pri experimente s produkčnou prevádzkou Gemini nezaznamenal štatisticky významný rozdiel v používateľských hodnoteniach medzi označenými a neoznačenými odpoveďami; podobný výsledok prinieslo aj porovnávanie ľudskými hodnotiteľmi. To je podstatný signál, nie však záruka pre každý jazyk, model a typ úlohy. Anthropic zatiaľ nezverejnil samostatné výsledky podľa jazykov ani podrobné merania pre slovenčinu, preto sa nedá overiť, či bude pomer medzi kvalitou a detegovateľnosťou rovnaký aj pri textoch s menším množstvom tréningových dát.
Systém zámerne nemá zasahovať tam, kde je správna voľba úzka alebo jednoznačná. Pri dátume, názve, matematickom výsledku či syntakticky záväznom kúsku kódu zostáva málo rovnocenných tokenov, do ktorých by sa dal vzor vložiť bez rizika chyby. Preto býva vodoznak redší vo faktografických odpovediach a v zdrojovom kóde, hoci pri komentároch alebo ľubovoľných názvoch môže priestor vzniknúť. Rovnaký problém sa objaví pri krátkych odpovediach: niekoľko viet neposkytne detektoru dosť pozorovaní na istý záver.
Detekcia nie je dôkaz autorstva
Google vo svojej dokumentácii uvádza tri možné výsledky detektora: označený text, neoznačený text a neistý výsledok. Konkrétne prahy ovplyvňujú mieru falošne pozitívnych aj falošne negatívnych nálezov. Organizácia preto nemôže zvoliť „maximálnu citlivosť“ bez následkov; zachytenie väčšieho počtu označených textov môže zároveň zvýšiť riziko nesprávneho podozrenia. Anthropic navyše používa vlastnú verziu techniky a vlastný kľúč. Detektor Claude tak automaticky nerozpozná text z Gemini, iného modelu ani zo staršej verzie Claude bez aktívneho vodoznaku.
Odolnosť značky má tiež hranice. Mierne úpravy, skrátenie alebo výmena niekoľkých slov nemusia signál úplne odstrániť, dôkladné preformulovanie ho však môže výrazne oslabiť. Google upozorňuje, že detekčné skóre môže klesnúť aj po preklade už vytvoreného textu. To nie je v rozpore s tvrdením Anthropicu, že preklad priamo vygenerovaný Claude bude označený: v prvom prípade ďalší proces mení už označenú sekvenciu, v druhom Claude od začiatku vyberá všetky slová cieľového textu. Pri jazykových korektúrach ľudského textu môže byť zásah modelu taký malý, že značka nebude prakticky zistiteľná.
Pre školy a zamestnávateľov z toho vyplýva, že výsledok detektora nemá byť jediným podkladom disciplinárneho rozhodnutia. Pozitívny nález nerozlíši kompletné napísanie od rozsiahlej redakčnej úpravy a negatívny nález nepotvrdzuje ľudské autorstvo. Text mohol vytvoriť iný model, vzniknúť v staršej verzii Claude alebo prejsť úpravou, ktorá vzor potlačila. Rozumnejší postup kombinuje pravidlá prípustného používania AI, dokumentovanie pracovného procesu, verzie textu a možnosť, aby dotknutý človek výsledok spochybnil.
Európsky a slovenský význam
Anthropic zavedenie spája s európskym AI Actom a s Kódexom postupov pre transparentnosť obsahu generovaného AI, ku ktorému sa podľa firmy pripojil spolu s ďalšími poskytovateľmi. Praktický význam pre slovenské médiá, školy, úrady a podniky nebude spočívať iba v dostupnosti technológie, ale najmä v pravidlách jej používania. Inštitúcie si budú musieť určiť, kto smie posielať interné alebo osobné údaje do detekčného API, ako dlho sa výsledky uchovávajú a kto môže rozhodovať o následkoch neistého nálezu. Pri verejnom obstarávaní AI služieb bude užitočné pýtať sa aj na podporované jazyky, chybovosť a auditovateľnosť detekcie.
Otvorené zostávajú presné parametre nasadenia, nezávislé testy slovenčiny, dostupnosť detektora a interoperabilita medzi poskytovateľmi. Google sprístupnil referenčnú implementáciu SynthID-Text a podporu v knižnici Transformers, no konfigurácia a kľúč majú zostať chránené; verejne známy kľúč by umožnil značku napodobňovať. Vodoznaky preto môžu byť užitočnou vrstvou transparentnosti vo veľkom meradle, nie univerzálnym testom pravdy. Neoveria faktickú správnosť textu, nevyriešia plagiátorstvo a samy neurčia autora ani právnu zodpovednosť.
Zdroje