Spoločnosť Anthropic sa rozhodla zaviesť novú bezpečnostnú politiku, v rámci ktorej začala označovať textové výstupy svojho modelu Claude vodoznakom. Háčik je v tom, že tento vodoznak nevidno voľným okom. Ide o skrytý kód, ktorý je vložený priamo do vygenerovaného textu. Ten, ako asi tušíte, dokáže prostredníctvom počítačových systémov odhaliť, že daný obsah bol vytvorený umelou inteligenciou.
Anthropic týmto krokom reaguje na Európsky akt o umelej inteligencii a jeho Kódex transparentnosti, ktorý tech firmám ukladá povinnosť jasne označovať AI obsah, informuje TechCrunch. Kým európski regulátori sú s týmto krokom spokojní, časť používateľov ostro nesúhlasí. Dôvod je asi každému jasný. Koniec koncov, naznačili sme ho už v nadpise.
Vlnu “hejtu” odštartovali obavy z odhalenia
Na diskusnom fóre Reddit sa po oznámení novinky zdvihla obrovská vlna nespokojnosti. Jeden z používateľov označil nový systém za prehnaný nástroj, ktorý podľa neho zasiahne najmä bežných ľudí. Vo svojom príspevku tvrdil, že zatiaľ čo technicky zdatnejší jednotlivci dokážu vodoznaky obísť preformulovaním textu alebo tým, že výstup preženú cez iné AI nástroje, obyčajní používatelia takýmito vedomosťami či schopnosťami často nedisponujú. Ako príklady uviedol študenta upravujúceho odsek v referáte, novinára sumarizujúceho rozsiahly prepis či spisovateľa hľadajúceho synonymá.
Reakcie ostatných diskutujúcich však boli voči týmto obavám pomerne chladné. Viacerí poukázali na to, že priame kopírovanie umelo vygenerovaných textov, napríklad do novinárskych článkov či študentských prác, je neetické. S vodoznakom či bez neho, takto by sa postupovať jednoducho nemalo. Autorovi príspevku poradili, aby sa radšej zhlboka nadýchol, pričom niektorí si neodpustili poznámku, že dokonca aj samotný kritický príspevok vyzeral, akoby bol napísaný s pomocou Claude.
Ďalší z kritikov označil vodoznaky za neetické s argumentom, že hlavnú prácu pri zadaní vykonáva človek poskytnutím kontextu a inštrukcií, zatiaľ čo AI predstavuje len pomocný nástroj. Pýtal sa preto, prečo by si systém mal privlastňovať zásluhy za výsledok. Ostatní mu však oponovali s tým, že cieľom vodoznaku nie je prisvojovanie si autorstva, ale zabezpečenie detekcie AI obsahu, hlavne kvôli rizikám, ktoré môže nesprávne používanie generatívnych modelov predstavovať.

Hovoria aj o “irónii”
Medzi príspevkami sa však objavili aj kvalifikovanejšie výhrady, ktoré nespadali do roviny “len čisto hejt”. Jeden z diskutujúcich poukázal na iróniu celej situácie. Označovanie výstupov vodoznakom považuje za sporné najmä v kontexte toho, akým spôsobom samotné vývojárske firmy získavali trénovacie dáta pre svoje modely, keď vo veľkom spracovávali autorské diela z celého internetu.
Napriek hlasným protestom jednotlivcov sa však zdá, že väčšia časť používateľskej komunity označovanie AI obsahu podporuje a vníma ho ako rozumný krok na sledovanie umelo generovaného materiálu. Podľa tých, ktorí súhlasia, neexistuje logický dôvod proti transparentnosti. Sú toho názoru, že za bojkotom vodoznakov často nebýva nič iné, než snaha utajiť reálny pôvod textu či iného materiálu pred ostatnými.

