Anthropic adaugă filigran AI la tot ce generează Claude

Andrei Negrescu Andrei Negrescu
5 min citire
Claude Fable 5
Publicitate

Anthropic începe să aplice filigran AI pe tot ce produc modelele Claude, indiferent de țara în care se află utilizatorul. Textele primesc un filigran statistic invizibil, iar imaginile în formate acceptate primesc metadate semnate criptografic, care arată că fișierul a trecut prin Claude.

Publicitate

Măsura vine ca răspuns la o problemă care a scăpat de mult de sub control. O analiză Ahrefs din 2025, realizată pe aproximativ 900.000 de pagini web, a arătat că circa trei sferturi din paginile nou publicate conțin text scris parțial sau integral de o mașină. Iar cifra nu acoperă documentele offline și nici muzica, ilustrațiile, codul, fotografiile sau clipurile video generate automat.

Ce cere legislația europeană

Răspunsul Uniunii Europene la această situație este reglementarea. Articolul 50 alineatul 2 din Regulamentul european privind inteligența artificială obligă furnizorii de sisteme generative să facă tot conținutul produs detectabil ca fiind generat sau manipulat artificial.

Anthropic a semnat Codul de bune practici privind transparența conținutului generat de AI, alături de aproximativ 190 de alți semnatari, potrivit relatării publicate de New Atlas. Deși obligația este europeană, compania aplică marcarea la nivel global de la bun început, explicând că nu are încă o metodă durabilă de a o limita geografic.

Unde se aplică noul filigran AI

Marcarea acoperă rezultatele modelelor compatibile în tot ecosistemul companiei: interfața de programare a platformei Claude, aplicațiile Claude, Claude Code, Claude Cowork și Claude Tag. Se extinde și la produsele dezvoltate de terți pe baza acestui API, pentru simplul motiv că filigranul călătorește în interiorul conținutului, nu în interfața prin care a fost obținut.

Modelele lansate începând cu 2 august 2026 au suportul activ de la lansare, iar cele mai vechi vor fi actualizate în lunile următoare, în cadrul perioadei de tranziție pe care legislația europeană o permite.

Imagine conceptuală despre inteligența artificială generativă și filigran AI pentru conținutul generat automat
Conținutul generat de AI devine tot mai greu de deosebit de cel scris de oameni, de aici și presiunea pentru filigranare. Foto: Jernej Furman / Wikimedia Commons, licență CC BY 2.0.

Cum funcționează marcarea textului

Pentru text, Anthropic folosește o variantă a metodei SynthID-Text, dezvoltată de Google DeepMind. Nu este vorba despre caractere ascunse sau despre metadate atașate documentului. Filigranul se naște din alegerea cuvintelor.

Publicitate

Când generează text, un model lingvistic mare selectează fiecare cuvânt următor dintr-un set de variante plauzibile. În multe situații, mai multe cuvinte ar continua propoziția la fel de bine, iar alegerea se face în mod normal aleatoriu. Cu filigranarea de tip SynthID, o cheie secretă și textul anterior influențează această alegere. Pe parcursul a suficiente cuvinte, micile decizii se adună într-un model statistic detectabil.

Textul se citește la fel de natural, dar poartă o semnătură pe care un detector cu cheia potrivită o poate verifica. Compania susține că metoda nu adaugă niciun caracter, nu consumă tokeni suplimentari, nu schimbă calitatea răspunsului și nu conține nimic care să identifice utilizatorul, organizația sau conversația.

Pentru imagini, standardul C2PA

La fișiere, abordarea este mai convențională. Când Claude generează un PNG, un JPG sau un SVG, atașează în metadatele fișierului o notă semnată criptografic, conform standardului deschis C2PA. Imaginea în sine rămâne neatinsă.

Acreditarea consemnează faptul că fișierul a fost creat sau procesat de Claude și nu include date personale. Orice aplicație compatibilă cu C2PA poate citi informația, iar pentru că este semnată criptografic, poate arăta și dacă fișierul sau acreditarea au fost modificate ulterior.

Publicitate

Partea slabă: detecția și rescrierea

Anthropic a rezolvat marcarea, dar nu și verificarea. O interfață de programare dedicată detectării filigranului este anunțată, însă modul exact de funcționare nu a fost stabilit. Pentru fișiere, orice instrument compatibil cu C2PA poate citi acreditările, iar compania promite un verificator propriu.

Mai important, compania recunoaște că aceste marcaje sunt semnale, nu dovezi. Un filigran detectat arată doar că Claude a fost probabil implicat la un moment dat, nu că textul nu a fost scris de un om. Pentru că filigranul se atașează oricăror cuvinte alese de model, Anthropic admite că nu poate face distincția între „Claude a scris asta” și „Claude a editat masiv asta”, iar o traducere realizată de model este integral filigranată, fiindcă fiecare cuvânt este alegerea lui.

Pe partea de detecție, limitarea este și mai directă. Editările mici probabil nu elimină complet semnătura, dar, în formularea companiei, „o rescriere completă, în care fiecare cuvânt este înlocuit, o va face”. Momentul acela, argumentează Anthropic, este oricum punctul în care textul nu mai poate fi considerat generat de AI. Practic, cine vrea să ascundă implicarea modelului poate rescrie substanțial rezultatul.

Contextul mai larg

Subiectul nu e nou pentru cititorii noștri: am detaliat anterior mecanismul filigranului din textele scrise de Claude și am scris despre faptul că regula de filigranare din AI Act poate fi ocolită cerându-i altui model să rescrie textul. Documentația tehnică oficială este publicată pe site-ul Anthropic.

Publicitate

Ultimele Știri

Descoperă mai multe

Articole selectate pentru tine

Se încarcă...