Anthropic explică pe îndelete cum va funcționa filigranul din textele scrise de Claude

Andrei Negrescu Andrei Negrescu
4 min citire
Claude Fable 5
Publicitate

Filigranul Claude a devenit, în doar câteva zile, cel mai controversat subiect din comunitatea Anthropic. Compania a publicat vineri o postare pe blog în care încearcă să răspundă la întrebările de bază: cum funcționează marcarea, dacă poate fi ștearsă prin editare și ce se întâmplă cu codul scris de model.

Publicitate

De ce apare filigranul acum

Anthropic a anunțat la începutul acestei săptămâni că va marca textul generat de chatbotul său, pentru a se conforma Codului de transparență asociat regulamentului european privind inteligența artificială. Documentul cere companiilor din domeniu să implementeze sisteme prin care conținutul produs de modele să poată fi identificat ca atare.

Reacțiile din comunitate au fost dure. Pe Reddit, un utilizator a descris măsura drept o conspirație împotriva abonaților nevinovați, în timp ce altul a răspuns că singurul motiv pentru care cineva ar refuza marcarea este dorința de a-i minți pe alții. Publicația Business Insider relatează că zeci de utilizatori de pe X au anunțat că își anulează abonamentele Claude din acest motiv.

Cum funcționează, tehnic, filigranul Claude

Explicația companiei pornește de la observația că un model de limbaj are, în permanență, mai multe variante echivalente la dispoziție. Când trebuie să descrie o vreme mohorâtă, poate alege între mai multe sinonime, iar niciuna nu este mai corectă decât cealaltă. Exact în aceste decizii cu impact minim se ascunde semnătura: modelul construiește un tipar statistic în răspunsurile sale, un tipar despre care Anthropic spune că este „nedetectabil pentru cititor”, dar poate fi identificat de oricine deține cheia care îl codifică.

Compania insistă că marcarea nu degradează rezultatul. Un răspuns cu filigran ar fi, pentru un cititor, imposibil de deosebit de unul fără filigran.

Metoda folosită nu este inventată de la zero. Anthropic spune că adoptă abordarea SynthID-Text, descrisă în 2024 de echipa Google DeepMind, și că intenționează să lanseze un API public de detecție. Compania face și o distincție importantă față de detectoarele clasice de conținut AI, precum cele oferite de Pangram, care caută indicii stilistice în scriitură, de tipul construcției „nu este X, este Y”. Identificarea unor asemenea tipare este, spune Anthropic, complet diferită de verificarea unui filigran criptografic.

Sediul Comisiei Europene, sursa regulilor care au impus filigranul Claude
Regulamentul european privind inteligența artificială, negociat la Bruxelles, este motivul pentru care Anthropic introduce filigranul. Foto: Fred Romero / Wikimedia Commons, licență CC BY 2.0

Poate fi șters prin rescriere?

Aici răspunsul este nuanțat. Anthropic recunoaște că marcajul poate fi eliminat, dar spune că o editare superficială „probabil nu va îndepărta complet filigranul”, în timp ce o rescriere totală, în care fiecare cuvânt este înlocuit, îl va șterge. Compania adaugă o observație care schimbă discuția: în al doilea caz, este discutabil dacă textul mai poate fi numit generat de inteligența artificială.

Publicitate

Situația este similară pentru textele pe care Claude doar le corectează sau le editează. Prezența marcajului depinde de lungimea materialului și de cât de intens a intervenit modelul. Dacă intervenția a fost minoră, aproape toate cuvintele rămân ale autorului uman, deci filigranul nu are practic de ce să se prindă.

Ce se întâmplă cu codul

Programatorii pot respira ușurați. Codul are, structural, mult mai puțină libertate stilistică: modelul trebuie să producă instrucțiuni care funcționează, nu variante echivalente la nivel de exprimare. Prin urmare, semnătura se prinde mult mai slab. Anthropic precizează totuși că, acolo unde există o alegere arbitrară între termeni, de exemplu în comentariile din cod, marcajul poate fi folosit, dar cu un efect neglijabil asupra codului propriu-zis.

Nu va fi singurul chatbot marcat

Compania subliniază că Claude nu va fi o excepție: alți dezvoltatori importanți de modele au semnat același cod de bune practici și își vor implementa propriile filigrane. Cu alte cuvinte, marcarea textului generat automat devine standard în spațiul european, nu o particularitate a unui singur furnizor.

Rămâne, desigur, întrebarea deschisă a eficienței. Am arătat deja, într-un material anterior, că regula de filigranare din AI Act poate fi ocolită cerându-i altui model să reformuleze textul, ceea ce reduce marcajul la o măsură utilă mai ales în cazurile de bună-credință. Pentru context despre companie, merită citite și articolele despre lansarea Claude Opus 5 și despre sesiunile Cowork din Claude pentru Chrome.

Publicitate

Surse oficiale: blogul Anthropic și cadrul de reglementare AI al Comisiei Europene. Reacțiile utilizatorilor și detaliile din postare au fost relatate de TechCrunch.

Publicitate

Ultimele Știri

Descoperă mai multe

Articole selectate pentru tine

Se încarcă...