Guvernul SUA obligă Anthropic să dezactiveze cele mai avansate modele AI, la doar trei zile după lansare

Andrei Negrescu Andrei Negrescu
6 min citire
Fable 5
Publicitate

Compania americană Anthropic a fost forțată să blocheze accesul la cele mai performante modele de inteligență artificială pe care le-a creat vreodată — Claude Fable 5 și Claude Mythos 5. Decizia vine în urma unei directive de control al exporturilor emise de guvernul Statelor Unite, invocând motive de securitate națională. Modelele fuseseră lansate public cu doar trei zile înainte. Ce s-a întâmplat, de fapt?

Publicitate

Departamentul Comerțului a instruit Anthropic să suspende accesul la Fable 5 și Mythos 5 pentru orice cetățean din afara SUA, lucru pe care compania a declarat că îl poate respecta doar dezactivând complet ambele modele. Directiva face parte dintr-o acțiune a administrației Trump, menită să blocheze accesul cetățenilor străini la aceste sisteme avansate.

Într-o postare pe rețeaua X, Anthropic a confirmat că s-a conformat ordinului, dar a transmis clar că consideră decizia guvernului greșită. Directiva, primită vineri la ora 17:21 (ora New York-ului), obligă compania să dezactiveze ambele modele pentru toți utilizatorii din lume — nu doar pentru cetățenii străini la care se referea, nominal, ordinul de control al exporturilor. Accesul la celelalte modele Claude ale companiei, inclusiv Claude Opus 4.8, nu a fost afectat.

Cine sunt Fable 5 și Mythos 5?

Anthropic a lansat Fable 5 și Mythos 5 marți, prezentându-le drept cele mai puternice sisteme de inteligență artificială create vreodată de companie. Mythos este, conform descrierii companiei, modelul cel mai capabil al Anthropic, previzualizat încă din aprilie și ținut sub control strict din cauza capacității sale excepționale de a identifica vulnerabilități de securitate în cod software.

Fable 5, lansat cu doar trei zile înainte de interdicție, reprezenta răspunsul Anthropic la presiunea comercială evidentă: o versiune a lui Mythos echipată cu mecanisme de protecție care blochează răspunsurile în zone cu risc ridicat, precum securitatea cibernetică și biologia, fiind astfel considerat suficient de sigur pentru lansare publică. La momentul lansării, Fable 5 a devenit imediat cel mai performant model AI disponibil publicului, conform testelor de referință realizate de compania Vals AI, specializată în evaluarea performanței sistemelor de inteligență artificială.

Anthropic a recunoscut public dezvoltarea lui Mythos abia ulterior, declarând că modelul prezintă riscuri semnificative pentru securitatea cibernetică. Compania a precizat inițial că nu intenționează să lanseze Mythos pentru publicul larg, lansând în schimb Project Glasswing — un consorțiu de companii care folosesc Mythos pentru a identifica și remedia vulnerabilități software.

Fable 5
Anthropic

De ce a intervenit guvernul american?

Compania a precizat că nu a primit detalii specifice despre natura îngrijorării de securitate națională invocate de autorități. Potrivit explicațiilor Anthropic, motivul real ar fi descoperirea unei metode prin care mecanismele de protecție ale lui Fable 5 ar putea fi eludate — practică cunoscută în industrie sub numele de „jailbreaking”.

Publicitate

Compania a declarat că a analizat o demonstrație a acestei tehnici, folosită pentru a identifica un număr mic de vulnerabilități minore, deja cunoscute anterior. Aceste vulnerabilități par relativ simple, iar Anthropic afirmă că pot fi descoperite și de alte modele disponibile public, fără a fi nevoie de vreo metodă de eludare.

Cum se apără Anthropic?

În declarația oficială publicată pe propriul site, compania a explicat pe larg strategia de protecție adoptată pentru Fable 5. Potrivit Anthropic, în săptămânile premergătoare lansării, compania a colaborat cu guvernul american, cu Institutul Britanic pentru Siguranța AI (UK AISI), precum și cu mai multe organizații private terțe și echipe interne, pentru a testa timp de mii de ore mecanismele de protecție ale modelului.

Testele au demonstrat că protecțiile lui Fable 5 sunt semnificativ mai eficiente decât cele ale oricărui model lansat anterior, iar niciun tester nu a reușit până acum să găsească un „jailbreak universal” — o metodă care să elimine pe scară largă toate barierele de siguranță ale modelului, deblocând o gamă vastă de capacități cibernetice periculoase.

Compania admite, totuși, că nu există protecție perfectă. Anthropic susține că rezistența perfectă la jailbreak nu este posibilă, în prezent, pentru niciun furnizor de modele AI, iar fiecare mecanism de protecție folosit în industrie este vulnerabil la jailbreak-uri „neuniversale”, care pot extrage anumite informații cibernetice în circumstanțe specifice. De aceea, compania a adoptat o strategie de „apărare în profunzime” pentru Fable 5 — combinând bariere de siguranță cu o monitorizare riguroasă, menită să detecteze și să blocheze rapid orice atac reușit.

Publicitate

Această strategie a fost motivul pentru care Anthropic a impus o politică de retenție a datelor clienților timp de 30 de zile pentru modelele din clasa Mythos — o schimbare cu costuri reale pentru relațiile cu clienții, dar care permite cercetarea și remedierea metodelor de jailbreak.

Cât de gravă a fost, de fapt, vulnerabilitatea descoperită?

Potrivit Anthropic, ceea ce guvernul a prezentat drept o amenințare de securitate națională ar fi, în realitate, o problemă minoră. Compania afirmă că, până în prezent, guvernul i-a oferit doar dovezi verbale ale unui posibil jailbreak îngust, neuniversal, care constă, în esență, în a cere modelului să citească un anumit cod sursă și să remedieze eventualele defecte software.

Anthropic susține că a analizat un raport considerat baza directivei guvernamentale și a constatat că nivelul de capacitate demonstrat acolo este disponibil pe scară largă și la alte modele — inclusiv GPT-5.5 de la OpenAI — și este folosit zilnic de specialiștii care protejează sistemele informatice.

Anthropic critică decizia guvernului

Compania nu și-a ascuns nemulțumirea față de modul în care a fost gestionată situația. Anthropic afirmă că nu a primit nici măcar o sesizare privind un posibil jailbreak neuniversal care să fi condus la un rezultat efectiv dăunător — potențialele jailbreak-uri raportate fiind, fie răspunsuri complet benigne, fie descoperiri minore, fără relevanță specifică pentru capacitățile lui Mythos. Anthropic
Compania se conformează directivei legale a guvernului și elimină accesul la Fable 5 și Mythos 5 pentru toți utilizatorii, dar nu este de acord că descoperirea unui posibil jailbreak îngust ar trebui să justifice retragerea unui model comercial folosit de sute de milioane de oameni. Dacă acest standard ar fi aplicat la nivelul întregii industrii, Anthropic crede că ar bloca practic toate lansările viitoare de modele AI de ultimă generație, din partea tuturor furnizorilor.

Publicitate

Anthropic a declarat că susține ideea conform căreia guvernul ar trebui să poată bloca implementări nesigure de inteligență artificială, dar printr-un proces statutar transparent, corect, clar și fundamentat pe fapte tehnice. Compania consideră că acțiunea actuală nu respectă aceste principii. Anthropic

„Ne scuzăm pentru această perturbare a serviciilor pentru clienții noștri. Credem că este vorba despre o neînțelegere și lucrăm pentru a restabili accesul cât mai rapid posibil”, a transmis compania.

Ultimele Știri

Descoperă mai multe

Articole selectate pentru tine

Se încarcă...