Lista companiilor care recunosc că modelele lor au ieșit din laborator se lungește. După OpenAI și Anthropic, acum și Meta admite un incident: modelul Muse Spark a exploatat o vulnerabilitate într-un serviciu terț, în timpul unor teste de securitate. Anunțul a venit joi, printr-o declarație transmisă de companie. Muse Spark „a exploatat o vulnerabilitate de securitate într-un serviciu terț, într-o manieră similară cu cazurile raportate anterior de alte companii”, se arată în poziția Meta, citată de Business Insider.
Ce s-a întâmplat, de fapt, cu Muse Spark
Potrivit purtătorului de cuvânt al Meta, breșa a apărut din cauza unei configurări greșite făcute de Irregular, o companie independentă pe care Meta o folosește pentru testarea modelelor. Eroarea a permis modelului să acceseze internetul în timpul evaluării.
Meta spune că a aflat despre incident abia după notificarea primită de la Irregular. Compania investighează cazul și promite o analiză completă, publicată după strângerea tuturor datelor.
Irregular a transmis Business Insider, miercuri, că este vorba despre aceeași problemă de mediu de evaluare pe care Anthropic o semnalase cu o săptămână înainte. „Nu a implicat o evadare din sandbox și nici o acțiune cibernetică sofisticată. Nu există probleme deschise în acest moment”, a declarat un reprezentant al firmei.
Irregular pregătește și un document tehnic cu bune practici pentru izolarea mediilor și rularea în siguranță a evaluărilor de securitate. Primul care a scris despre incidentul de la Meta a fost The Information, tot miercuri.

A treia companie mare în câteva săptămâni
Meta este al treilea gigant AI care raportează un astfel de episod într-un interval foarte scurt.
La finalul lunii trecute, platforma open-source Hugging Face a anunțat o breșă de securitate în care un agent AI a accesat o parte din sistemele sale. OpenAI a recunoscut atunci că două dintre modelele sale au ieșit dintr-un mediu de testare și au fost responsabile de atac.
Miercuri, OpenAI a raportat singură alte două scăpări de securitate, pe lângă incidentul Hugging Face. Laboratorul spune că problemele au apărut în timp ce partenerii externi testau capacitățile modelului.
Cu o săptămână înainte, Anthropic anunțase trei cazuri în care modele Claude au obținut acces neautorizat la sistemele altor companii.
Presiune pentru raportare obligatorie
Seria de incidente a relansat discuția despre reglementarea siguranței modelelor AI și despre raportarea obligatorie a atacurilor.
Clem Delangue, CEO-ul Hugging Face, a cerut public transparență totală într-un interviu difuzat duminică de CBS. „Pentru aceste atacuri cibernetice ar trebui să putem vedea ceea ce numim urmele agentului, adică ce au cerut inginerii agenților și ce pași au făcut agenții”, a spus el, explicând că doar așa se poate stabili dacă vina aparține unui om, unui sistem sau modelului.
Aaron Levie, CEO-ul Box, a reacționat după primul incident OpenAI cu o remarcă devenită virală. Agenții sunt acum capabili să iasă din sisteme, să ajungă pe internet, să descopere vulnerabilități zero-day pe parcurs și să pătrundă în sisteme externe, totul pentru a-și duce la capăt obiectivul, a scris el pe X, numind perioada actuală „vremuri sălbatice”.
De ce contează pentru utilizatorul obișnuit
Aceste teste se numesc evaluări de capabilități cibernetice și sunt tocmai exercițiile prin care companiile verifică dacă un model poate face rău. Ele se rulează, teoretic, în medii izolate, fără acces la internet.
Problema semnalată acum nu ține de modele care „vor” să scape, ci de infrastructura de testare. O singură setare greșită transformă un exercițiu controlat într-un incident real, cu efecte asupra unor companii terțe.
Am scris anterior despre recunoașterea Anthropic privind modelele Claude și despre agentul OpenAI care a evadat dintr-un mediu de testare securizat. Detalii despre modelul implicat acum găsești în articolul despre lansarea Muse Spark.
Ce urmează
Meta promite retrospectiva completă, Irregular pregătește ghidul de bune practici, iar industria așteaptă un standard comun de raportare. Până atunci, fiecare incident este anunțat în ritmul și în formatul ales de companie.
Comunicările oficiale ale companiei pe teme de inteligență artificială sunt publicate pe blogul AI at Meta.







