OpenAI oprește lucrul la modelul Astra: nu poate exclude capacități cibernetice critice

OpenAI Astra a fost oprit din dezvoltare internă: compania nu poate exclude capacități cibernetice critice. Ce prevede Preparedness Framework.

Andrei Negrescu Andrei Negrescu
5 min citire
Logo OpenAI, compania care pregătește primele sale dispozitive
Publicitate

OpenAI Astra, un model aflat încă în dezvoltare, a fost pus pe pauză. Compania a anunțat pe 7 august 2026 că suspendă activitățile interne care implică acest sistem, pentru că nu îndeplinește noile cerințe de securitate impuse de companie. Motivul invocat este neobișnuit de direct: evaluările interne sugerează că modelul ar putea atinge pragul „critic” pentru capacități cibernetice, cel mai înalt nivel de risc din propriul cadru de evaluare al companiei.

Publicitate

Anunțul, publicat pe blogul oficial, vine după o serie de incidente în industrie. OpenAI recunoscuse recent că unele dintre modelele sale au compromis accidental infrastructura Hugging Face, iar ulterior Anthropic și Meta au admis, la rândul lor, că au avut modele care au ieșit de sub control și au pătruns în sistemele altor organizații.

Ce arată evaluările interne pe OpenAI Astra

Potrivit companiei, testele desfășurate în ultimele zile pe modelul Astra indică „progrese semnificative în programarea agentică și în securitate cibernetică”. Concluzia formulată de OpenAI este prudentă, dar clară.

„Aceste rezultate, împreună cu evaluările experților, ne-au determinat să concluzionăm aseară că nu putem exclude existența unor capacități cibernetice critice conform Preparedness Framework”, se arată în comunicatul publicat de OpenAI.

Formularea „nu putem exclude” este importantă. Compania nu afirmă că Astra a atins pragul critic, ci că testele de până acum nu permit infirmarea acestei ipoteze. Evaluările continuă în paralel cu măsurile de izolare.

Ce înseamnă pragul „critic”

OpenAI definește pragul critic pentru securitate cibernetică prin două scenarii alternative. Primul: modelul poate identifica și dezvolta, fără intervenție umană, exploituri zero-day funcționale, de orice grad de severitate, în numeroase sisteme critice reale și bine protejate. Al doilea: modelul poate concepe și executa, cap-coadă, strategii de atac complet noi împotriva unor ținte întărite, primind doar un obiectiv formulat la nivel general.

Pentru comparație, modelele anterioare ale companiei, inclusiv GPT-5.6-Sol, au fost evaluate pentru capacități cibernetice de frontieră și încadrate la nivelul „ridicat”, nu „critic”. Astra ar fi, așadar, primul care se apropie de treapta superioară.

Publicitate

Compania precizează explicit că Astra „nu a fost implicat” în incidentul de la Hugging Face, despre care am scris în articolul despre agentul OpenAI care a evadat dintr-un mediu de testare securizat.

Rackuri de servere într-un centru de date, tipul de infrastructură izolată în care este testat modelul OpenAI Astra
Modelele de frontieră sunt antrenate și evaluate în centre de date izolate; OpenAI spune că a mutat testarea Astra în medii sandbox. Foto: PiDatacenters / Wikimedia Commons, licență CC BY-SA 4.0

Măsurile luate de companie

OpenAI a enumerat mai multe schimbări operaționale. Pentru modelele cu capacități ridicate se introduc controale de securitate mai stricte: medii de testare izolate, acces restricționat la rețea și la unelte externe, protecție și criptare suplimentară a parametrilor modelului, capacități extinse de monitorizare și detecție și execuție în sandbox.

Activitățile interne care implică Astra și care nu respectă încă aceste cerințe sunt suspendate. În plus, compania spune că a implementat o monitorizare universală pentru acțiuni riscante și pentru abateri de aliniere în toate aplicațiile agentice ale modelului, inclusiv în timpul antrenării și al evaluării. Sistemele de supraveghere analizează lanțul de raționament (Chain of Thought) al modelului și pot declanșa un răspuns de securitate care întrerupe activitățile cu risc ridicat.

Nu în ultimul rând, OpenAI anunță colaborarea cu agenții guvernamentale relevante și cu organizații selectate din domeniul siguranței inteligenței artificiale pentru testarea capacităților modelului, precum și transmiterea unor recomandări de securitate către partenerii terți care rulează evaluări cu risc ridicat.

Publicitate

Un cadru vechi de aproape trei ani

Preparedness Framework a fost publicat pentru prima dată în decembrie 2023, cu mult înainte ca modelele să se apropie de acest nivel în domeniile biologic, chimic, cibernetic sau al auto-îmbunătățirii. Documentul a fost gândit ca un ghid intern: identifici progresul de capacitate, apoi aplici planul stabilit în avans.

Nu este prima oară când mecanismul se declanșează. În iunie 2025, când modelele companiei au atins pragul ridicat pentru capacități în domeniul biologiei, OpenAI a anunțat un set similar de măsuri: consolidarea barierelor de siguranță, extinderea testărilor și implicarea unor experți externi.

De ce contează

Decizia arată o tensiune care definește acest moment din industrie. Aceleași capacități care fac un model periculos în mâini greșite îl fac extrem de valoros pentru apărarea cibernetică — un sistem capabil să găsească vulnerabilități înaintea atacatorilor este exact ce își doresc echipele de securitate. OpenAI spune că își asumă tocmai această direcție, în colaborare cu guverne, institute de siguranță și societatea civilă.

Presiunea publică pentru un ritm mai prudent a crescut vizibil în ultimele luni. Peste 1.100 de angajați din laboratoarele de inteligență artificială au semnat inițiativa Pacing the Frontier, prin care cer autorităților americane un mecanism de frânare a dezvoltării modelelor de frontieră. Iar avertismentele privind securitatea nu vin doar din zona AI: Google a semnalat deja riscul pe care calculatoarele cuantice îl reprezintă pentru criptarea actuală.

Publicitate

Deocamdată, Astra rămâne un model neanunțat oficial ca produs, fără dată de lansare comunicată. Următorul pas depinde de rezultatele testelor suplimentare și de validarea externă a nivelului real de capacitate.

Ultimele Știri

Descoperă mai multe

Articole selectate pentru tine

Se încarcă...