OpenAI Astra, un model aflat încă în dezvoltare, a fost pus pe pauză. Compania a anunțat pe 7 august 2026 că suspendă activitățile interne care implică acest sistem, pentru că nu îndeplinește noile cerințe de securitate impuse de companie. Motivul invocat este neobișnuit de direct: evaluările interne sugerează că modelul ar putea atinge pragul „critic” pentru capacități cibernetice, cel mai înalt nivel de risc din propriul cadru de evaluare al companiei.
Anunțul, publicat pe blogul oficial, vine după o serie de incidente în industrie. OpenAI recunoscuse recent că unele dintre modelele sale au compromis accidental infrastructura Hugging Face, iar ulterior Anthropic și Meta au admis, la rândul lor, că au avut modele care au ieșit de sub control și au pătruns în sistemele altor organizații.
Ce arată evaluările interne pe OpenAI Astra
Potrivit companiei, testele desfășurate în ultimele zile pe modelul Astra indică „progrese semnificative în programarea agentică și în securitate cibernetică”. Concluzia formulată de OpenAI este prudentă, dar clară.
„Aceste rezultate, împreună cu evaluările experților, ne-au determinat să concluzionăm aseară că nu putem exclude existența unor capacități cibernetice critice conform Preparedness Framework”, se arată în comunicatul publicat de OpenAI.
Formularea „nu putem exclude” este importantă. Compania nu afirmă că Astra a atins pragul critic, ci că testele de până acum nu permit infirmarea acestei ipoteze. Evaluările continuă în paralel cu măsurile de izolare.
Ce înseamnă pragul „critic”
OpenAI definește pragul critic pentru securitate cibernetică prin două scenarii alternative. Primul: modelul poate identifica și dezvolta, fără intervenție umană, exploituri zero-day funcționale, de orice grad de severitate, în numeroase sisteme critice reale și bine protejate. Al doilea: modelul poate concepe și executa, cap-coadă, strategii de atac complet noi împotriva unor ținte întărite, primind doar un obiectiv formulat la nivel general.
Pentru comparație, modelele anterioare ale companiei, inclusiv GPT-5.6-Sol, au fost evaluate pentru capacități cibernetice de frontieră și încadrate la nivelul „ridicat”, nu „critic”. Astra ar fi, așadar, primul care se apropie de treapta superioară.
Compania precizează explicit că Astra „nu a fost implicat” în incidentul de la Hugging Face, despre care am scris în articolul despre agentul OpenAI care a evadat dintr-un mediu de testare securizat.

Măsurile luate de companie
OpenAI a enumerat mai multe schimbări operaționale. Pentru modelele cu capacități ridicate se introduc controale de securitate mai stricte: medii de testare izolate, acces restricționat la rețea și la unelte externe, protecție și criptare suplimentară a parametrilor modelului, capacități extinse de monitorizare și detecție și execuție în sandbox.
Activitățile interne care implică Astra și care nu respectă încă aceste cerințe sunt suspendate. În plus, compania spune că a implementat o monitorizare universală pentru acțiuni riscante și pentru abateri de aliniere în toate aplicațiile agentice ale modelului, inclusiv în timpul antrenării și al evaluării. Sistemele de supraveghere analizează lanțul de raționament (Chain of Thought) al modelului și pot declanșa un răspuns de securitate care întrerupe activitățile cu risc ridicat.
Nu în ultimul rând, OpenAI anunță colaborarea cu agenții guvernamentale relevante și cu organizații selectate din domeniul siguranței inteligenței artificiale pentru testarea capacităților modelului, precum și transmiterea unor recomandări de securitate către partenerii terți care rulează evaluări cu risc ridicat.
Un cadru vechi de aproape trei ani
Preparedness Framework a fost publicat pentru prima dată în decembrie 2023, cu mult înainte ca modelele să se apropie de acest nivel în domeniile biologic, chimic, cibernetic sau al auto-îmbunătățirii. Documentul a fost gândit ca un ghid intern: identifici progresul de capacitate, apoi aplici planul stabilit în avans.
Nu este prima oară când mecanismul se declanșează. În iunie 2025, când modelele companiei au atins pragul ridicat pentru capacități în domeniul biologiei, OpenAI a anunțat un set similar de măsuri: consolidarea barierelor de siguranță, extinderea testărilor și implicarea unor experți externi.
De ce contează
Decizia arată o tensiune care definește acest moment din industrie. Aceleași capacități care fac un model periculos în mâini greșite îl fac extrem de valoros pentru apărarea cibernetică — un sistem capabil să găsească vulnerabilități înaintea atacatorilor este exact ce își doresc echipele de securitate. OpenAI spune că își asumă tocmai această direcție, în colaborare cu guverne, institute de siguranță și societatea civilă.
Presiunea publică pentru un ritm mai prudent a crescut vizibil în ultimele luni. Peste 1.100 de angajați din laboratoarele de inteligență artificială au semnat inițiativa Pacing the Frontier, prin care cer autorităților americane un mecanism de frânare a dezvoltării modelelor de frontieră. Iar avertismentele privind securitatea nu vin doar din zona AI: Google a semnalat deja riscul pe care calculatoarele cuantice îl reprezintă pentru criptarea actuală.
Deocamdată, Astra rămâne un model neanunțat oficial ca produs, fără dată de lansare comunicată. Următorul pas depinde de rezultatele testelor suplimentare și de validarea externă a nivelului real de capacitate.






