09/01/2026, 11.13

OpenAI Astra și pragul critic de securitate cibernetică: Riscuri noi

OpenAI a suspendat dezvoltarea modelului Astra după ce evaluările au indicat capacități critice de atac cibernetic autonom și crearea de exploit-uri zero-day.
Pe scurt
  • OpenAI a identificat că modelul Astra ar putea atinge pragul de risc Critic, cel mai înalt nivel din cadrul Preparedness Framework.
  • Astra ar putea dezvolta autonom exploit-uri zero-day și strategii de atac end-to-end fără intervenție umană.
  • Dezvoltarea modelului a fost suspendată pentru implementarea unor măsuri stricte de izolare, sandbox și monitorizare universală.
  • Modelul Astra nu a fost implicat în incidentul de securitate raportat anterior la Hugging Face.

Industria inteligenței artificiale a intrat într-o zonă necunoscută de risc. Pentru prima dată, OpenAI a admis public faptul că nu poate exclude posibilitatea ca noul său model, Astra, să fi atins pragul de securitate cibernetică definit ca Critic în cadrul propriului sistem de siguranță. Această recunoaștere nu reprezintă o simplă actualizare de rutină a performanțelor, ci o alertă majoră care a dus la suspendarea activităților de dezvoltare internă care nu respectă noile controale de securitate impuse.

Ce înseamnă concret pragul de risc Critic

Pentru a înțelege gravitatea situației, trebuie să analizăm ierarhia de risc stabilită de OpenAI în cadrul Preparedness Framework, documentul publicat inițial în decembrie 2023. Până în prezent, toate modelele lansate, inclusiv GPT-5.6 Sol, au fost clasificate în categoria de risc Ridicat (High). Trecerea la categoria Critic reprezintă un salt calitativ periculos în ceea ce privește capacitățile ofensive ale AI.

Conform specificațiilor tehnice, un model este considerat că a atins pragul Critic atunci când poate realiza, fără nicio intervenție umană, una dintre următoarele acțiuni: identificarea și dezvoltarea de exploit-uri zero-day funcționale pentru sisteme critice din lumea reală, indiferent de nivelul de severitate, sau proiectarea și executarea de strategii de atac cibernetic end-to-end, pornind doar de la un obiectiv general stabilit de utilizator. Practic, vorbim despre o inteligență artificială capabilă să găsească vulnerabilități necunoscute și să le exploateze autonom pentru a penetra sisteme securizate.

Măsurile de urgență adoptate de OpenAI

Imediat ce evaluările interne au semnalat aceste capacități agentice avansate în codare și securitate, OpenAI a activat protocoalele obligatorii de siguranță. Compania a decis să oprească dezvoltarea Astra până când garanțiile de securitate vor fi validate complet. Această pauză nu este doar administrativă, ci implică o schimbare radicală a infrastructurii de testare.

Pentru a preveni orice scurgere de date sau utilizare neautorizată, Astra a fost plasată în medii de testare izolate. Implementarea execuției în sandbox și monitorizarea universală sunt acum obligatorii, alături de un acces strict restricționat la rețelele externe. Mai mult, OpenAI a început să colaboreze cu agenții guvernamentale și organizații independente de siguranță AI pentru a evalua riscurile și pentru a stabili dacă modelul poate fi lansat în siguranță în viitor.

Distincția necesară între Astra și incidentele recente

În perioada recentă, comunitatea tech a fost alarmată de cazuri în care agenți AI au compromis accidental companii reale în timpul unor evaluări terțe flawed. Este esențial ca antreprenorii și specialiștii în securitate să nu confunde aceste incidente cu situația modelului Astra. OpenAI a clarificat explicit faptul că Astra nu a fost implicată în exploit-ul raportat la Hugging Face.

Atacul de la Hugging Face a fost rezultatul utilizării unui model de test separat combinat cu GPT-5.6 Sol. În cazul Astra, riscul nu este unul derivat dintr-o eroare de implementare a unui terț, ci din capacitățile intrinseci ale modelului. Capacitățile de codare agentică ale lui Astra sunt atât de avansate încât modelul ar putea, teoretic, să creeze propriile sale instrumente de atac, ceea ce îl plasează într-o categorie de risc complet diferită de modelele anterioare.

O nouă rutină în transparența riscurilor AI

Această dezvăluire marchează un moment pivot în modul în care companiile de AI comunică riscurile. Până acum, discuțiile despre riscurile existențiale sau atacurile cibernetice autonome erau dominate de teorii sau scenarii ipotetice. Acum, avem un caz concret în care un dezvoltator recunoaște că modelul său a atins un prag de pericol definit anterior. Divulgarea capacităților critice ar putea deveni o procedură standard pe măsură ce modelele frontier evoluează.

Astra reprezintă prima dată când un model OpenAI declanșează pragul Critic de securitate cibernetică, forțând compania să redefinească granița dintre utilitatea unui agent AI și riscul de a crea o armă cibernetică autonomă.

Pentru business-uri, acest lucru înseamnă că dependența de instrumente AI pentru securitatea codului sau pentru automatizarea infrastructurii trebuie gestionată cu o prudență sporită. Dacă un AI poate crea exploit-uri zero-day, capacitatea sa de a ajuta la apărare este imensă, dar riscul de a fi utilizat mal intenționat devine un factor sistemic.

Impactul strategic pentru ecosistemul digital din România

Pentru antreprenorii și companiile din România, vestea privind Astra nu este doar o curiozitate tehnologică, ci un semnal de alarmă privind maturizarea riscurilor digitale. România, cu un sector IT puternic, dar cu o digitalizare unevenă a IMM-urilor, se află într-o poziție vulnerabilă în fața unor astfel de evoluții.

În contextul implementării AI Act la nivel european, reglementările vor deveni mult mai stricte pentru modelele care prezintă riscuri sistemice. Companiile române care integrează soluții de AI în procesele lor operaționale trebuie să realizeze că securitatea nu mai poate fi tratată doar ca o problemă de firewall sau antivirus, ci ca o strategie de reziliență împotriva unor atacuri care pot fi generate autonom.

Fondurile din PNRR dedicate digitalizării trebuie să prioritizeze nu doar achiziția de software, ci și formarea în securitate cibernetică avansată. Pe măsură ce AI-ul trece de la rolul de asistent la cel de agent autonom, capacitatea de a monitoriza și audita codul generat de AI devine critică. Pentru firmele locale, acest lucru înseamnă că investiția în specialiști de securitate capabili să gestioneze riscurile AI va fi mai valoroasă decât simpla adoptare a celor mai noi instrumente de productivitate. Digitalizarea românească trebuie să evolueze spre un model de Security by Design, anticipând o lume în care vulnerabilitățile software pot fi descoperite și exploatate în milisecunde de către modele precum Astra.

Întrebări frecvente

Ce este modelul Astra de la OpenAI?

Astra este un model de AI de ultimă generație care a demonstrat capacități avansate de codare agentică, fiind însă suspendat temporar pentru a fi evaluate riscurile de securitate cibernetică.

Ce înseamnă un exploit zero-day?

Un exploit zero-day este un atac care profită de o vulnerabilitate software necunoscută dezvoltatorului, pentru care nu există încă niciun patch de securitate.

Astra a fost folosit pentru a ataca alte companii?

Nu, OpenAI a confirmat că Astra nu a fost implicat în niciun atac, inclusiv în cel de la Hugging Face; suspendarea a avut loc preventiv, în urma unor teste interne.

Când va fi lansat modelul Astra?

În acest moment nu există o dată de lansare, dezvoltarea fiind încetinită până când toate măsurile de siguranță și validările guvernamentale vor fi finalizate.


Surse: Explainx, Aitoolsrecap, Securityweek ·

Hai una domanda su questo dossier?

Scrivila qui: Susanna, l assistente AI di glacom, ti risponde via email con un approfondimento gratuito.

Nessuna consulenza personalizzata (finanziaria, legale o medica): solo informazione e fonti. Email usata solo per rispondere.

oppure scrivile su: WhatsApp · Telegram · SimpleX · Delta Chat · Email

Printable version
CLOSE X
Distribuie această știre
See also
Vulnerabilități critice în LangFlow: riscuri pentru agenții de AI
Sunt identificate 8 vulnerabilități în LangFlow, inclusiv breșe critice de Remote Code Execution. Află cum să protejezi infrastructura de AI a compani…
03/09/2026 17:47
Vulnerabilitate critică în cPanel: riscuri de securitate pentru hosting
O vulnerabilitate de severitate ridicată în cPanel permite escaladarea privilegiilor și execuția de cod. Află cum să protejezi infrastructura business…
03/09/2026 14:21
Visa lansează AI autonom pentru patch-uri de securitate în codul sursă
Visa introduce Visa Vulnerability Agentic Harness (VVAH), un sistem AI care detectează și repară vulnerabilitățile de cod fără intervenție umană preal…
02/09/2026 17:48
Atacul Aurora: Cum a fost folosit agentul AI Cursor pentru ransomware
Hackerii grupului Aurora au utilizat agentul AI Cursor pentru a infiltra 10 rețele corporate, manipulând barierele de siguranță prin inginerie socială…
02/09/2026 07:54
LLM-as-a-Judge: Noua frontieră în evaluarea și securitatea AI
Descoperă cum funcționează LLM-as-a-Judge, de la sistemul Bionic al LM Studio până la riscurile de bias, și ce înseamnă această evoluție pentru firmel…
31/08/2026 18:26


ISCRIVITI A GLACOM.NEWS

I dossier su AI, tech e business che contano, nella tua email. Gratis.