Sari la conținutul principal
OpenAI

7 august 2026

Securitate

Răspuns la noua frontieră a capabilităților cibernetice critice

Se încarcă…

Securitatea cibernetică evoluează rapid, pe măsură ce modelele devin mai capabile atât să consolideze apărarea cibernetică, cât și să faciliteze atacuri cu o viteză și la o scară fără precedent.

Cele mai recente evaluări interne ale Astra, unul dintre viitoarele noastre modele, efectuate în ultimele zile, indică progrese semnificative în codarea agentivă și securitatea cibernetică. Aceste rezultate, alături de evaluările experților, ne-au determinat să concluzionăm aseară că, potrivit Cadrului de pregătire(se deschide într-o fereastră nouă), nu putem exclude existența unor capabilități cibernetice critice.

Facem publice aceste informații deoarece considerăm că este important să fim transparenți față de public și comunitățile din domeniul siguranței și securității cu privire la această posibilă schimbare a capabilităților.

Am publicat prima versiune a Cadrului de pregătire în decembrie 2023, cu mult înainte ca modelele să se apropie de acest nivel al capabilităților biologice, chimice, de securitate cibernetică și de autoperfecționare a IA. L-am creat pentru a ne ghida în identificarea progreselor în materie de capabilități și în planificarea măsurilor pe care compania noastră urma să le ia pe măsură ce acestea apăreau. Modelele anterioare, inclusiv GPT‑5.6‑Sol, au fost evaluate în privința capabilităților cibernetice de vârf și încadrate la pragul Ridicat, nu la cel Critic.

Măsurarea capabilităților critice de securitate cibernetică 

Potrivit Cadrului de pregătire, un model atinge pragul Critic în materie de securitate cibernetică dacă poate identifica și dezvolta, fără intervenție umană, exploituri zero-day funcționale de orice nivel de severitate pentru numeroase sisteme critice reale și bine protejate sau dacă poate concepe și executa, de la un capăt la altul, strategii noi de atac cibernetic împotriva unor ținte bine protejate, pornind doar de la un obiectiv general. 

Deși continuăm testarea comparativă și evaluarea acestui model, rezultatele preliminare indică performanțe suficient de solide încât, în acest moment, să nu putem exclude nivelul Critic al capabilităților. Astra este un model în curs de lansare și nu a fost implicat în exploatarea Hugging Face. 

Măsurile pe care le luăm

În consecință, am extins testarea robusteții măsurilor de protecție și a controalelor noastre de securitate, astfel încât acestea să fie adecvate implementării unor asemenea capabilități. De asemenea, am luat intern următoarele măsuri pentru ca dezvoltarea în continuare a acestui model să se desfășoare în condiții de siguranță și securitate: 

  • Implementăm controale de securitate mai stricte pentru modelele cu capabilități superioare și activitățile asociate, inclusiv medii de testare izolate, acces restricționat la rețele și instrumente, protecție și criptare îmbunătățite pentru ponderile modelului, capabilități suplimentare de monitorizare și detectare și execuție în medii sandbox.
  • Suspendăm activitățile interne care implică Astra și care nu îndeplinesc încă aceste cerințe consolidate privind controalele de securitate.
  • Am implementat monitorizarea universală a acțiunilor riscante și a abaterilor de la obiective în toate utilizările agentive ale Astra, inclusiv în procesul de instruire și evaluare. Sistemele de monitorizare evaluează lanțul de gândire al modelului și declanșează un răspuns de securitate pentru verificarea și întreruperea activităților cu risc ridicat.
  • Vom colabora cu agențiile guvernamentale relevante și cu anumite organizații pentru siguranța IA în vederea testării capabilităților acestui model.
  • Vom pune la dispoziția partenerilor externi de testare controale de securitate recomandate, pentru ca aceștia să poată efectua în siguranță evaluări și sarcini de lucru cu risc mai ridicat. 

Cadrul ne-a îndrumat deja și în privința altor tranziții ale capabilităților. În iunie 2025, pe măsură ce modelele noastre se apropiau de pragul de capabilitate ridicată în biologie, conform Cadrului de pregătire, am prezentat măsurile pe care le luam pentru a consolida protecțiile, extinde testarea, colabora cu experți externi și implementa controale de securitate suplimentare. Aplicăm același principiu și în acest caz.

Considerăm că modelele cu capabilități cibernetice avansate ar trebui să ajute specialiștii în apărare să identifice și remedieze vulnerabilitățile înaintea atacatorilor. Ne angajăm să colaborăm cu guvernele, institutele de siguranță și societatea civilă pentru a ne asigura că modelele cu capabilități de vârf, precum Astra și cele care îi vor urma, sunt implementate responsabil și pe scară largă, în beneficiul întregii umanități.

Autor

OpenAI