Vai al contenuto principale
OpenAI

7 agosto 2026

Sicurezza

Rispondere alla nuova frontiera delle capacità cyber critiche

Caricamento in corso...

La cybersicurezza sta cambiando rapidamente, man mano che i modelli acquisiscono capacità in grado sia di rafforzare le difese informatiche sia di consentire attacchi con velocità e portata senza precedenti.

Le nostre più recenti valutazioni interne di Astra, uno dei nostri prossimi modelli, condotte negli ultimi giorni indicano progressi significativi nel coding agentico e nella cybersicurezza. Questi risultati, insieme alle valutazioni degli esperti, ci hanno portato a concludere ieri sera che non possiamo escludere capacità cyber critiche secondo il nostro Preparedness Framework(si apre in una nuova finestra).

Condividiamo queste informazioni perché riteniamo importante essere trasparenti con il pubblico e con le comunità impegnate nella sicurezza e nella protezione riguardo a questo potenziale cambiamento delle capacità.

Abbiamo pubblicato per la prima volta il nostro Preparedness Framework nel dicembre 2023, molto prima che i modelli si avvicinassero a questo livello di capacità biologiche, chimiche, di cybersicurezza e di auto-miglioramento dell’IA. Lo abbiamo creato per guidarci nell’individuare i progressi delle capacità e nel pianificare come avrebbe agito la nostra azienda al loro emergere. I modelli precedenti, tra cui GPT‑5.6‑Sol, sono stati valutati per le capacità cyber di frontiera e collocati al livello Alto, anziché Critico.

Misurare le capacità critiche di cybersicurezza 

Secondo il nostro Preparedness Framework, un modello raggiunge la soglia Critica per la cybersicurezza se riesce a individuare e sviluppare exploit zero-day funzionanti di ogni livello di gravità in numerosi sistemi critici reali dotati di difese avanzate, senza intervento umano, oppure se riesce a ideare ed eseguire strategie inedite end-to-end per attacchi informatici contro obiettivi protetti, ricevendo soltanto un obiettivo generale. 

Mentre continuiamo a sottoporre questo modello a benchmark e valutazioni, i risultati preliminari indicano prestazioni sufficientemente elevate da non poter escludere, al momento, un livello di capacità Critico. Astra è un modello di prossima uscita e non è stato impiegato per violare Hugging Face. 

Le misure che stiamo adottando

Di conseguenza, abbiamo potenziato i test di robustezza delle nostre misure di salvaguardia e dei controlli di sicurezza, affinché siano adeguati alla distribuzione di queste capacità. Abbiamo inoltre adottato internamente le seguenti misure per garantire che l’ulteriore sviluppo di questo modello avvenga in modo sicuro e protetto: 

  • Stiamo introducendo controlli di sicurezza più rigorosi per i modelli con capacità superiori e per le attività associate, tra cui ambienti di test isolati, accesso limitato alla rete e agli strumenti, protezioni e crittografia rafforzate per i pesi dei modelli, ulteriori funzionalità di monitoraggio e rilevamento ed esecuzione in sandbox.
  • Stiamo sospendendo le attività interne che coinvolgono Astra e che non soddisfano ancora questi requisiti rafforzati per i controlli di sicurezza.
  • Abbiamo implementato un monitoraggio universale delle azioni rischiose e dei disallineamenti in tutte le applicazioni agentiche di Astra, inclusi l’addestramento e la valutazione. I sistemi di monitoraggio analizzano la catena di pensiero del modello e attivano una risposta di sicurezza per esaminare e interrompere le attività ad alto rischio.
  • Collaboreremo con le agenzie governative competenti e con organizzazioni selezionate per la sicurezza dell’IA per testare le capacità di questo modello.
  • Forniremo ai partner esterni incaricati dei test indicazioni sui controlli di sicurezza consigliati per eseguire in sicurezza valutazioni e carichi di lavoro a rischio più elevato. 

Il framework ci ha già guidato in altre transizioni delle capacità. Nel giugno 2025, quando i nostri modelli si sono avvicinati al livello Alto di capacità biologica previsto dal Preparedness Framework, abbiamo illustrato le misure che stavamo adottando per rafforzare le salvaguardie, ampliare i test, collaborare con esperti esterni e introdurre ulteriori controlli di sicurezza. Stiamo applicando lo stesso principio anche in questo caso.

Riteniamo che i modelli dotati di capacità cyber avanzate debbano aiutare i difensori a individuare e correggere le vulnerabilità prima che lo facciano gli aggressori. Ci impegniamo a collaborare con governi, istituti per la sicurezza e società civile affinché le capacità di frontiera di modelli come Astra, e di quelli che seguiranno, siano distribuite responsabilmente e su vasta scala a beneficio di tutta l’umanità.

Autore

OpenAI