Standard per la prossima fase dell’IA
La nostra missione è garantire che l’intelligenza artificiale generale porti benefici a tutta l’umanità. Come illustrato di recente da Sam Altman e Jakub Pachocki, orientiamo il nostro lavoro verso questa missione attraverso tre obiettivi principali:
Affrontare la prossima fase del progresso dell’IA creando un ricercatore di IA automatizzato, lavorando insieme a esso in modo iterativo sul problema dell’allineamento e trovando modi per mantenere le persone all’interno del ciclo di auto-miglioramento.
Mettere a disposizione i benefici del progresso scientifico e della crescita economica resi possibili da macchine altamente intelligenti.
Offrire a ogni persona una propria AGI personale.
L’IA sta accelerando le nostre attività di ricerca e ingegneria e la ricerca resa possibile dall’IA ha prodotto progressi in matematica, anche riguardo al problema del millennio di Navier-Stokes. Questi progressi sono molto promettenti per gli altri due obiettivi e potrebbero portare a importanti scoperte mediche, a un’assistenza sanitaria ampiamente accessibile e a maggiori opportunità economiche per piccole imprese e singoli imprenditori in tutto il mondo.
L’IA progredisce in numerose aziende e Paesi, e i progressi dell’intero settore trasformano le opportunità e le sfide che tutti devono affrontare. Oltre a offrire altri benefici, un’IA capace e allineata sarà fondamentale per affrontare questa transizione, rafforzando le difese, facendo progredire la ricerca sull’allineamento e aiutando le persone a comprendere e orientare le prossime fasi dello sviluppo dell’IA.
Per affrontare questa transizione in sicurezza, la ricerca sull’allineamento deve tenere il passo con tali capacità, affinché i sistemi creati da noi e da altri rimangano allineati ai valori umani e sotto il controllo umano. Ciò diventa sempre più importante man mano che i sistemi di IA acquisiscono capacità e autonomia, anche assumendo un ruolo crescente nella ricerca e nello sviluppo dell’IA stessa. Per garantire che i continui progressi dell’IA siano sicuri e vantaggiosi, serviranno sia nuovi passi avanti nella ricerca sull’allineamento sia standard condivisi che orientino lo sviluppo nei diversi laboratori e Paesi.
La ricerca automatizzata sull’IA può prevedere diversi livelli di supervisione umana. Man mano che i sistemi di IA svolgono una parte crescente del lavoro necessario a sviluppare le generazioni successive di IA, possono guidare sempre più un processo di auto-miglioramento ricorsivo (RSI), anche mantenendo il coinvolgimento delle persone. Con l’aumentare dell’automazione di questo processo, il progresso dell’IA potrebbe accelerare rapidamente.
Riteniamo che la ricerca automatizzata sull’IA produrrà modelli capaci di migliorare direttamente la vita delle persone. Può ridurre il costo dell’intelligenza avanzata, consentendo alle persone di tutto il mondo di beneficiarne. La ricerca automatizzata potrebbe inoltre aiutarci a migliorare notevolmente l’allineamento e a costruire difese contro un’IA sempre più capace: un ricercatore di IA automatizzato può essere anche un ricercatore automatizzato sulla sicurezza dell’IA. Sistemi più capaci e allineati potrebbero contribuire a proteggere le infrastrutture critiche, difenderci da agenti di IA pericolosi e sviluppare nuove misure di protezione.
Oggi non esiste un’RSI pienamente autonoma e non dovremmo perseguirla finché non sarà possibile realizzarla in sicurezza. La decisione se procedere e in che modo deve dipendere dalla nostra capacità di preservare il controllo umano e da scelte democratiche consapevoli(si apre in una nuova finestra) in merito a benefici e rischi. Se realizzata senza la dovuta cura e cautela, l’RSI potrebbe far perdere agli esseri umani il controllo effettivo sullo sviluppo dell’IA, rendendoli incapaci di supervisionare processi di ricerca che non comprendono più. A quel punto, l’IA potrebbe diventare più pericolosa, meno allineata e, nel complesso, rappresentare un pericolo per le persone. L’incidente di Hugging Face da noi reso noto, pur non essendo una conseguenza diretta dell’RSI, offre un’anticipazione dei rischi che potrebbero diventare molto più gravi in assenza di solide tutele e di un adeguato allineamento.
Gli standard internazionali per le pratiche di sicurezza nello sviluppo dell’IA di frontiera potrebbero essere importanti quanto la ricerca sull’allineamento per gestire il ritmo dei progressi alla frontiera. Gli standard possono creare definizioni condivise di prove di alta qualità e parametri di riferimento concordati per il rigore delle tutele tecniche. In breve, ci aiutano a rispondere alla domanda: “Come si presenta una buona mitigazione del rischio catastrofico legato all’IA?”
Le istituzioni democratiche esistenti, come il Center for AI Standards and Innovation (CAISI), le leggi statali e un quadro federale per l’IA possono contribuire a questo obiettivo, così come nuove forme di partenariato pubblico-privato(si apre in una nuova finestra). Tuttavia, lo sviluppo e l’impiego dell’IA avvengono in più Paesi, la sua adozione è globale e, prima o poi, è probabile che tutti ne avvertano in qualche modo gli effetti.
Occorrono quindi iniziative internazionali per sviluppare standard e affrontare alcune sfide fondamentali:
Frammentazione — Le valutazioni, gli obblighi di comunicazione e le definizioni degli incidenti adottati dai diversi Paesi potrebbero entrare in conflitto, rendendo più difficile confrontare le prove, comprendere le capacità emergenti e rispondere ai rischi transfrontalieri.
Azione collettiva — Se ogni Paese agisce in modo indipendente, possono prodursi risultati che nessuno desidera. L’RSI può accelerare la ricerca stessa sull’IA, potenzialmente oltre la nostra capacità collettiva di comprendere i progressi, valutare i rischi e mantenere una supervisione umana significativa.
Capacità disomogenea — Le attività di sviluppo alla frontiera e le relative competenze non sono distribuite uniformemente nel mondo. Ciò accentua entrambi i problemi descritti sopra.
Queste sfide riguardano sia i modelli aperti sia quelli chiusi.
È bene precisare che qualsiasi laboratorio di IA impegnato nella ricerca automatizzata sull’IA o nello sviluppo di altre capacità avanzate deve assumersi la responsabilità di operare in sicurezza, nel rispetto dei principi fondamentali di responsabilità individuale e delle leggi vigenti. La nostra motivazione a favore degli standard nasce dalla volontà di evitare la concentrazione del potere e ottenere risultati concreti migliori. Gli standard consentono a un maggior numero di soggetti esterni ai laboratori di contribuire alle decisioni sull’evoluzione di questa tecnologia e offrono un insieme visibile di principi su cui fare affidamento, indipendentemente dalle specifiche pratiche di un determinato laboratorio. È inoltre probabile che la collaborazione tra le parti per affrontare le sfide descritte produca risultati migliori.
Per questo riteniamo che gli Stati Uniti debbano guidare un’iniziativa congiunta con i Paesi di tutto il mondo per sviluppare standard tecnici globali per l’IA di frontiera, compresa l’RSI.
Pur prevedendo che questo concetto evolva notevolmente nel tempo, due aspetti saranno essenziali.
Un possibile approccio consisterebbe nello sfruttare la rete emergente di istituti per la sicurezza dell’IA, come quelli già istituiti in Australia, Canada, Germania, Francia, Kenya, Giappone, Corea, Singapore, India e Regno Unito, per agevolare la definizione di standard attraverso il CAISI e gli organismi nazionali di settore, concentrandosi in particolare su: (1) modelli e sviluppatori di IA di frontiera, misurati mediante benchmark delle capacità; e (2) gestione di benefici e rischi della ricerca automatizzata sull’IA, compresa l’RSI. Gli Stati Uniti possono sviluppare ulteriormente l’International Network for Advanced AI Measurement, Evaluation, and Science(si apre in una nuova finestra), creata dal CAISI nel 2024 per riunire istituzioni pubbliche e favorire la cooperazione nella misurazione, valutazione e ricerca scientifica sull’IA.
Gli standard sviluppati nell’ambito di questa iniziativa offrirebbero una base tecnica comune per misurare e valutare le capacità, analizzare i rischi e stabilire l’adeguatezza delle tutele. Questi standard tecnici non costituirebbero licenze, revisioni obbligatorie prima del rilascio o requisiti di approvazione per i modelli di IA. I governi nazionali deciderebbero se e come integrare tali standard nei rispettivi ordinamenti giuridici.
Questo lavoro dovrebbe inoltre sostenere un ecosistema dell’IA competitivo, coinvolgendo sviluppatori di modelli aperti e chiusi, esperti tecnici indipendenti e il mondo accademico. Gli standard comuni dovrebbero essere sviluppati in modo trasparente e concepiti per non favorire aziende, Paesi o modelli di business specifici, evitando anche di rendere più difficile la concorrenza per i nuovi operatori o gli sviluppatori di modelli a pesi aperti.
Come abbiamo suggerito(si apre in una nuova finestra), questo approccio può trarre insegnamento da settori come l’aviazione e la stabilità finanziaria, nei quali i Paesi hanno sviluppato standard tecnici comuni e canali di cooperazione affidabili senza rinunciare all’autorità nazionale. Dovrebbe inoltre collaborare strettamente con organismi di normazione consolidati e più recenti, come ISO(si apre in una nuova finestra), il Frontier Model Forum(si apre in una nuova finestra), l’Agentic AI Foundation(si apre in una nuova finestra) e l’Open Secure AI Alliance(si apre in una nuova finestra), nonché con organizzazioni incentrate sull’attuazione, come l’Appia Foundation, che sta sviluppando specifiche pratiche per collegare gli standard internazionali alle valutazioni dell’IA nel mondo reale.
Gli standard internazionali per l’IA saranno particolarmente importanti per gestire la crescente autonomia nella ricerca sull’IA e l’auto-miglioramento ricorsivo. Nello specifico, potrebbero includere standard per:
Valutare i progressi dell’IA rilevanti per l’RSI e la quantità di ricerca autonoma svolta all’interno di un’azienda di IA. Il nostro recente rapporto sull’accelerazione della ricerca rappresenta un primo contributo a questa iniziativa.
Supervisionare a livello umano la ricerca automatizzata sull’IA, stabilendo anche quali tipi di processi automatizzati di ricerca sull’IA debbano attivare un’immediata revisione umana.
Classificare, monitorare, segnalare e gestire gli incidenti relativi all’allineamento e alla ricerca automatizzata sull’IA, adottando ad esempio livelli comuni di gravità e soglie comuni di segnalazione. Il nostro quadro per la segnalazione dei disallineamenti costituisce un primo contributo.
Oltre a questi standard, riteniamo importante che gli operatori delle infrastrutture critiche e i governi di tutto il mondo istituiscano canali di comunicazione sicuri per condividere questioni di sicurezza nazionale, vulnerabilità e minacce emergenti, nonché buone pratiche nel settore in rapida evoluzione della sicurezza dell’IA di frontiera. Il dialogo tra Stati Uniti e Cina in questi ambiti sarebbe un passo positivo, e i prossimi colloqui giungono in un momento opportuno.
Gestire il ritmo dello sviluppo dell’IA non significa mantenere una velocità prestabilita. Sul piano tecnico, significa garantire che la ricerca sull’allineamento e la sua applicazione restino al passo con le capacità, anticipandole. Sul piano sociale, significa usare standard, istituzioni e collaborazione per rafforzare le reti industriali, le relazioni sociali e le forze di mercato, così da produrre risultati vantaggiosi per tutti. Il recente appello a un’azione collettiva per la difesa informatica è un esempio di quest’ultimo approccio.
Gli Stati Uniti sono nella posizione ideale per assumere un ruolo guida, perché il loro settore dell’IA è alla frontiera tecnologica e il Paese occupa ancora una posizione privilegiata nelle reti globali in ambiti cruciali come finanza, commercio, difesa, tecnologia e sistemi informativi. Assumere ora un ruolo guida determinerà se saranno gli Stati Uniti a plasmare il quadro globale dell’IA o se il Paese vedrà affermarsi intorno a sé un sistema frammentato, disomogeneo e segnato dai conflitti. Ciò determinerà anche se l’IA avanzata rafforzerà le reti già esistenti degli Stati Uniti e dei loro alleati; rinunciare alla leadership potrebbe indebolirle.
La competizione geopolitica non riguarderà soltanto chi è tecnologicamente più avanti, ma anche l’adozione e la diffusione dell’IA. Sempre più spesso, queste ultime potrebbero dipendere da chi promuove una cooperazione realistica e regole di condotta sensate, che imprese e società di tutto il mondo vorranno avere prima di affidare il proprio futuro a questa tecnologia.
Una solida governance nazionale, collegata attraverso una concreta cooperazione internazionale, offre un percorso verso tutele più forti, un’innovazione continua e un ampio accesso ai benefici dell’IA.


