Standarde pentru următoarea etapă a IA
Misiunea noastră este să ne asigurăm că inteligența generală artificială va aduce beneficii întregii omeniri. Așa cum a prezentat recent Sam Altman, alături de Jakub Pachocki, ne orientăm eforturile către această misiune urmărind trei obiective principale:
Să gestionăm următoarea perioadă de progres al IA prin crearea unui cercetător IA automatizat, colaborarea iterativă cu acesta pentru rezolvarea problemei alinierii și găsirea unor modalități prin care oamenii să rămână parte din ciclul de autoîmbunătățire.
Să oferim beneficiile progresului științific și ale creșterii economice pe care le fac posibile mașinile foarte inteligente.
Să-i oferim fiecărei persoane puterea unei AGI personale.
IA ne accelerează propriile activități de cercetare și inginerie, iar cercetarea bazată pe IA a dus la progrese în matematică, inclusiv în privința Problemei Mileniului Navier–Stokes. Acest progres oferă perspective excelente pentru celelalte două obiective ale noastre și ar putea duce la descoperiri importante în medicină, la servicii medicale accesibile pe scară largă și la oportunități economice pentru firmele mici și antreprenorii individuali de pretutindeni.
IA avansează în numeroase companii și țări, iar progresul întregului domeniu schimbă oportunitățile și provocările cu care se confruntă toată lumea. Pe lângă celelalte beneficii ale sale, o IA capabilă și aliniată va juca un rol important în gestionarea acestei tranziții: va consolida apărarea, va promova cercetarea în domeniul alinierii și va ajuta oamenii să înțeleagă și îndrume următoarele etape ale dezvoltării IA.
Pentru a gestiona în siguranță această tranziție, cercetarea în domeniul alinierii trebuie să țină pasul cu aceste capabilități, astfel încât sistemele create de noi și de alții să rămână aliniate cu valorile umane și sub controlul oamenilor. Acest lucru devine tot mai important pe măsură ce sistemele de IA devin mai capabile și mai autonome, mai ales în condițiile în care preiau o parte tot mai mare din cercetarea și dezvoltarea IA. Pentru ca progresul continuu al IA să fie sigur și benefic, vor fi necesare atât progrese în cercetarea alinierii, cât și standarde comune care să ghideze dezvoltarea în toate laboratoarele și țările.
Cercetarea automatizată în domeniul IA poate implica diferite niveluri de supraveghere umană. Pe măsură ce sistemele de IA preiau o parte tot mai mare din activitatea de dezvoltare a generațiilor succesive de IA, ele pot impulsiona tot mai mult un proces de autoîmbunătățire recursivă (RSI), chiar dacă oamenii rămân implicați. Pe măsură ce acest proces devine mai automatizat, ritmul progresului IA s-ar putea accelera rapid.
Considerăm că cercetarea automatizată în domeniul IA va produce modele care vor îmbunătăți direct viața oamenilor. Aceasta poate reduce costul inteligenței avansate, astfel încât oamenii din întreaga lume să poată beneficia de ea. Cercetarea automatizată ne-ar putea ajuta și să îmbunătățim substanțial alinierea și să construim mijloace de apărare împotriva unei IA tot mai capabile, deoarece un cercetător IA automatizat poate fi și un cercetător automatizat al siguranței IA. Sistemele mai capabile și aliniate ar putea contribui la securizarea infrastructurii critice, la apărarea împotriva agenților IA periculoși și la dezvoltarea unor noi măsuri de protecție.
RSI complet autonomă nu este încă o realitate, și nu ar trebui să ne străduim să o realizăm decât dacă și atunci când va putea fi pusă în practică în condiții de siguranță. Decizia de a continua sau nu trebuie să depindă de capacitatea noastră de a păstra controlul uman și de alegeri democratice informate(se deschide într-o fereastră nouă) cu privire la beneficii și riscuri. Dacă ar fi realizată fără grija și prudența necesare, RSI ar putea face ca oamenii să piardă controlul efectiv asupra dezvoltării IA și să nu mai poată supraveghea procese de cercetare pe care nu le mai înțeleg. Din acel moment, IA ar putea deveni mai periculoasă, mai puțin aliniată și, în ansamblu, un pericol pentru oameni. Incidentul Hugging Face pe care l-am dezvăluit, deși nu a fost un rezultat direct al RSI, oferă o imagine a tipurilor de riscuri care ar putea deveni mult mai grave în lipsa unor garanții și a unei alinieri solide.
Standardele internaționale privind practicile de siguranță și securitate în dezvoltarea IA de vârf pot fi la fel de importante pentru gestionarea ritmului progresului de vârf ca însăși cercetarea în domeniul alinierii. Standardele pot crea definiții comune pentru dovezile de înaltă calitate și niveluri de referință convenite pentru rigoarea garanțiilor tehnice. Pe scurt, ele ne ajută să răspundem la întrebarea: „Cum arată o atenuare eficientă a riscului catastrofal asociat IA?”
Instituțiile democratice existente, precum Centrul pentru Standarde și Inovare în IA (CAISI), legile statale și un cadru federal pentru IA pot contribui la toate acestea, la fel ca noile forme de parteneriat public-privat(se deschide într-o fereastră nouă). Însă dezvoltarea și implementarea IA au loc în mai multe țări, adoptarea se produce la nivel global, iar efectele sale vor fi probabil resimțite, într-un fel sau altul și la un moment dat, de toată lumea.
Prin urmare, sunt necesare eforturi internaționale pentru elaborarea standardelor, în vederea soluționării unor provocări esențiale:
Fragmentarea: Evaluările, cerințele de raportare și definițiile incidentelor stabilite de diferite țări s-ar putea contrazice, îngreunând compararea dovezilor, înțelegerea capabilităților emergente și răspunsul la riscurile transfrontaliere.
Acțiunea colectivă: Dacă fiecare țară acționează independent, pot apărea rezultate pe care nu și le dorește nimeni. RSI poate accelera însăși cercetarea în domeniul IA, posibil dincolo de capacitatea noastră colectivă de a înțelege progresul, de a evalua riscurile și de a menține o supraveghere umană semnificativă.
Capacitatea inegală: Activitatea de dezvoltare de vârf și competențele conexe nu sunt distribuite uniform în întreaga lume. Acest lucru accentuează ambele probleme de mai sus.
Aceste provocări privesc atât modelele deschise, cât și pe cele închise.
În mod clar, orice laborator de IA care desfășoară cercetare automatizată în domeniul IA sau vizează alte capabilități avansate trebuie să-și asume responsabilitatea pentru realizarea lor în siguranță, în conformitate cu principiile fundamentale ale responsabilității proprii și cu legislația existentă. Argumentele noastre în favoarea standardelor pornesc de la obiectivul de a evita concentrarea puterii și de a obține rezultate practice mai bune. Standardele le oferă mai multor părți interesate din afara laboratoarelor posibilitatea de a-și exprima opinia asupra evoluției acestei tehnologii și stabilesc un set vizibil de principii pe care se poate conta, indiferent de practicile specifice ale unui anumit laborator. Și probabil vom obține rezultate mai bune dacă părțile colaborează pentru a aborda provocările de mai sus.
De aceea, considerăm că Statele Unite ar trebui să conducă un efort de colaborare cu țări din întreaga lume pentru elaborarea unor standarde tehnice globale privind IA de vârf, inclusiv RSI.
Deși ne așteptăm ca acest concept să evolueze substanțial în timp, două aspecte vor fi esențiale.
O modalitate de a realiza acest lucru ar fi valorificarea rețelei emergente de institute pentru siguranța IA, precum cele deja înființate în Australia, Canada, Germania, Franța, Kenya, Japonia, Coreea, Singapore, India și Regatul Unit, pentru a facilita stabilirea standardelor prin CAISI și organismele naționale din domeniu, cu accent special pe (1) modelele și dezvoltatorii de IA de vârf, evaluați pe baza unor benchmarkuri privind capabilitățile; și (2) gestionarea raportului dintre beneficii și riscuri în cercetarea automatizată în domeniul IA, inclusiv RSI. Statele Unite pot valorifica crearea de către CAISI, în 2024, a Rețelei Internaționale pentru Măsurarea, Evaluarea și Știința IA Avansate(se deschide într-o fereastră nouă), care reunește instituții publice pentru a coopera în domeniul măsurării, evaluării și științei IA.
Standardele elaborate în cadrul acestei inițiative ar oferi o bază tehnică comună pentru măsurarea și evaluarea capacităților, evaluarea riscurilor și asigurarea eficacității măsurilor de protecție. Aceste standarde tehnice nu ar constitui licențe, proceduri obligatorii de revizuire înainte de lansare sau cerințe de aprobare pentru modelele de IA. Guvernele naționale ar decide dacă și cum să încorporeze aceste standarde în propriile sisteme juridice.
Această inițiativă ar trebui, de asemenea, să susțină un ecosistem competitiv în domeniul IA, prin consultarea dezvoltatorilor de modele deschise și închise, a experților tehnici independenți și a mediului universitar. Standardele comune ar trebui elaborate în mod transparent și concepute astfel încât să nu favorizeze anumite companii, țări sau modele de afaceri, inclusiv prin îngreunarea concurenței pentru noii veniți pe piață sau pentru dezvoltatorii de modele cu pondere deschisă.
Așa cum am sugerat(se deschide într-o fereastră nouă), această abordare poate trage învățăminte din domenii precum aviația și stabilitatea financiară, unde țările au elaborat standarde tehnice comune și canale de cooperare de încredere, fără a renunța la autoritatea națională. De asemenea, ar trebui să colaboreze îndeaproape cu organisme de standardizare consacrate și mai noi, precum ISO(se deschide într-o fereastră nouă), Frontier Model Forum(se deschide într-o fereastră nouă), Agentic AI Foundation(se deschide într-o fereastră nouă) și Open Secure AI Alliance(se deschide într-o fereastră nouă), precum și cu organizații axate pe implementare, cum ar fi Appia Foundation, care elaborează specificații practice ce fac legătura între standardele internaționale și evaluările IA din lumea reală.
Standardele internaționale pentru IA vor fi deosebit de importante în gestionarea autonomiei tot mai mari din cercetarea IA și a autoîmbunătățirii recursive. Mai exact, acestea ar putea include standarde pentru:
Evaluarea progresului IA relevant pentru RSI și a volumului de cercetare autonomă desfășurată în cadrul unei companii de IA. Raportul nostru recent privind accelerarea cercetării reprezintă o contribuție inițială la acest efort.
Supravegherea umană a cercetării automatizate în domeniul IA, inclusiv tipurile de procese automatizate de cercetare în IA care ar trebui să declanșeze o evaluare umană imediată.
Clasificarea, urmărirea, raportarea și gestionarea incidentelor legate de aliniere și de cercetarea automatizată în domeniul IA, inclusiv niveluri comune de gravitate a incidentelor și praguri de raportare. Cadrul nostru de raportare a nealinierii reprezintă o contribuție timpurie.
Pe lângă aceste standarde, considerăm că va fi important ca operatorii de infrastructură critică și guvernele din întreaga lume să creeze canale de comunicare securizate pentru a împărtăși preocupări privind securitatea națională, vulnerabilități și amenințări emergente, precum și bune practici în domeniul siguranței IA de vârf, aflat într-o evoluție rapidă. Dialogul dintre Statele Unite și China în aceste domenii ar reprezenta un pas pozitiv, iar discuțiile care urmează vor avea loc într-un moment oportun.
Gestionarea ritmului dezvoltării IA nu înseamnă menținerea unei viteze prestabilite. Din punct de vedere tehnic, înseamnă să ne asigurăm că cercetarea în domeniul alinierii și aplicarea rezultatelor sale rămân cu un pas înaintea capabilităților. Din punct de vedere social, presupune folosirea standardelor, instituțiilor și colaborării pentru a consolida rețelele din acest sector, relațiile sociale și forțele pieței, astfel încât să se obțină rezultate reciproc avantajoase. Apelul recent la acțiune colectivă în domeniul apărării cibernetice este un exemplu în acest sens.
Statele Unite sunt bine poziționate pentru a prelua conducerea, deoarece sectorul său de IA se află în avangarda tehnologiei și ocupă în continuare o poziție privilegiată în rețelele globale din domenii esențiale precum finanțele, comerțul, apărarea, tehnologia și sistemele informaționale. Asumarea conducerii în acest moment va determina dacă Statele Unite vor defini cadrul global al IA sau vor asista la instaurarea în jurul lor a unui sistem fragmentat, inegal și marcat de conflicte. Tot de acest lucru va depinde dacă IA avansată va consolida rețelele de care dispun deja Statele Unite și aliații lor; neasumarea conducerii le-ar putea slăbi.
Competiția geopolitică nu se va reduce doar la a stabili cine deține avantajul tehnologic, ci va viza și adoptarea și răspândirea IA. Din ce în ce mai mult, acest aspect din urmă ar putea fi determinat de cei care promovează o cooperare realistă și reguli de funcționare raționale, pe care companiile și societățile de pretutindeni le vor dori dacă își vor pune viitorul în mâinile acestei tehnologii.
O guvernanță națională solidă, conectată printr-o cooperare internațională pragmatică, oferă o cale către garanții mai puternice, inovare continuă și acces larg la beneficiile IA.


