Standartai kitam DI raidos etapui
Mūsų misija – užtikrinti, kad bendrasis dirbtinis intelektas būtų naudingas visai žmonijai. Kaip neseniai išdėstė Samas Altmanas ir Jakubas Pachockis, siekdami šios misijos savo darbe teikiame pirmenybę trims pagrindiniams tikslams:
Sėkmingai įveikti kitą DI pažangos etapą sukuriant automatizuotą DI tyrėją, kartu su juo ieškant suderinamumo problemos sprendimų ir būdų žmonėms išlikti savęs tobulinimo ciklo dalimi.
Suteikti žmonėms labai išmanių mašinų įgalinamos mokslo pažangos ir ekonomikos augimo naudą.
Suteikti kiekvienam žmogui asmeninį AGI.
DI spartina mūsų pačių mokslinius tyrimus ir inžinerijos darbus, o DI grindžiami tyrimai jau padėjo pasiekti matematikos laimėjimų, įskaitant Navjė–Stokso tūkstantmečio problemą. Ši pažanga teikia daug vilčių siekiant kitų dviejų mūsų tikslų ir gali padėti padaryti svarbių medicinos atradimų, užtikrinti plačiai prieinamą sveikatos priežiūrą ir ekonomiškai sustiprinti mažąsias įmones bei individualius verslininkus visame pasaulyje.
DI pažangą daro daugybė įmonių ir šalių, o visos srities raida keičia kiekvienam kylančias galimybes ir iššūkius. Be kitos naudos, pajėgus ir su žmogaus vertybėmis suderintas DI atliks svarbų vaidmenį mums įveikiant šį pereinamąjį laikotarpį: stiprins gynybą, skatins suderinamumo tyrimus ir padės žmonėms suprasti bei valdyti kitus DI plėtros etapus.
Kad šį pereinamąjį laikotarpį įveiktume saugiai, suderinamumo tyrimai turi neatsilikti nuo šių gebėjimų, kad mūsų ir kitų kuriamos sistemos išliktų suderintos su žmogaus vertybėmis ir kontroliuojamos žmonių. Tai tampa vis svarbiau DI sistemoms įgyjant daugiau gebėjimų ir savarankiškumo, taip pat joms perimant vis didesnę pačių DI tyrimų ir plėtros dalį. Kad tolesnė DI pažanga būtų saugi ir naudinga, reikės ir suderinamumo tyrimų laimėjimų, ir bendrų standartų, kuriais būtų vadovaujamasi įvairių laboratorijų bei šalių plėtros darbuose.
Automatizuoti DI tyrimai gali būti vykdomi taikant skirtingo lygio žmogaus priežiūrą. DI sistemoms perimant vis daugiau darbo kuriant paskesnes DI kartas, jos gali vis labiau skatinti rekursinio savęs tobulinimo (RSI) procesą, net jei žmonės ir toliau jame dalyvauja. Šiam procesui tampant vis labiau automatizuotam, DI pažanga gali sparčiai įsibėgėti.
Tikime, kad automatizuoti DI tyrimai padės sukurti modelius, tiesiogiai gerinančius žmonių gyvenimą. Jie gali sumažinti pažangaus intelekto kainą, kad jo teikiama nauda būtų prieinama žmonėms visame pasaulyje. Automatizuoti tyrimai taip pat galėtų padėti mums gerokai pagerinti suderinamumą ir sukurti apsaugą nuo vis pajėgesnio DI – automatizuotas DI tyrėjas gali būti ir automatizuotas DI saugos tyrėjas. Pajėgesnės, suderintos sistemos galėtų padėti apsaugoti ypatingos svarbos infrastruktūrą, gintis nuo pavojingų DI agentų ir kurti naujas apsaugos priemones.
Visiškai autonominis RSI šiandien nevyksta, ir neturėtume jo siekti, kol negalėsime to daryti saugiai. Sprendimas, ar ir kaip tęsti, turi priklausyti nuo mūsų gebėjimo išsaugoti žmogaus kontrolę ir nuo informacija pagrįstų demokratinių sprendimų(atsidaro naujame lange) dėl naudos ir rizikos. Jei RSI būtų vykdomas be deramo atidumo ir atsargumo, žmonės galėtų prarasti praktinę DI plėtros kontrolę ir nebesugebėti prižiūrėti tyrimų procesų, kurių nebesupranta. Tuomet DI galėtų tapti pavojingesnis, mažiau suderintas ir apskritai kelti pavojų žmonėms. Nors mūsų atskleistas „Hugging Face“ incidentas nebuvo tiesioginė RSI pasekmė, jis leidžia numatyti, kokio pobūdžio rizika be patikimų apsaugos ir suderinamumo priemonių galėtų tapti gerokai didesnė.
Tarptautiniai saugos ir saugumo praktikos standartai, taikomi kuriant priešakinį DI, gali būti ne mažiau svarbūs valdant šios srities pažangos tempą nei patys suderinamumo tyrimai. Standartai gali padėti bendrai apibrėžti aukštos kokybės įrodymus ir sutarti dėl techninių apsaugos priemonių griežtumo atskaitos taškų. Trumpai tariant, jie padeda atsakyti į klausimą: „Kaip turėtų atrodyti tinkamas katastrofinės DI rizikos mažinimas?“
Prie to gali prisidėti esamos demokratinės institucijos, pavyzdžiui, DI standartų ir inovacijų centras (CAISI), valstijų įstatymai bei federalinė DI sistema, taip pat naujos viešojo ir privačiojo sektorių partnerystės formos(atsidaro naujame lange). Tačiau DI kuriamas ir diegiamas daugelyje šalių, jo naudojimas plinta visame pasaulyje, o poveikį vienaip ar kitaip ir anksčiau ar vėliau tikriausiai pajus visi.
Todėl norint išspręsti kelis pagrindinius iššūkius būtinos tarptautinės pastangos kurti standartus:
Susiskaidymas – skirtingų valstybių vertinimai, ataskaitų teikimo reikalavimai ir incidentų apibrėžtys gali prieštarauti vieni kitiems, todėl būtų sunkiau lyginti įrodymus, suprasti naujus gebėjimus ir reaguoti į tarpvalstybinę riziką.
Kolektyviniai veiksmai – kiekvienai valstybei veikiant savarankiškai gali susiklostyti nė vienai valstybei nepriimtini rezultatai. RSI gali paspartinti pačius DI tyrimus, galbūt net viršydamas mūsų bendrus gebėjimus suprasti pažangą, įvertinti riziką ir išlaikyti prasmingą žmogaus priežiūrą.
Netolygūs pajėgumai – priešakinio DI kūrimo veikla ir susijusios ekspertinės žinios pasaulyje pasiskirsčiusios netolygiai. Tai dar labiau paaštrina abi pirmiau minėtas problemas.
Šie iššūkiai aktualūs ir atviriesiems, ir uždariesiems modeliams.
Svarbu aiškiai pasakyti: kiekviena DI laboratorija, vykdanti automatizuotus DI tyrimus ar plėtojanti kitus pažangius gebėjimus, privalo prisiimti atsakomybę ir tai daryti saugiai, laikydamasi pagrindinių asmeninės atsakomybės principų bei galiojančių įstatymų. Standartų poreikį grindžiame siekiu išvengti galios sutelkimo ir užtikrinti geresnius praktinius rezultatus. Standartai suteikia daugiau suinteresuotųjų šalių už laboratorijų ribų galimybę tarti žodį dėl šios technologijos raidos ir nustato aiškų principų rinkinį, kuriuo galima pasikliauti nepriklausomai nuo konkrečios laboratorijos praktikos. Be to, bendradarbiaudamos spręsti minėtus iššūkius šalys tikriausiai pasieks geresnių rezultatų.
Todėl manome, kad Jungtinės Valstijos turėtų imtis iniciatyvos ir bendradarbiauti su viso pasaulio šalimis kuriant pasaulinius techninius priešakinio DI, įskaitant RSI, standartus.
Nors tikimės, kad laikui bėgant ši koncepcija gerokai keisis, du aspektai išliks esminiai.
Vienas iš būdų tai pasiekti – pasitelkti besiformuojantį DI saugos institutų tinklą, įskaitant jau įsteigtus Australijoje, Kanadoje, Vokietijoje, Prancūzijoje, Kenijoje, Japonijoje, Korėjoje, Singapūre, Indijoje ir Jungtinėje Karalystėje. Per CAISI ir nacionalines pramonės organizacijas jis padėtų nustatyti standartus, daugiausia dėmesio skiriant: (1) priešakinio DI modeliams ir kūrėjams, vertinamiems pagal gebėjimų etalonus; (2) automatizuotų DI tyrimų, įskaitant RSI, naudos ir rizikos valdymui. Jungtinės Valstijos gali remtis tuo, kad 2024 m. CAISI sukūrė Tarptautinį pažangaus DI matavimo, vertinimo ir mokslo tinklą(atsidaro naujame lange), subūrusį viešąsias institucijas bendradarbiauti DI matavimo, vertinimo ir mokslo srityse.
Vykdant šią iniciatyvą parengti standartai suteiktų bendrą techninį pagrindą gebėjimams matuoti ir vertinti, rizikai įvertinti bei apsaugos priemonių pakankamumui nustatyti. Šie techniniai standartai nebūtų licencijos, privaloma peržiūra prieš išleidimą ar DI modelių patvirtinimo reikalavimai. Nacionalinės vyriausybės pačios spręstų, ar ir kaip įtraukti šiuos standartus į savo teisines sistemas.
Šis darbas taip pat turėtų palaikyti konkurencingą DI ekosistemą, konsultuojantis su atvirųjų ir uždarųjų modelių kūrėjais, nepriklausomais technikos ekspertais ir akademine bendruomene. Bendri standartai turėtų būti rengiami skaidriai ir taip, kad nesuteiktų pranašumo konkrečioms įmonėms, šalims ar verslo modeliams, taip pat neapsunkintų naujų rinkos dalyvių ar atvirųjų svorių modelių kūrėjų konkurencijos.
Kaip jau esame siūlę(atsidaro naujame lange), rengiant šį požiūrį galima pasimokyti iš tokių sričių kaip aviacija ir finansinis stabilumas, kuriose šalys sukūrė bendrus techninius standartus ir patikimus bendradarbiavimo kanalus neatsisakydamos nacionalinių įgaliojimų. Taip pat reikėtų glaudžiai bendradarbiauti su seniau veikiančiomis ir naujesnėmis standartizacijos organizacijomis, tokiomis kaip ISO(atsidaro naujame lange), Priešakinių modelių forumas(atsidaro naujame lange), Agentinio DI fondas(atsidaro naujame lange) ir Atviro ir saugaus DI aljansas(atsidaro naujame lange), taip pat su įgyvendinimu besirūpinančiomis organizacijomis, pavyzdžiui, „Appia“ fondu, rengiančiu praktines specifikacijas, kurios susieja tarptautinius standartus su realiomis DI vertinimo procedūromis.
Tarptautiniai DI standartai bus ypač svarbūs valdant didėjantį DI tyrimų savarankiškumą ir rekursinį savęs tobulinimą. Konkrečiai, jie galėtų apimti šių sričių standartus:
Su RSI susijusios DI pažangos ir DI įmonėje vykdomų autonominių tyrimų masto vertinimo. Mūsų naujausia ataskaita apie tyrimų spartinimą yra pirmasis indėlis į šią iniciatyvą.
Automatizuotų DI tyrimų priežiūros, kurią vykdo žmonės, įskaitant tai, kokie automatizuotų DI tyrimų procesai turėtų būti nedelsiant perduodami žmogui peržiūrėti.
Su suderinamumu ir automatizuotais DI tyrimais susijusių incidentų klasifikavimo, stebėjimo, pranešimo ir reagavimo, pavyzdžiui, bendrų incidentų sunkumo lygių ir pranešimo ribų. Mūsų pranešimo apie nesuderinamumą sistema yra vienas pirmųjų indėlių.
Be šių standartų, manome, kad ypatingos svarbos infrastruktūros operatoriams ir vyriausybėms visame pasaulyje bus svarbu sukurti saugius ryšio kanalus, kuriais būtų galima dalytis susirūpinimu dėl nacionalinio saugumo, informacija apie naujas spragas bei grėsmes ir geriausia praktika sparčiai besivystančioje priešakinio DI saugos srityje. Jungtinių Valstijų ir Kinijos dialogas šiose srityse būtų teigiamas žingsnis, o artėjančios derybos vyks tinkamu metu.
DI plėtros tempo valdymas nereiškia iš anksto nustatyto greičio palaikymo. Techniniu požiūriu tai reiškia užtikrinti, kad suderinamumo tyrimai ir jų rezultatų diegimas aplenktų gebėjimų plėtrą. Visuomeniniu požiūriu tai reiškia pasitelkti standartus, institucijas ir bendradarbiavimą, kad pramonės tinklai, visuomeniniai ryšiai ir rinkos jėgos būtų sustiprinti ir kurtų visoms šalims naudingus rezultatus. Neseniai paskelbtas raginimas kolektyviai stiprinti kibernetinę gynybą yra pastarojo požiūrio pavyzdys.
Jungtinės Valstijos turi puikias galimybes imtis lyderystės, nes jų DI pramonė yra technologijų priešakyje, o pati šalis vis dar užima išskirtinę padėtį pasauliniuose tinkluose tokiose svarbiose srityse kaip finansai, prekyba, gynyba, technologijos ir informacinės sistemos. Nuo lyderystės dabar priklausys, ar Jungtinės Valstijos formuos pasaulinę DI sistemą, ar stebės, kaip aplink jas įsitvirtina susiskaldžiusi, netolygi ir konfliktų draskoma sistema. Nuo to taip pat priklausys, ar pažangus DI sustiprins Jungtinių Valstijų ir jų sąjungininkių jau turimus tinklus; lyderystės stoka gali juos susilpninti.
Geopolitinė konkurencija vyks ne tik dėl technologinės lyderystės, bet ir dėl DI diegimo bei sklaidos. Pastaruosius procesus vis dažniau gali lemti tas, kas skatins realistišką bendradarbiavimą ir kurs pagrįstas veiklos taisykles, kurių įmonėms ir visuomenėms visame pasaulyje reikės, jei jos ketins su šia technologija sieti savo ateitį.
Tvirtas nacionalinis valdymas, praktiniu tarptautiniu bendradarbiavimu susietas su kitomis šalimis, atveria kelią patikimesnėms apsaugos priemonėms, nuolatinėms inovacijoms ir plačiai prieinamai DI naudai.


