DI politikos langas atviras. Privalome veikti.
Chris Lehane, „OpenAI“ pasaulinių reikalų vadovas
Pasiekėme naują DI galimybių etapą, o tai reikalauja ir naujo DI politikos etapo. Jokia įmonė, pramonės šaka ar vyriausybė negali įveikti šio iššūkio viena pati. Šiuo metu privalome teikti pirmenybę prasmingiems veiksmams, o ne tobulai politikai.
Štai ką mes darome:
siekiame privalomų nacionalinių DI saugos reikalavimų. Norime bendradarbiauti su Kongresu dėl privalomo, galimybėmis pagrįsto nacionalinio DI saugos reglamentavimo;
išlaikome tempą valstijose. Kol Kongresas nesiima veiksmų, toliau palaikysime valstijų teisės aktus, stiprinančius platesnę DI saugos ekosistemą. Šiandien pranešame, kad palaikome keturis Kalifornijos įstatymų projektus: SB 813 dėl bendros nepriklausomų saugos vertinimų infrastruktūros, AB 1405 dėl DI auditorių standartų, SB 1119 dėl jaunimo apsaugos ir AB 1864 dėl apsaugos priemonių nuo su DI susijusių biologinių grėsmių;
skatiname pramonės inicijuotus standartus. Bendradarbiausime su kitomis priešakinių technologijų laboratorijomis, kad patobulintume priešakinio DI standartus, ir jau dabar, su vyriausybės palaikymu ar be jo, kuriame savanorišką iniciatyvą;
kuriame visuotinius standartus. Pasisakysime už suderintą tarptautinį požiūrį į galimybių matavimą, rizikos valdymą, žmogaus kontrolės išsaugojimą ir sprendimus dėl to, kada ir kaip technologijų plėtra turėtų sulėtėti ar sustoti, net jeigu tai reikštų modelio galimybių plėtros sulėtinimą.
Mūsų vyriausiasis mokslininkas Jakubas Pachockis neseniai rašė, kad sparčiai augant mašininiam intelektui, įskaitant rekursyvaus savęs tobulinimo galimybę, būtinas „ypatingas atsargumas“. OpenAI ir toliau ieškos techninių suderinimo bei stebėsenos sprendimų, kurs gynybos sistemas ir prireikus lėtins plėtrą. Tačiau techninio darbo pavienėse laboratorijose nepakaks. Taip pat reikia bendrų standartų, įskaitant kriterijus, kada plėtrą reikėtų sulėtinti ar sustabdyti.
Ant kortos pastatyta labai daug. Pažangusis DI gali paspartinti naujų vaistų kūrimą, sustiprinti ypatingos svarbos infrastruktūrą, išplėsti ekonomines galimybes ir padėti išspręsti mokslines problemas, kurių nepavyko įveikti net kelioms žmonių kartoms. Tačiau galimybės, dėl kurių modeliai tampa naudingesni, neatsiejamos ir nuo rizikos, be to, jie neliks uždaryti vos keliose priešakinių technologijų laboratorijose. Visame pasaulyje kuriami modeliai, įskaitant atviruosius modelius, vis labiau artės prie šiandieninių priešakinių technologijų ir taps plačiai prieinami.
„Astra“ galimybės, ankstyvieji DI skatinamo tyrimų spartėjimo įrodymai ir Jakubo esė rodo tą pačią kryptį: DI tobulėja sparčiai, o politika privalo neatsilikti.
Gregas Brockmanas aprašė „gynėjų langą“(atsidaro naujame lange) – ribotą laikotarpį, kai priešakinis DI gali padėti gynėjams sustiprinti ypatingos svarbos sistemas, kol nepaplito galingos puolamosios galimybės. Politikos formuotojai susiduria su analogiška situacija: užsiveriančiu langu, per kurį privalu sukurti ilgalaikes apsaugos priemones, kol DI galimybės nepralenkė už jų valdymą atsakingų institucijų.
Augant galimybėms, pasitikėjimas sauga privalo vis labiau diktuoti DI pažangos tempą. Sauga netrukdo pažangai – priešingai, ji leidžia pažangai žengti dar toliau ir teikti naudą daugiau žmonių.
Sustiprinome stebėsenos, suderinimo ir saugumo priemones visame modelio kūrimo cikle, įskaitant griežtesnę priešakinių tyrimų darbo krūvių izoliaciją, išplėstinę modelio elgsenos stebėseną įrankiais paremto mokymo ir vertinimų metu bei aiškesnes taisykles, kada reikia perduoti informaciją apie kylančias problemas. Kalbant apie „Astra“, taip pat įdiegėme visuotinę visų trajektorijų, įskaitant minčių grandines, stebėseną bei privalomą suderinimo vertinimo etapą prieš pradedant platesnį naudojimą įmonės viduje.
Šios apsaugos priemonės privalo ir toliau išlikti žingsniu priekyje modelių galimybių. Tais atvejais, kai tolesni veiksmai keltų nepriimtiną saugos riziką, sulėtinsime arba sustabdysime sistemų, kurioms negalime užtikrinti pakankamos apsaugos, kūrimą ar diegimą – taip, kaip darėme anksčiau ir kaip to reikalaujama mūsų pasirengimo sistemoje(atsidaro naujame lange).
Visiškai savarankiškas rekursinis tobulėjimas – kai DI sistemos savarankiškai kuria vis pajėgesnes vėlesnes DI kartas – šiandien nevyksta. Neturėtume to siekti, kol negalėsime to daryti saugiai.
Tačiau DI jau dabar spartina dalį tyrimų, pasitelkiamų kuriant ir suderinant naujos kartos modelius. Naujausi mūsų tyrimai rodo, kad DI agentai gali atlikti kai kurias užduotis, kurioms patyrę tyrėjai skirtų kelias dienas. Tai nėra rekursinis savarankiškas tobulėjimas, tačiau tai rodo judėjimo kryptį.
Šį pagreitį galima ir privalu nukreipti į saugą. Mūsų tikslas – saugiai sukurti automatizuotus DI tyrėjus, kurie dirbtų prižiūrimi žmonių ir tobulintų tiek gilųjį mokymąsi, tiek suderinimą, o kiekviena nauja DI karta padėtų užtikrinti, kad kita būtų saugesnė, geriau suderinta ir lengviau valdoma, o ne vien pajėgesnė.
Vyriausybės turėtų sukurti bendrus šios pažangos matavimo būdus, išlaikyti realią žmogaus kontrolę ir nustatyti bendrus saugos standartus, numatančius, kada ir kaip plėtra turėtų sulėtėti ar sustoti. Jei negalime pasiekti tam tikrų saugos standartų nesulėtindami galimybių augimo, pirmenybę turėtume teikti saugai. Kuo galingesnė tampa technologija, tuo stipresnės privalo būti apsaugos priemonės.
DI spartinamos DI plėtros perspektyva reikalauja daugiau nei vien savanoriškų įsipareigojimų. Jungtinėms Valstijoms reikia privalomo, galimybėmis pagrįsto nacionalinio reglamentavimo, galinčio tobulėti kartu su technologijomis.
Mūsų Priešakinio DI demokratinio valdymo plane (angl. „Blueprint for Democratic Governance of Frontier AI“) nubrėžtas kelias į tvarią federalinę sistemą: bendri testavimo ir nepriklausomo vertinimo reikalavimai, stipresnės kibernetinio saugumo apsaugos priemonės, aiškios pranešimų apie incidentus taisyklės, didesnis nacionalinis pasirengimas ir bendros priemonės, skirtos stebėti pažangą siekiant rekursinio savarankiško tobulėjimo.
Šiuo metu Kongrese formuojami keli rimti priešakinių technologijų saugos pasiūlymai. Toliau konstruktyviai bendradarbiausime ir tikimės palaikyti teisės aktus, reikšmingai keliančius saugos standartus. Kai ant kortos pastatyta tiek daug, tobulybės siekis neturi trukdyti geriems sprendimams. Kongresas turėtų imtis veiksmų dar prieš baigdamas sesiją.
Nacionalinė sistema turėtų būti griežta, bet tikslinga. Priešakinių technologijų saugos reikalavimai turėtų būti taikomi vos kelioms didelius išteklius turinčioms laboratorijoms, kuriančioms pajėgiausias sistemas, o ne startuoliams, smulkiesiems kūrėjams ar tyrėjams, dirbantiems toli nuo priešakinių technologijų ribos. Įsipareigojimai turi būti proporcingi galimybėms ir rizikai.
Be to, priešakinių technologijų saugos politika neturėtų tapti atvirųjų svorių politika kitu pavadinimu. Atvirieji modeliai gali būti sprendimo dalis, ypač kibernetinio saugumo srityje ir ten, kur suvereniteto, saugumo ar duomenų saugojimo vietos poreikiai skatina rinktis vietinį diegimą. Dauguma jų konkuruoja ne priešakinių technologijų srityje, bet dėl kainos, valdymo ir vėlavimo. Kaip patvirtinome pasirašydami Atvirųjų svorių ir Amerikos DI lyderystės laišką(atsidaro naujame lange) (angl. „Open Weights and American AI Leadership letter“), Amerikai reikia tiek atvirųjų, tiek uždarųjų modelių. Federalinė sistema turėtų valdyti priešakines galimybes ir riziką, nesusilpnindama konkurencijos, neįtvirtindama esamų rinkos lyderių dominavimo ir neišstumdama inovacijų į užsienį.
Rimta viešoji sistema turėtų mažinti, o ne didinti galios koncentraciją. Šiandien priešakinių technologijų laboratorijos dažniausiai pačios nusistato taisykles priešakinei rizikai valdyti. Demokratiškai atskaitingi standartai, nepriklausomas patikrinimas ir prasmingas skaidrumas pakeistų šią suskaidytą privataus valdymo sistemą.
Tai – būtina Amerikos lyderystės sąlyga. Jungtinės Valstijos negali laimėti DI eroje pasikliaudamos vien galimybėmis. Technologinis pranašumas neturės reikšmės, jei žmonės, institucijos ir vyriausybės nepasitikės technologija pakankamai, kad ją pradėtų naudoti. Griežtos apsaugos priemonės nėra nuolaidžiavimas inovacijų sąskaita. Jos yra infrastruktūros dalis, būtina plačiam naudojimui ir ilgalaikei Amerikos lyderystei.
Nacionaliniai DI standartai – gyvybiškai svarbūs, ir kiekvienas, kuriantis priešakines technologijas, mato šį skubumą. Kol Kongresas nesiima veiksmų, valstijos turėtų ir toliau pildyti šį vakuumą ir kelti kartelę.
„OpenAI“ palaikė Kalifornijos įstatymo projektą SB 53, Niujorko RAISE aktą, Ilinojaus įstatymo projektą SB 315 ir Masačusetse svarstomuose priešakinių technologijų saugos teisės aktuose numatytus nepriklausomus auditus. Skatiname valstijas susitarti dėl šių bendrų apsaugos priemonių. Taip jos gali sukurti faktinį nacionalinį standartą, kurį vėliau Kongresas galėtų įtvirtinti įstatymais – šį metodą vadiname atvirkštiniu federalizmu. Tačiau suderinti nereiškia įšaldyti reikalavimų.
Šiandien oficialiai palaikome dar keturis Kalifornijos įstatymų projektus, kuriuos priėmė parlamentas ir perdavė gubernatoriui G. Newsomui. Kartu jie apima viena kitą papildančias DI saugos ekosistemos sritis.
SB 813(atsidaro naujame lange) nustatytų kvalifikuotų nepriklausomų organizacijų, galinčių vertinti DI rizikos veiksnius, skyrimo tvarką. Kaip jau minėjome savo (atsidaro naujame lange)priešakinių technologijų saugos plane(atsidaro naujame lange), teikiame pirmenybę privalomiems nepriklausomiems techniniams vertinimams federaliniu lygmeniu, kur politikos formuotojai galėtų nustatyti vienodus standartus vertintojų kvalifikacijai, saugumui ir prieigai prie itin neskelbtinos informacijos. Vis dėlto kol nesiimama federalinių veiksmų, Kalifornija gali padėti nustatyti pagrindines taisykles saugiai ir veiksmingai nacionalinei nepriklausomo vertinimo sistemai, užtikrinančiai geresnius saugos rezultatus.
AB 1405(atsidaro naujame lange) nustatytų registracijos, nepriklausomumo, skaidrumo ir atskaitomybės reikalavimus DI auditoriams.
SB 1119(atsidaro naujame lange) reikalautų amžiaus patvirtinimo, rizikos vertinimų, nepriklausomų auditų, tėvų kontrolės ir apsaugos nuo žalingo turinio priemonių vaikams bei paaugliams, naudojantiems virtualius pokalbių robotus. Neseniai palaikėme šį įstatymo projektą, papildantį jaunimo saugos priemones, kurias „OpenAI“ diegia savo produktuose, įtvirtina pasaulinėse politikos gairėse, skatina palaikydama (atsidaro naujame lange)Tėvų ir vaikų saugaus DI aktą(atsidaro naujame lange) (angl. „Parents & Kids Safe AI Act“) ir taiko paaugliams skirtame „ChatGPT“ per įdiegtas apsaugos funkcijas – įskaitant griežtesnes numatytąsias nuostatas jautriose srityse, funkcijas „Quiet Hours“ (Ramybės valandos), „Study Hours“ (Mokymosi valandos) ir priminimus pailsėti.
AB 1864(atsidaro naujame lange) įpareigotų genų sintezės paslaugų teikėjus ir stalinės sintezės įrangos gamintojus laikytis federalinių patikros standartų ir taip sustiprintų svarbią fizinę apsaugą nuo su DI susijusių biologinių grėsmių.
Anksčiau kai kurių iš šių įstatymų projektų nepalaikėme, tačiau dabar, atsižvelgdami į naujausią modelių pajėgumų šuolį, persvarstėme savo poziciją ir jiems pritariame.
Šie įstatymų projektai nepakeičia federalinio reglamentavimo. Tai – rimtos pastangos, galinčios apsaugoti žmones jau dabar, parodyti, kaip atrodo veiksmingos apsaugos priemonės, ir padėti kurti postūmį federaliniams veiksmams.
Vien įstatymai neužtikrins pažangiojo DI saugos. Taip pat būtinos konkrečios praktikos pačiose laboratorijose, kuriančiose pajėgiausias sistemas. Skubiausias žingsnis – stebėsena.
Tai ypač svarbu dėl suderinamumo trūkumo – kai modelis siekia tikslo pažeisdamas žmogaus ketinimus ar nustatytas ribas, neturėdamas sąmonės ar piktų kėslų. Kadangi modeliai tampa savarankiškesni, naudoja galingesnius įrankius ir veikia ilgiau, kūrėjai turėtų būti įpareigoti stebėti šią nesuderintą elgseną ir įrodyti, kad taiko veiksmingas apsaugos priemones.
Stebėsena privalo būti susieta su aiškiais informacijos atskleidimo reikalavimais. Kaip jau siūlėme Kalifornijoje, įmonės turėtų būti įpareigotos nedelsdamos raštu pranešti paveiktoms šalims, jeigu kuriant ar vertinant jų modeliai be leidimo apeitų kitos organizacijos saugumo kontrolės priemones ir faktiškai pasiektų, pakeistų ar sunaikintų tos organizacijos apsaugotas sistemas arba konfidencialią informaciją. Taip pat palaikome federalinius atskaitomybės reikalavimus dėl kitų rimtų DI incidentų ir siekiame apibrėžti, kokiems incidentams tai turėtų būti taikoma ir ką šie reikalavimai turėtų apimti.
Kaip paskelbėme praėjusią savaitę, „OpenAI“ kuria sistemą, skirtą pranešti apie reikšmingus suderinamumo trūkumo incidentus ir sistemingai stebėti priešakinių modelių veiklą, įskaitant vidinį naudojimą. Tai prasideda kaip įmonės iniciatyva, tačiau tikimės, kad ji padės formuoti platesnę federalinę politiką ir atskaitomybės reikalavimus.
Norime bendradarbiauti su kitomis laboratorijomis kuriant pramonės inicijuotus standartus. Pramonės inicijuoti standartai papildytų – o ne pakeistų – privalomas federalines apsaugos priemones ir demokratinę priežiūrą. Tačiau žengėme į naują DI galimybių etapą, todėl reikia svarstyti visus variantus, įskaitant tai, ką, kaip skubų žingsnį, galima savanoriškai sukurti nevyriausybiniu lygmeniu.
Galiausiai bet kokie tokie standartai privalo peržengti ir valstybių sienas. Modeliai, tyrimai ir techninės žinios plinta visame pasaulyje, o su pajėgiausiomis sistemomis susijusios nesėkmės gali turėti pasekmių toli už jas sukūrusios šalies ribų. Jei Jungtinės Valstijos nori pirmauti tarptautinėje arenoje, jos privalo nustatyti patikimus standartus savo šalyje – ir esame vis labiau įsitikinę, kad bus būtini suderinami tarptautiniai standartai.
DI politikos langas kol kas atviras. Ketiname juo pasinaudoti.
Tai reiškia, kad privalome veikti skubiai, nuolankiai ir būti pasirengę prisitaikyti. Taip pat tai reiškia palaikyti rimtus pasiūlymus, reikšmingai keliančius saugos kartelę, net jei jie nėra visiškai tokie, kokius būtume sukūrę patys. Ir tai reiškia, kad tobulėjant technologijoms privalome stiprinti šią sistemą.
Nė vienas pirmas žingsnis nebus tobulas. Tačiau dabar didesnė rizika – per ilgai delsti jį žengti.


