Þróun staðla fyrir næsta skeið gervigreindar
Markmið okkar er að tryggja að almenn gervigreind verði öllu mannkyni til góðs. Eins og Sam Altman lýsti nýlega, ásamt Jakub Pachocki, forgangsröðum við starfi okkar að þessu markmiði út frá þremur meginmarkmiðum:
Að komast farsællega í gegnum næsta skeið framfara í gervigreind með því að smíða sjálfvirkan gervigreindarrannsakanda, vinna með honum ítrekað að samstillingarvandanum og finna leiðir til að fólk verði áfram þátttakendur í sjálfsbætingarferlinu.
Að miðla ávinningi vísindaframfara og hagvaxtar sem mjög greindar vélar gera mögulegan.
Að veita hverjum og einum aukin tækifæri með persónulegri AGG.
Gervigreind flýtir fyrir rannsóknum okkar og verkfræðivinnu og rannsóknir með aðstoð gervigreindar hafa leitt til framfara í stærðfræði, meðal annars varðandi þúsaldarvandamálið um Navier–Stokes-jöfnurnar. Þessar framfarir lofa góðu fyrir hin tvö markmið okkar og gætu leitt til mikilvægra uppgötvana í læknisfræði, heilbrigðisþjónustu sem er aðgengileg sem flestum og aukinna efnahagslegra tækifæra fyrir smáfyrirtæki og sjálfstæða frumkvöðla um allan heim.
Gervigreind fleygir fram hjá mörgum fyrirtækjum og í fjölmörgum löndum og framfarir á sviðinu breyta þeim tækifærum og áskorunum sem allir standa frammi fyrir. Samhliða öðrum ávinningi verður öflug, samstillt gervigreind mikilvæg til að komast farsællega í gegnum þessi umskipti—með því að styrkja varnir, efla rannsóknir á samstillingu og hjálpa fólki að skilja og leiðbeina næstu skrefum í þróun gervigreindar.
Til að komast örugglega í gegnum þessi umskipti þurfa rannsóknir á samstillingu að halda í við þessa getu svo að kerfin sem við og aðrir smíðum samræmist áfram mannlegum gildum og lúti stjórn manna. Þetta verður sífellt mikilvægara eftir því sem gervigreindarkerfi verða öflugri og sjálfstæðari, meðal annars þegar þau taka að sér stærri hluta rannsókna og þróunar á gervigreindinni sjálfri. Til að áframhaldandi framfarir í gervigreind verði öruggar og gagnlegar þarf bæði framfarir í rannsóknum á samstillingu og sameiginlega staðla sem leiðbeina þróun þvert á rannsóknarstofur og lönd.
Sjálfvirkar rannsóknir á gervigreind geta falið í sér mismikla umsjón manna. Eftir því sem gervigreindarkerfi taka að sér stærri hluta vinnunnar við þróun nýrra kynslóða gervigreindar geta þau í auknum mæli knúið áfram endurkvæma sjálfsbætingu (RSI), jafnvel þótt fólk taki áfram þátt. Eftir því sem ferlið verður sjálfvirkara gætu framfarir í gervigreind orðið mun hraðari.
Við teljum að sjálfvirkar rannsóknir á gervigreind muni skila líkönum sem bæta líf fólks með beinum hætti. Þær geta lækkað kostnað við háþróaða greind svo að fólk um allan heim geti notið ávinningsins. Sjálfvirkar rannsóknir gætu einnig hjálpað okkur að bæta samstillingu verulega og þróa varnir gegn sífellt öflugri gervigreind—sjálfvirkur gervigreindarrannsakandi getur jafnframt rannsakað öryggi gervigreindar sjálfvirkt. Öflugri, samstillt kerfi gætu hjálpað til við að tryggja mikilvæga innviði, verjast hættulegum gervigreindarfulltrúum og þróa nýjar verndarráðstafanir.
Algerlega sjálfstæð RSI á sér ekki stað í dag og við ættum ekki að stefna að henni nema og þar til hægt er að gera það með öruggum hætti. Hvort og hvernig eigi að halda áfram verður að ráðast af getu okkar til að viðhalda stjórn manna og af upplýstum lýðræðislegum ákvörðunum(opnast í nýjum glugga) um ávinninginn og áhættuna. Ef RSI er framkvæmd án viðeigandi aðgæslu og varúðar gæti fólk glatað raunverulegri stjórn á þróun gervigreindar og ekki lengur getað haft eftirlit með rannsóknarferlum sem það skilur ekki. Í kjölfarið gæti gervigreind orðið hættulegri, síður samstillt og í heildina skapað fólki hættu. Atvikið hjá Hugging Face sem við greindum frá var ekki bein afleiðing RSI en gefur vísbendingu um áhættuna sem gæti orðið mun alvarlegri án öflugra öryggisráðstafana og samstillingar.
Alþjóðlegir staðlar um öryggis- og verndarráðstafanir við þróun háþróaðrar gervigreindar gætu skipt jafnmiklu máli og samstillingarrannsóknir fyrir ábyrga framvindu á þessu sviði. Staðlar geta skapað sameiginlegar skilgreiningar á vönduðum sönnunargögnum og samþykkt lágmarksviðmið um traustleika tæknilegra öryggisráðstafana. Í stuttu máli hjálpa þeir okkur að svara spurningunni: „Hvernig lítur árangursrík mildun á hættu af hörmulegum afleiðingum gervigreindar út?“
Núverandi lýðræðislegar stofnanir á borð við Center for AI Standards and Innovation (CAISI), löggjöf einstakra ríkja og alríkisramma um gervigreind geta allar lagt sitt af mörkum, sem og ný samstarfsform opinberra aðila og einkaaðila(opnast í nýjum glugga). Þróun og innleiðing gervigreindar fer hins vegar fram í mörgum löndum, upptaka tækninnar er alþjóðleg og líklegt er að allir finni með einhverjum hætti fyrir áhrifum hennar fyrr eða síðar.
Því þarf alþjóðlegt átak við þróun staðla til að leysa nokkrar lykiláskoranir:
Sundurleitni—Mat, skýrslugjafarkröfur og skilgreiningar ríkja á atvikum gætu stangast á, sem torveldar samanburð sönnunargagna, skilning á nýrri getu og viðbrögð við áhættu sem nær yfir landamæri.
Sameiginlegar aðgerðir—Ef hvert ríki starfar sjálfstætt getur niðurstaðan orðið sú sem ekkert ríki vill. RSI getur hraðað sjálfum rannsóknum á gervigreind, hugsanlega umfram sameiginlega getu okkar til að skilja framfarirnar, meta áhættu og viðhalda raunverulegu eftirliti manna.
Ójöfn geta—Þróun háþróaðrar gervigreindar og tengd sérþekking dreifast ekki jafnt um heiminn. Þetta magnar bæði vandamálin hér að ofan.
Þessar áskoranir eiga bæði við um opin og lokuð líkön.
Svo það sé skýrt verður hver sú gervigreindarrannsóknarstofa sem stundar sjálfvirkar rannsóknir á gervigreind eða þróar aðra háþróaða getu að axla ábyrgð á því að gera það með öruggum hætti, í samræmi við grundvallarreglur um eigin ábyrgð og gildandi lög. Rök okkar fyrir stöðlum byggjast á því að forðast samþjöppun valds og ná betri árangri í framkvæmd. Staðlar gera fleiri hagsmunaaðilum utan rannsóknarstofanna kleift að hafa áhrif á þróun tækninnar og skapa sýnilegar meginreglur sem hægt er að reiða sig á óháð starfsháttum einstakra rannsóknarstofa. Og líklegt er að árangurinn verði betri ef aðilar vinna saman að því að takast á við áskoranirnar hér að ofan.
Þess vegna teljum við að Bandaríkin eigi að leiða samstarf við lönd um allan heim um þróun alþjóðlegra tæknistaðla fyrir háþróaða gervigreind, þar á meðal RSI.
Þótt við búumst við að þessi hugmynd þróist verulega með tímanum verða tveir þættir nauðsynlegir.
Ein leið væri að nýta hið vaxandi tengslanet stofnana um öryggi gervigreindar—eins og þeirra sem þegar hafa verið stofnaðar í Ástralíu, Kanada, Þýskalandi, Frakklandi, Kenía, Japan, Kóreu, Singapúr, Indlandi og Bretlandi—til að auðvelda staðlasetningu fyrir milligöngu CAISI og innlendra atvinnugreinasamtaka. Sérstök áhersla yrði lögð á (1) líkön og þróunaraðila háþróaðrar gervigreindar, metin með viðmiðum um getu, og (2) stýringu ávinnings og áhættu vegna sjálfvirkra gervigreindarrannsókna, þar á meðal RSI. Bandaríkin geta byggt á stofnun CAISI árið 2024 á Alþjóðlega samstarfsnetinu um mælingar, mat og vísindi háþróaðrar gervigreindar(opnast í nýjum glugga), sem sameinar opinberar stofnanir í samstarfi um mælingar, mat og vísindi gervigreindar.
Staðlar sem þetta átak skilar myndu skapa sameiginlegan tæknilegan grunn fyrir mælingu og mat á getu, áhættumat og mat á því hvort öryggisráðstafanir séu fullnægjandi. Þessir tæknistaðlar yrðu hvorki leyfi, skyldubundin skoðun fyrir útgáfu né samþykkiskröfur fyrir gervigreindarlíkön. Ríkisstjórnir hvers lands myndu ákveða hvort og hvernig staðlarnir yrðu felldir inn í þeirra eigin réttarkerfi.
Þetta starf ætti einnig að styðja við samkeppnishæft vistkerfi gervigreindar með samráði við þróunaraðila opinna og lokaðra líkana, óháða tæknisérfræðinga og háskólasamfélagið. Sameiginlegir staðlar ættu að vera þróaðir með gagnsæjum hætti og þannig úr garði gerðir að þeir hygli ekki tilteknum fyrirtækjum, löndum eða viðskiptalíkönum, meðal annars með því að torvelda nýjum aðilum eða þróunaraðilum líkana með opnum vigtum samkeppni.
Eins og við höfum lagt til(opnast í nýjum glugga) getur þessi nálgun dregið lærdóm af sviðum á borð við flug og fjármálastöðugleika, þar sem lönd hafa þróað sameiginlega tæknistaðla og traustar samstarfsleiðir án þess að afsala sér innlendu ákvörðunarvaldi. Einnig ætti að vinna náið með rótgrónum og nýrri staðlastofnunum á borð við ISO(opnast í nýjum glugga), Frontier Model Forum(opnast í nýjum glugga), Agentic AI Foundation(opnast í nýjum glugga) og Open Secure AI Alliance(opnast í nýjum glugga), auk stofnana sem leggja áherslu á innleiðingu, svo sem Appia Foundation, sem þróar hagnýtar forskriftir sem tengja alþjóðlega staðla við raunverulegt mat á gervigreind.
Alþjóðlegir staðlar um gervigreind verða sérstaklega mikilvægir við að stýra auknu sjálfstæði í rannsóknum á gervigreind og endurkvæmri sjálfsbætingu. Nánar tiltekið gætu þeir meðal annars náð til staðla um:
Mat á framförum í gervigreind sem skipta máli fyrir RSI og umfangi sjálfstæðra rannsókna innan gervigreindarfyrirtækis. Nýleg skýrsla okkar um hröðun rannsókna er fyrsta framlag til þessa starfs.
Umsjón manna með sjálfvirkum rannsóknum á gervigreind, þar á meðal hvaða tegundir slíkra rannsóknarferla eigi að kalla á tafarlausa yfirferð manna.
Flokkun, skráningu, tilkynningu og viðbrögð við atvikum sem tengjast samstillingu og sjálfvirkum gervigreindarrannsóknum, svo sem sameiginleg alvarleikastig atvika og viðmiðunarmörk tilkynninga. Rammi okkar um tilkynningar vegna misstillingar er snemma framlag til þessa starfs.
Auk þessara staðla teljum við mikilvægt að rekstraraðilar mikilvægra innviða og stjórnvöld um allan heim komi á öruggum samskiptaleiðum til að miðla áhyggjum af þjóðaröryggi, nýjum veikleikum og ógnum og bestu starfsvenjum á sviði öryggis háþróaðrar gervigreindar, sem þróast hratt. Samtal Bandaríkjanna og Kína á þessum sviðum væri jákvætt skref og fyrirhugaðar viðræður fara fram á heppilegum tíma.
Að stýra hraða þróunar gervigreindar snýst ekki um að halda fyrirfram ákveðnum hraða. Tæknilega séð snýst það um að tryggja að rannsóknir á samstillingu og hagnýting niðurstaðna þeirra haldist á undan getu kerfanna. Frá samfélagslegu sjónarhorni snýst það um að nota staðla, stofnanir og samstarf til að efla tengslanet atvinnulífs, samfélagsleg tengsl og markaðsöfl svo að niðurstöðurnar verði öllum í hag. Nýleg áskorun um sameiginlegar aðgerðir í netvörnum er dæmi um hið síðarnefnda.
Bandaríkin eru vel í stakk búin til að hafa forystu því gervigreindariðnaður þeirra er í fremstu röð tæknilega og landið nýtur enn forréttindastöðu í alþjóðlegum tengslanetum á mikilvægum sviðum á borð við fjármál, viðskipti, varnarmál, tækni og upplýsingakerfi. Forysta nú mun ráða því hvort Bandaríkin móta alþjóðlegan ramma um gervigreind eða horfa upp á sundurleitt, ójafnt og átakahrjáð kerfi festa rætur í kringum sig. Þetta mun einnig ráða því hvort háþróuð gervigreind styrkir þau tengslanet sem Bandaríkin og bandamenn þeirra búa þegar yfir; skortur á forystu gæti veikt þau.
Geópólitísk samkeppni mun ekki aðeins snúast um hver stendur tæknilega fremst heldur einnig um innleiðingu og útbreiðslu gervigreindar. Í auknum mæli gæti útbreiðslan ráðist af því hver leiðir raunhæft samstarf og mótar skynsamlegar leikreglur sem fyrirtæki og samfélög alls staðar munu vilja sjá áður en þau treysta framtíð sinni þessari tækni.
Öflug stjórnsýsla innan ríkja, tengd með hagnýtu alþjóðlegu samstarfi, getur leitt til traustari öryggisráðstafana, áframhaldandi nýsköpunar og víðtæks aðgangs að ávinningi gervigreindar.


