Pagbuo ng mga pamantayan para sa susunod na yugto ng AI
Misyon naming tiyaking nakikinabang ang buong sangkatauhan sa artificial general intelligence. Gaya ng binalangkas kamakailan ni Sam Altman at ni Jakub Pachocki, inuuna namin ang aming gawain para sa misyong ito ayon sa tatlong pangunahing layunin:
Pamahalaan ang susunod na panahon ng pag-unlad ng AI sa pamamagitan ng pagbuo ng isang awtomatikong AI researcher, pakikipagtulungan dito nang paulit-ulit sa problema ng alignment, at paghahanap ng mga paraan upang manatiling bahagi ang mga tao ng proseso ng pagpapahusay sa sarili.
Ihatid ang mga pakinabang ng siyentipikong pag-unlad at paglago ng ekonomiya na ginagawang posible ng mga makinang may napakataas na intelligence.
Bigyan ang bawat isa ng kapangyarihan sa pamamagitan ng personal na AGI.
Pinabibilis ng AI ang sarili naming pananaliksik at engineering, at nagbunga ang pananaliksik na pinagana ng AI ng mga pagsulong sa matematika, kabilang ang Navier-Stokes Millennium Problem. Malaki ang maitutulong ng pag-unlad na ito sa dalawa pa naming layunin, na maaaring humantong sa mahahalagang tuklas sa medisina, pangangalagang pangkalusugan na malawak na naaabot, at pagbibigay-kakayahang pang-ekonomiya sa maliliit na negosyo at mga indibidwal na negosyante saanman.
Sumusulong ang AI sa maraming kumpanya at bansa, at binabago ng pag-unlad sa buong larangan ang mga oportunidad at hamong kinakaharap ng lahat. Kasabay ng iba pang mga pakinabang nito, magiging mahalagang bahagi ng pamamahala natin sa transisyong ito ang mahusay at nakaayon na AI—palalakasin nito ang mga depensa, isusulong ang pananaliksik sa alignment, at tutulungan ang mga taong maunawaan at gabayan ang mga susunod na yugto ng pag-unlad ng AI.
Upang ligtas na mapamahalaan ang transisyong ito, kailangang makasabay ng pananaliksik sa alignment ang mga kakayahang ito nang sa gayon ay manatiling nakaayon sa mga pagpapahalaga ng tao at nasa ilalim ng kontrol ng tao ang mga sistemang binubuo namin at ng iba. Lalo itong nagiging mahalaga habang tumataas ang kakayahan at awtonomiya ng mga AI system, kabilang ang pag-ako nila ng mas malaking bahagi ng pananaliksik at pagpapaunlad mismo ng AI. Upang manatiling ligtas at kapaki-pakinabang ang patuloy na pag-unlad ng AI, kakailanganin ang mga pagsulong sa pananaliksik sa alignment at mga iisang pamantayang gagabay sa pagpapaunlad sa mga laboratoryo at bansa.
Maaaring mag-iba-iba ang antas ng pangangasiwa ng tao sa awtomatikong pananaliksik sa AI. Habang inaako ng mga AI system ang mas malaking bahagi ng pagbuo ng magkakasunod na henerasyon ng AI, lalo nilang mapauusad ang proseso ng recursive self-improvement (RSI), kahit nananatiling sangkot ang mga tao. Habang lalong nagiging awtomatiko ang prosesong ito, maaaring bumilis nang husto ang pag-unlad ng AI.
Naniniwala kaming magbubunga ang awtomatikong pananaliksik sa AI ng mga modelong tuwirang magpapabuti sa buhay ng mga tao. Mapabababa nito ang halaga ng advanced na intelligence upang makinabang ang mga tao sa buong mundo. Maaari din kaming tulungan ng awtomatikong pananaliksik na lubos na mapahusay ang alignment at bumuo ng mga depensa laban sa AI na patuloy na humuhusay—maaari ring maging awtomatikong AI researcher sa kaligtasan ang isang awtomatikong AI researcher. Makakatulong ang mas mahusay at nakaayon na mga sistema na panatilihing ligtas ang kritikal na imprastraktura, ipagtanggol tayo laban sa mapanganib na mga AI agent, at bumuo ng mga bagong hakbang sa proteksiyon.
Hindi pa nangyayari ngayon ang ganap na autonomous na RSI, at hindi natin ito dapat isulong maliban kung at hangga't hindi ito maisasagawa nang ligtas. Ang pagpapasya kung magpapatuloy at kung paano ito gagawin ay dapat nakasalalay sa kakayahan nating mapanatili ang kontrol ng tao at sa mga demokratikong pasyang nakabatay sa sapat na kaalaman(magbubukas sa bagong window) tungkol sa mga pakinabang at panganib. Kung gagawin nang walang nararapat na pag-iingat, maaaring humantong ang RSI sa pagkawala ng praktikal na kontrol ng mga tao sa pag-unlad ng AI at sa kawalan nila ng kakayahang pangasiwaan ang mga proseso ng pananaliksik na hindi na nila nauunawaan. Mula rito, maaaring maging mas mapanganib at hindi gaanong nakaayon ang AI, at sa kabuuan ay magdulot ng panganib sa mga tao. Bagama't hindi tuwirang resulta ng RSI, ang Hugging Face Incident na isiniwalat namin ay nagbibigay ng paunang larawan ng mga uri ng panganib na maaaring lumubha nang husto kung walang matitibay na pananggalang at alignment.
Ang mga internasyonal na pamantayan para sa mga gawain sa kaligtasan at seguridad sa pagpapaunlad ng frontier AI ay maaaring maging kasinghalaga ng mismong pananaliksik sa alignment sa pagtukoy sa bilis ng pag-usad sa frontier. Maaaring magtakda ang mga pamantayan ng magkakatulad na kahulugan ng de-kalidad na ebidensiya at napagkasunduang mga batayan para sa higpit ng mga teknikal na pananggalang. Sa madaling salita, tinutulungan tayo nitong sagutin ang tanong na, “Ano ang maituturing na mahusay na paraan ng pagbawas sa panganib ng sakuna mula sa AI?”
Makakatulong dito ang mga umiiral na demokratikong institusyon gaya ng Center for AI Standards and Innovation (CAISI), mga batas ng estado, at isang pederal na balangkas para sa AI, gayundin ang mga bagong anyo ng pakikipagtulungan ng pampubliko at pribadong sektor(magbubukas sa bagong window). Ngunit nagaganap ang pagpapaunlad at pagpapatupad ng AI sa maraming bansa, ginagamit na ito sa buong mundo, at malamang na maranasan ng lahat ang mga epekto nito sa iba't ibang paraan at panahon.
Dahil dito, kailangan ang mga internasyonal na pagsisikap na bumuo ng mga pamantayan upang lutasin ang ilang pangunahing hamon:
Pagkawatak-watak—Maaaring magkasalungat ang mga pagsusuri, kinakailangan sa pag-uulat, at depinisyon ng insidente ng iba't ibang bansa, kaya mas mahirap paghambingin ang ebidensiya, unawain ang mga bagong kakayahan, at tumugon sa mga panganib na tumatawid sa mga hangganan.
Sama-samang pagkilos—Kapag kumilos nang hiwalay ang bawat bansa, maaari itong magbunga ng mga resultang ayaw ng lahat ng bansa. Kayang pabilisin ng RSI ang mismong pananaliksik sa AI, posibleng lampas sa sama-sama nating kakayahang unawain ang pag-unlad, tasahin ang mga panganib, at panatilihin ang makabuluhang pangangasiwa ng tao.
Hindi pantay na kakayahan—Hindi pantay ang pagkakabahagi sa buong mundo ng mga gawain sa pagpapaunlad ng frontier AI at kaugnay na kadalubhasaan. Lalo nitong pinalalala ang dalawang problemang nabanggit.
Nalalapat ang mga hamong ito sa mga open at closed na modelo.
Upang maging malinaw, dapat managot ang anumang AI lab na nagsasagawa ng awtomatikong pananaliksik sa AI o bumubuo ng iba pang advanced na kakayahan sa ligtas na paggawa nito, alinsunod sa mga pangunahing prinsipyo ng pananagutan sa sarili at mga umiiral na batas. Nakaugat ang aming batayan para sa mga pamantayan sa pag-iwas sa pagkonsentra ng kapangyarihan at pagkamit ng mas mahuhusay na praktikal na resulta. Nagbibigay ang mga pamantayan ng paraan upang makapagbigay ng opinyon ang mas maraming stakeholder sa labas ng mga laboratoryo kung paano dapat umunlad ang teknolohiyang ito, at ng malinaw na hanay ng mga prinsipyong maaasahan anuman ang partikular na gawain ng alinmang laboratoryo. At malamang na makakamit natin ang mas magagandang resulta kung magtutulungan ang mga panig upang tugunan ang mga hamon sa itaas.
Kaya naniniwala kaming dapat pangunahan ng Estados Unidos ang pakikipagtulungan sa mga bansa sa buong mundo upang bumuo ng mga pandaigdigang teknikal na pamantayan para sa frontier AI, kabilang ang RSI.
Bagama't inaasahan naming malaki ang magiging pagbabago sa konseptong ito sa paglipas ng panahon, dalawang aspeto ang magiging mahalaga.
Isang paraan upang maisakatuparan ito ang paggamit sa umuusbong na network ng mga instituto para sa kaligtasan ng AI—gaya ng mga naitatag na sa Australia, Canada, Germany, France, Kenya, Japan, Korea, Singapore, India, at United Kingdom—upang mapadali ang pagtatakda ng mga pamantayan sa pamamagitan ng CAISI at mga pambansang samahan ng industriya, na partikular na nakatuon sa (1) mga frontier AI model at developer, ayon sa mga benchmark ng kakayahan; at (2) pamamahala ng pakinabang at panganib para sa awtomatikong pananaliksik sa AI, kabilang ang RSI. Maaaring palawakin ng Estados Unidos ang paglikha ng CAISI sa International Network for Advanced AI Measurement, Evaluation, and Science(magbubukas sa bagong window) noong 2024, na pinag-uugnay ang mga pampublikong institusyon upang magtulungan sa pagsukat, pagsusuri, at agham ng AI.
Magbibigay ang mga pamantayang bubuuin sa pagsisikap na ito ng iisang teknikal na pundasyon para sa pagsukat at pagsusuri ng kakayahan, pagtatasa ng panganib, at kasapatan ng mga pananggalang. Ang mga teknikal na pamantayang ito ay hindi magiging mga lisensiya, sapilitang pagsusuri bago ilabas, o kinakailangan sa pag-apruba para sa mga modelo ng AI. Ang mga pambansang pamahalaan ang magpapasya kung isasama ang mga pamantayang ito sa sarili nilang mga sistemang legal at kung paano.
Dapat ding suportahan ng gawaing ito ang isang kompetitibong ecosystem ng AI sa pamamagitan ng pagkonsulta sa mga developer ng open na modelo at saradong modelo, mga independiyenteng teknikal na eksperto, at akademya. Dapat buuin nang malinaw ang mga iisang pamantayan at idisenyo upang hindi nito paboran ang mga partikular na kumpanya, bansa, o modelo ng negosyo, kabilang ang pag-iwas na pahirapan ang mga bagong kalahok o developer ng open-weight na makipagkompetensiya.
Gaya ng aming iminungkahi(magbubukas sa bagong window), maaaring matuto ang pamamaraang ito mula sa mga larangan gaya ng abyasyon at katatagan ng pananalapi, kung saan nakabuo ang mga bansa ng magkakatulad na teknikal na pamantayan at mapagkakatiwalaang mga paraan ng pakikipagtulungan nang hindi isinusuko ang pambansang awtoridad. Dapat din itong makipagtulungan nang malapitan sa mga matagal nang umiiral at mas bagong organisasyon sa pamantayan gaya ng ISO(magbubukas sa bagong window), Frontier Model Forum(magbubukas sa bagong window), Agentic AI Foundation(magbubukas sa bagong window), at Open Secure AI Alliance(magbubukas sa bagong window), gayundin sa mga organisasyong nakatuon sa pagpapatupad gaya ng Appia Foundation, na bumubuo ng mga praktikal na espesipikasyong nag-uugnay sa mga internasyonal na pamantayan at aktuwal na pagtatasa ng AI.
Magiging lubhang mahalaga ang mga internasyonal na pamantayan sa AI sa pamamahala sa tumataas na awtonomiya sa pananaliksik sa AI at recursive self-improvement. Sa partikular, maaaring kabilang dito ang mga pamantayan para sa:
Pagsusuri sa pag-unlad ng AI na may kaugnayan sa RSI at sa dami ng autonomous na pananaliksik na nagaganap sa loob ng isang kumpanya ng AI. Ang aming kamakailang ulat tungkol sa pagpapabilis ng pananaliksik ay isang paunang ambag sa pagsisikap na ito.
Pangangasiwa ng tao sa awtomatikong pananaliksik sa AI, kabilang ang mga uri ng proseso ng awtomatikong pananaliksik sa AI na dapat magbunsod ng agarang pagsusuri ng tao.
Pag-uuri, pagsubaybay, pag-uulat, at pagtugon sa mga insidenteng may kaugnayan sa alignment at awtomatikong pananaliksik sa AI, gaya ng magkakatulad na antas ng tindi ng insidente at mga pamantayan kung kailan dapat mag-ulat. Isang paunang ambag ang aming balangkas sa pag-uulat ng misalignment.
Bukod sa mga pamantayang ito, naniniwala kaming mahalagang magtatag ang mga operator ng kritikal na imprastraktura at mga pamahalaan sa buong mundo ng mga ligtas na paraan ng komunikasyon upang magbahagi ng mga alalahanin sa pambansang seguridad, mga bagong kahinaan at banta, at pinakamahuhusay na gawain sa mabilis na umuunlad na larangan ng kaligtasan ng frontier AI. Magiging positibong hakbang ang dayalogo ng Estados Unidos at China sa mga larangang ito, at napapanahon ang mga nalalapit na pag-uusap.
Ang pagtukoy sa bilis ng pag-unlad ng AI ay hindi tungkol sa pagpapanatili ng bilis na itinakda na. Sa teknikal na aspeto, layunin nitong tiyaking nauuna sa mga kakayahan ang pananaliksik sa alignment at ang pagpapatupad ng mga resulta nito. Sa aspeto ng lipunan, layunin nitong gamitin ang mga pamantayan, institusyon, at pagtutulungan upang palakasin ang mga network ng industriya, ugnayang panlipunan, at puwersa ng merkado at makalikha ng mga resultang kapaki-pakinabang sa lahat. Ang kamakailang panawagan para sa sama-samang pagkilos sa cyber defense ay isang halimbawa nito.
Nasa magandang posisyon ang Estados Unidos upang manguna dahil nasa teknikal na frontier ang industriya nito ng AI, at nananatili itong nasa pribilehiyadong posisyon sa pandaigdigang network sa mahahalagang larangan gaya ng pananalapi, kalakalan, depensa, teknolohiya, at mga sistema ng impormasyon. Ang pangunguna ngayon ang magtatakda kung huhubugin ng Estados Unidos ang pandaigdigang balangkas para sa AI o masasaksihan nitong mamayani sa paligid nito ang isang watak-watak, hindi pantay, at puno ng tunggaliang sistema. Itatakda rin nito kung mapalalakas ng advanced na AI ang mga umiiral nang network ng Estados Unidos at mga kaalyado nito; maaaring pahinain ang mga ito ng kabiguang manguna.
Ang kompetisyong heopolitikal ay hindi lamang iikot sa kung sino ang nangunguna sa teknolohiya, kundi pati sa paggamit at pagpapalaganap ng AI. Higit na matutukoy ang paggamit at pagpapalaganap nito ng sinumang nangunguna sa makatotohanang kooperasyon at makatuwirang mga tuntunin na nanaisin ng mga negosyo at lipunan saanman kung iaasa nila ang kanilang kinabukasan sa teknolohiyang ito.
Ang matatag na pambansang pamamahala, na pinag-uugnay ng praktikal na internasyonal na kooperasyon, ay nag-aalok ng landas tungo sa mas mahuhusay na proteksiyon, patuloy na inobasyon, at malawak na access sa mga pakinabang ng AI.


