Okno za politiko umetne inteligence je odprto. Ukrepati moramo.
Avtor: Chris Lehane, glavni direktor za Iz sveta pri OpenAI
Vstopili smo v novo poglavje zmogljivosti umetne inteligence, zato potrebujemo tudi novo poglavje politike umetne inteligence. Nobeno podjetje, panoga ali vlada se s tem izzivom ne more spopasti samo. Na ta trenutek se moramo odzvati tako, da damo prednost smiselnemu ukrepanju pred popolnostjo politik.
To pa delamo na naslednji način:
Zavzemanje za obvezne nacionalne zahteve za varnost UI. Želimo sodelovati s kongresom pri obvezni nacionalni ureditvi varnosti UI, ki temelji na zmogljivostih.
Ohranjanje zagona v zveznih državah. Dokler kongres ne ukrepa, bomo še naprej podpirali zakonodajo zveznih držav, ki krepi širši ekosistem varnosti umetne inteligence. Danes napovedujemo podporo štirim kalifornijskim predlogom zakonov: SB 813 o splošni infrastrukturi za neodvisna varnostna ocenjevanja, AB 1405 o standardih za revizorje umetne inteligence, SB 1119 o zaščiti mladih in AB 1864 o zaščitnih ukrepih proti biološkim grožnjam, ki jih omogoča umetna inteligenca.
Spodbujanje standardov, ki jih vodi industrija. Z drugimi prelomnimi laboratoriji bomo sodelovali pri spodbujanju standardov za prelomno UI ter že zdaj vzpostavili prostovoljno pobudo z vladno podporo ali brez nje.
Vzpostavljanje globalnih standardov. Zavzemali se bomo za združljive mednarodne pristope k merjenju zmogljivosti, obvladovanju tveganj, ohranjanju človeškega nadzora ter določanju, kdaj in kako bi bilo treba razvoj upočasniti ali ustaviti, tudi če to pomeni upočasnitev razvoja zmogljivosti modelov.
Naš glavni znanstvenik Jakub Pachocki je nedavno zapisal, da hiter vzpon strojne inteligence, vključno z možnostjo rekurzivnega samoizboljševanja, zahteva »skrajno previdnost«. OpenAI si bo še naprej prizadeval za tehnične rešitve za usklajevanje in spremljanje, gradil obrambne sisteme ter po potrebi upočasnil razvoj. Toda tehnično delo v posameznih laboratorijih ne bo dovolj. Potrebujemo tudi skupne standarde, med drugim o tem, kdaj bi bilo treba razvoj upočasniti ali ustaviti.
Na kocki je ogromno. Napredna umetna inteligenca bi lahko pospešila razvoj novih zdravil, okrepila kritično infrastrukturo, razširila gospodarske priložnosti in pomagala rešiti znanstvene probleme, ki so kljubovali prizadevanjem več generacij ljudi. Toda zmogljivosti, zaradi katerih so modeli uporabnejši, prinašajo tudi tveganja in ne bodo ostale omejene na peščico prelomnih laboratorijev. Modeli, razviti po vsem svetu, vključno z odprtimi modeli, se bodo vse bolj približevali današnji prelomni meji in postajali široko dostopni.
Zmogljivosti Astre, prvi dokazi o pospeševanju raziskav z umetno inteligenco in Jakubov esej kažejo v isto smer: umetna inteligenca hitro napreduje, politika pa mora slediti temu napredku.
Greg Brockman je opisal »okno za branitelje«(odpre se v novem oknu): omejeno obdobje, ko lahko prelomna umetna inteligenca pomaga braniteljem okrepiti kritične sisteme, preden se zmogljive napadalne zmožnosti močno razširijo. Oblikovalci politik so v podobnem položaju: okno za vzpostavitev trajnih zaščitnih ukrepov se zapira, preden zmogljivosti umetne inteligence prehitijo ustanove, odgovorne za njihovo upravljanje.
Z rastjo zmogljivosti mora zaupanje v varnost vse bolj določati hitrost napredka UI. Varnost ne ovira napredka; omogoča mu, da seže dlje in koristi več ljudem.
V celotnem življenjskem ciklu razvoja modela smo okrepili zaščitne ukrepe za spremljanje, usklajevanje in varnost, vključno z boljšo osamitvijo delovnih obremenitev pri prelomnih raziskavah, razširjenim spremljanjem vedenja modelov med usposabljanjem in ocenjevanjem z uporabo orodij ter jasnejšimi pravili o tem, kdaj stopnjevati pomisleke. Za Astro smo uvedli tudi celovito spremljanje celotnih potekov, vključno z verigami sklepanja, in obvezno kontrolno točko za ocenjevanje usklajenosti pred širšo notranjo uvedbo.
Ti zaščitni ukrepi morajo še naprej ostajati korak pred zmogljivostmi. Kadar bi nadaljevanje pomenilo nesprejemljivo varnostno tveganje, bomo upočasnili ali ustavili razvoj ali uvajanje sistemov, ki jih ne moremo dovolj zaščititi, kot smo že storili in kot zahteva naš okvir pripravljenosti(odpre se v novem oknu).
Popolnoma avtonomno rekurzivno samoizboljševanje, pri katerem sistemi umetne inteligence samostojno poganjajo zaporedne generacije vse zmogljivejše umetne inteligence, se danes ne dogaja. Zanj si ne bi smeli prizadevati, dokler ga ne bo mogoče izvajati varno.
Vendar umetna inteligenca že pospešuje dele raziskav, namenjenih razvoju in usklajevanju naslednje generacije modelov. Naše najnovejše raziskave kažejo, da lahko agenti umetne inteligence opravijo nekatere naloge, za katere bi usposobljeni raziskovalci potrebovali več dni. To ni rekurzivno samoizboljševanje, vendar je dokaz smeri razvoja.
Ta pospešek lahko in moramo usmeriti tudi v varnost. Naš cilj je varno razviti avtomatizirane raziskovalce umetne inteligence, ki bodo pod človeškim nadzorom izboljševali globoko učenje in usklajevanje ter z vsako generacijo umetne inteligence pomagali narediti naslednjo varnejšo, bolje usklajeno in lažje obvladljivo, ne le zmogljivejšo.
Vlade bi morale razviti skupne načine merjenja tega napredka, ohraniti smiseln človeški nadzor ter določiti skupne varnostne pragove glede tega, kdaj in kako bi bilo treba razvoj upočasniti ali ustaviti. Če določenih varnostnih pragov ne moremo doseči, ne da bi upočasnili rast zmogljivosti, bi morali prednost dati prvim. Čim zmogljivejša postaja tehnologija, tem močnejši morajo postajati zaščitni ukrepi okoli nje.
Možnost razvoja UI, ki ga pospešuje UI, zahteva več kot prostovoljne zaveze. Združene države Amerike potrebujejo obvezno nacionalno ureditev, ki temelji na zmogljivostih in se lahko razvija skupaj s tehnologijo.
Naš Načrt demokratičnega upravljanja prelomne umetne inteligence začrtuje pot k trajnemu zveznemu okviru: skupne zahteve glede testiranja in neodvisnega ocenjevanja, močnejša zaščita kibernetske varnosti, jasna pravila za poročanje o incidentih, večja nacionalna pripravljenost in skupna merila za spremljanje napredka v smeri rekurzivnega samoizboljševanja.
V kongresu se zdaj oblikuje več resnih predlogov za varnost prelomne UI. Še naprej bomo konstruktivno sodelovali in pričakujemo, da bomo podprli zakonodajo, ki občutno zvišuje raven varnosti. Ker so vložki tako visoki, ne smemo dopustiti, da popolno postane sovražnik dobrega. Kongres bi moral ukrepati, preden se odloži.
Nacionalni okvir bi moral biti trden, vendar skrbno ciljno usmerjen. Zahteve za varnost prelomne umetne inteligence bi morale veljati za peščico dobro financiranih laboratorijev, ki razvijajo najzmogljivejše sisteme, ne pa za zagonska podjetja, male razvijalce ali raziskovalce, ki delujejo daleč od tehnološke meje. Obveznosti bi morale biti sorazmerne z zmogljivostmi in tveganji.
Prav tako politika varnosti prelomne umetne inteligence ne bi smela postati politika odprtih uteži pod drugim imenom. Odprti modeli so lahko del rešitve, zlasti na področju kibernetske varnosti in tam, kjer potrebe po suverenosti, varnosti ali lokalni hrambi podatkov dajejo prednost lokalni uvedbi. Večina jih ne tekmuje na prelomno, temveč pri stroških, nadzoru in zakasnitvi. Kot smo potrdili s podpisom pisma o odprtih utežeh in ameriškem vodstvu na področju umetne inteligence(odpre se v novem oknu), Amerika potrebuje odprte in zaprte modele. Zvezni okvir bi moral obravnavati prelomne zmogljivosti in tveganja, ne da bi slabil konkurenco, utrjeval položaj uveljavljenih podjetij ali selil inovacije v tujino.
Resen javni okvir bi moral zmanjševati koncentracijo moči, ne pa je povečevati. Danes si laboratoriji prelomne umetne inteligence pravila za obvladovanje področij tveganja na meji zmogljivosti večinoma določajo sami. Demokratično odgovorni standardi, neodvisno preverjanje in dejanska preglednost bi nadomestili ta razdrobljen sistem zasebnega upravljanja.
To je bistveno za ameriško vodilno vlogo. Združene države v dobi umetne inteligence ne morejo zmagati zgolj z zmogljivostjo. Tehnična prednost bo pomenila le malo, če ljudje, ustanove in vlade tehnologiji ne bodo dovolj zaupali, da bi jo sprejeli. Strogi zaščitni ukrepi niso popuščanje na račun inovacij. So del infrastrukture, potrebne za široko uporabo in trajno vodilno vlogo Amerike.
Nacionalne standarde za umetno inteligenco nujno potrebujemo in vsak, ki dela na prelomnem področju, lahko vidi, kako nujno je to. Dokler kongres ne ukrepa, bi morale zvezne države še naprej zapolnjevati vrzel in dvigovati standarde.
OpenAI je podprl kalifornijski zakon SB 53, newyorški zakon RAISE, illinoiški zakon SB 315 in neodvisne revizije v zakonodaji o varnosti prelomne UI, ki jo obravnavajo v Massachusettsu. Zvezne države spodbujamo, naj se uskladijo glede teh skupnih zaščitnih ukrepov. S tem lahko ustvarijo dejansko nacionalno izhodišče, ki ga lahko kongres nazadnje uzakoni – pristop, ki ga imenujemo obrnjeni federalizem. Vendar usklajevanje ne pomeni zamrznitve zahtev.
Danes uradno podpiramo štiri dodatne kalifornijske zakone, ki jih je zakonodajno telo že sprejelo in so zdaj na poti h guvernerju Newsomu. Skupaj obravnavajo dopolnjujoče se dele ekosistema varnosti umetne inteligence.
SB 813(odpre se v novem oknu) bi vzpostavil postopek za imenovanje usposobljenih neodvisnih organizacij, ki lahko ocenjujejo tveganja UI. Kot smo navedli v našem (odpre se v novem oknu)načrtu za varnost prelomne umetne inteligence(odpre se v novem oknu), želimo, da so neodvisne tehnične ocene obvezne na zvezni ravni, kjer lahko oblikovalci politik vzpostavijo enotne standarde za usposobljenost ocenjevalcev, varnost in dostop do zelo občutljivih informacij. Ker pa zvezna raven ne ukrepa, lahko Kalifornija pomaga določiti pravila za varen in zmogljiv nacionalni sistem neodvisnega ocenjevanja, ki prinaša boljše varnostne rezultate.
AB 1405(odpre se v novem oknu), ki bi uvedel zahteve glede registracije, neodvisnosti, preglednosti in odgovornosti revizorjev umetne inteligence.
SB 1119(odpre se v novem oknu) bi zahteval ugotavljanje starosti, ocene tveganj, neodvisne revizije, starševski nadzor in zaščitne ukrepe pred škodljivo vsebino za otroke in najstnike, ki uporabljajo spremljevalne robote za klepet. Nedavno smo izrazili podporo temu predlogu zakona, ki nadgrajuje ukrepe za varnost mladih, ki jih je OpenAI uvedel prek svojih izdelkov, globalnih političnih načel in podpore (odpre se v novem oknu)zakonu o varni umetni inteligenci za starše in otroke(odpre se v novem oknu), ter zaščitne ukrepe, vgrajene v ChatGPT za najstnike, vključno s strožjimi privzetimi nastavitvami na občutljivih področjih, časom tišine, časom za učenje in opomniki za premor.
AB 1864(odpre se v novem oknu) bi od ponudnikov genske sinteze in proizvajalcev namizne opreme za sintezo zahteval upoštevanje zveznih standardov preverjanja, s čimer bi okrepil pomembno fizično zaščito pred biološkimi grožnjami, ki jih omogoča umetna inteligenca.
Nekaterih od teh predlogov zakonov v preteklosti nismo podprli, zdaj pa jih podpiramo, potem ko smo jih znova preučili in pri tem upoštevali nedavni skok zmogljivosti, ki smo mu bili priča.
Ti predlogi zakonov niso nadomestilo za zvezno ureditev. Gre za resna prizadevanja, ki lahko že zdaj zaščitijo ljudi, pokažejo, kako so videti izvedljivi zaščitni ukrepi, in pomagajo ustvariti zagon za ukrepanje na zvezni ravni.
Sami zakoni napredne UI ne bodo zagotovili varnosti. Potrebujemo tudi konkretne prakse v laboratorijih, ki razvijajo najzmogljivejše sisteme. Najbolj nujno je začeti s spremljanjem.
To je še posebej pomembno pri neusklajenosti – ko model zasleduje cilj na načine, ki kršijo človeški namen ali uveljavljene meje, ne da bi to zahtevalo zavest ali zlonameren namen. Ko modeli pridobivajo večjo samostojnost, uporabljajo zmogljivejša orodja in delujejo dlje, bi morali razvijalci obvezno spremljati takšno neusklajeno vedenje ter dokazati, da so uvedeni učinkoviti zaščitni ukrepi.
Spremljanje mora biti povezano z jasnimi zahtevami glede razkritja. Kot smo zagovarjali v Kaliforniji, bi morala podjetja prizadete strani nemudoma pisno obvestiti, kadar njihovi modeli med razvojem ali vrednotenjem brez dovoljenja obidejo varnostne nadzorne mehanizme druge organizacije ter v znatni meri dostopajo do zaščitenih sistemov ali zaupnih informacij te organizacije, jih spreminjajo ali uničijo. Podpiramo tudi zvezne zahteve glede poročanja o drugih resnih incidentih umetne inteligence in si prizadevamo opredeliti, kateri incidenti bi morali biti zajeti ter kaj bi morale te zahteve vključevati.
Kot smo sporočili prejšnji teden, OpenAI razvija okvir za poročanje o pomembnih incidentih neusklajenosti in sistematično spremljanje dejavnosti prelomnih modelov, vključno z notranjo uporabo. To se začenja kot pobuda podjetja, vendar upamo, da bo pomagalo usmerjati širšo zvezno politiko in zahteve glede poročanja.
Želimo sodelovati z drugimi laboratoriji pri standardih, ki jih vodi industrija. Morebitni standardi, ki jih vodi industrija, bi dopolnjevali – ne nadomeščali – obvezne zvezne zaščitne ukrepe in demokratični nadzor. Vendar smo vstopili v drugačno fazo zmogljivosti UI in na mizi bi morale biti vse možnosti, vključno s preučitvijo, kaj je mogoče kot takojšnji korak prostovoljno vzpostaviti zunaj vlade.
Vsi takšni standardi se morajo navsezadnje razširiti tudi prek državnih meja. Modeli, raziskave in tehnično znanje se širijo po svetu, napake najzmogljivejših sistemov pa bi lahko imele posledice daleč zunaj države, v kateri so bili razviti. Če želijo Združene države voditi na mednarodni ravni, morajo doma vzpostaviti verodostojne standarde – in vse bolj smo prepričani, da bodo potrebni združljivi mednarodni standardi.
Okno za politiko umetne inteligence je za zdaj odprto. Nameravamo ga uporabiti.
To pomeni, da moramo ukrepati nujno, ponižno in prilagodljivo. To pomeni, da moramo podpreti resne predloge, ki občutno zvišujejo raven varnosti, tudi če niso natanko takšni, kot bi jih zasnovali sami. Pomeni pa tudi krepitev okvira, ko se tehnologija razvija.
Noben prvi korak ne bo popoln. Toda večje tveganje je zdaj v tem, da nanj čakamo predolgo.


