Mulighetsvinduet for AI-politikk står åpent. Vi må handle.
Av Chris Lehane, Chief Global Affairs Officer at OpenAI
Vi har nådd et nytt kapittel i utviklingen av KI-kapasitet, og det krever et nytt kapittel i KI-politikken. Ingen bedrift, bransje eller myndighet kan møte denne utfordringen alene. Vi må gripe øyeblikket og prioritere reell handling fremfor perfekt politikk.
Slik gjør vi det:
Arbeider for obligatoriske nasjonale sikkerhetskrav for AI. Vi ønsker å samarbeide med Kongressen om obligatorisk, kapasitetsbasert nasjonal AI-sikkerhetsregulering.
Opprettholder fremdriften i delstatene. Inntil Kongressen griper inn, vil vi fortsette å støtte delstatslovgivning som styrker det bredere økosystemet for AI-sikkerhet. I dag kunngjør vi vår støtte til fire lovforslag i California: SB 813 om den overordnede infrastrukturen for uavhengige sikkerhetsvurderinger, AB 1405 om standarder for KI-revisorer, SB 1119 om beskyttelse av unge og AB 1864 om sikkerhetstiltak mot biologiske trusler muliggjort av AI.
Fremmer bransjeledede standarder. Vi vil samarbeide med andre banebrytende laboratorier for å fremme standarder for banebrytende AI, og bygge opp et frivillig initiativ nå, med eller uten støtte fra myndighetene.
Utvikling av globale standarder. Vi vil arbeide for samordnede internasjonale tilnærminger til å måle kapasitet, håndtere risiko, bevare menneskelig kontroll og avgjøre når og hvordan utviklingen bør bremses eller stanses, selv om det innebærer å bremse utviklingen av modellkapasiteten.
Sjefsforskeren vår, Jakub Pachocki, skrev nylig at den raske fremveksten av maskinintelligens, inkludert muligheten for rekursiv selvforbedring, krever «ekstrem forsiktighet». OpenAI vil fortsette arbeidet med tekniske løsninger for finjustering og overvåking, utvikle forsvarssystemer og bremse utviklingen når det er nødvendig. Men teknisk arbeid i enkeltlaboratorier vil ikke være nok. Vi trenger også felles standarder, blant annet for når utviklingen bør bremses eller stanses.
Det er enormt mye som står på spill. Avansert AI kan fremskynde utviklingen av nye legemidler, styrke kritisk infrastruktur, utvide økonomiske muligheter og bidra til å løse vitenskapelige problemer som generasjoner av mennesker ikke har klart å løse. Men kapasitetene som gjør modellene mer nyttige, medfører også risiko, og de vil ikke forbli begrenset til noen få laboratorier for banebrytende AI. Modeller som utvikles rundt om i verden, inkludert åpne modeller, vil i økende grad nærme seg dagens mest avanserte nivå og bli bredt tilgjengelige.
Astras evner, de første tegnene på AI-drevet forskningsakselerasjon og Jakubs essay peker alle i samme retning: AI utvikler seg raskt, og politikken må følge med.
Greg Brockman har beskrevet et «mulighetsvindu for forsvarerne»(åpnes i et nytt vindu): en begrenset periode der banebrytende AI kan hjelpe forsvarere med å styrke kritiske systemer før kraftige offensive evner blir utbredt. Beslutningstakere står overfor en tilsvarende situasjon: et mulighetsvindu er i ferd med å lukkes for å etablere varige sikkerhetstiltak før AI-kapasiteten løper fra institusjonene som skal styre den.
Etter hvert som kapasiteten øker, må tilliten til sikkerheten i stadig større grad sette tempoet for AI-utviklingen. Sikkerhet står ikke i veien for fremskritt. Det er sikkerheten som gjør at vi kan komme lenger og at flere får nytte av fremskrittene.
Vi har styrket overvåkingen, innrettingen og sikkerhetstiltakene gjennom hele livssyklusen for modellutvikling, blant annet med sterkere isolasjon av arbeidsbelastninger knyttet til forskning på avanserte modeller, utvidet overvåking av modellatferd under trening og evalueringer med verktøytilgang, og tydeligere regler for når bekymringer skal eskaleres. For Astra innførte vi også universell overvåking av fullstendige forløp, inkludert tankerekker, og en obligatorisk port for evaluering av tilpasning før bredere intern utrulling.
Disse sikkerhetstiltakene må fortsette å ligge foran kapasitetsutviklingen. Når det å gå videre vil innebære en uakseptabel sikkerhetsrisiko, vil vi bremse eller stanse utviklingen eller utrullingen av systemer vi ikke kan sikre tilstrekkelig, slik vi har gjort tidligere, og slik det kreves i henhold til vårt beredskapsrammeverk(åpnes i et nytt vindu).
Fullt autonom rekursiv selvforbedring – der AI-systemer på egen hånd driver frem stadig mer avanserte generasjoner av AI – skjer ikke i dag. Vi bør ikke etterstrebe dette før det kan gjøres på en trygg måte.
Men AI fremskynder allerede deler av forskningen som brukes til å utvikle og innrette neste generasjon modeller. Den nyeste forskningen vår viser at AI-agenter kan utføre enkelte oppgaver som ville tatt dyktige forskere flere dager. Dette er ikke rekursiv selvforbedring, men det er et tegn på hvilken retning utviklingen går.
Denne akselerasjonen kan og må også rettes mot sikkerhet. Målet vårt er å utvikle automatiserte AI-forskere på en trygg måte, som arbeider under menneskelig tilsyn for å fremme både dyp læring og tilpasning – ved å bruke hver generasjon AI til å gjøre den neste tryggere, bedre tilpasset og enklere å kontrollere, ikke bare mer kapabel.
Myndighetene bør utvikle felles metoder for å måle denne fremgangen, bevare meningsfull menneskelig kontroll og fastsette felles sikkerhetsgrenser for når og hvordan utviklingen bør bremses eller stanses. Hvis vi ikke kan oppfylle visse sikkerhetsgrenser uten å bremse kapasitetsutviklingen, bør vi prioritere førstnevnte. Jo kraftigere teknologien blir, desto sterkere må sikkerhetstiltakene rundt den være.
Utsiktene til AI-akselerert AI-utvikling krever mer enn frivillige forpliktelser. USA trenger obligatorisk, kapasitetsbasert nasjonal regulering som kan utvikle seg i takt med teknologien.
Vår plan for demokratisk styring av banebrytende KI viser veien mot et varig føderalt rammeverk: felles krav til testing og uavhengige vurderinger, sterkere cybersikkerhetstiltak, klare regler for hendelsesrapportering, økt nasjonal beredskap og felles måleparametere for å følge fremgangen mot rekursiv selvforbedring.
Flere seriøse forslag om sikkerhet for banebrytende AI tar nå form i Kongressen. Vi vil fortsette å bidra konstruktivt og regner med å støtte lovgivning som hever sikkerhetsnivået vesentlig. Når innsatsen er så høy, kan vi ikke la det perfekte bli det godes fiende. Kongressen bør handle før den avslutter sesjonen.
Et nasjonalt rammeverk bør være solid, men nøye målrettet. Krav til sikkerhet for banebrytende AI bør gjelde de få ressurssterke laboratoriene som utvikler de mest kapable systemene – ikke oppstartsbedrifter, små utviklere eller forskere som ikke er i nærheten av det teknologiske toppsjiktet. Forpliktelsene bør stå i forhold til kapasitet og risiko.
Sikkerhetspolitikk for de mest avanserte modellene bør heller ikke bli åpenvektsmodellpolitikk under et annet navn. Åpne modeller kan være en del av løsningen, særlig innen cybersikkerhet og på områder der hensyn til suverenitet, sikkerhet eller datalagring i eget land taler for lokal utrulling. De fleste konkurrerer ikke på det mest avanserte nivået, men på kostnad, kontroll og forsinkelse. Som vi bekreftet da vi undertegnet brevet om Open Weights and American AI Leadership(åpnes i et nytt vindu), trenger USA både åpne og lukkede modeller. Et føderalt rammeverk bør håndtere de mest avanserte KI-modellenes kapasiteter og risikoer uten å svekke konkurransen, befeste etablerte aktørers posisjon eller drive innovasjon til utlandet.
Et solid offentlig rammeverk bør redusere, ikke øke, maktkonsentrasjonen. I dag fastsetter laboratoriene for banebrytende AI i stor grad selv reglene for hvordan grenserisiko skal håndteres. Demokratisk ansvarlige standarder, uavhengig kontroll og reell åpenhet ville erstatte dette fragmenterte systemet for privat styring.
Dette er avgjørende for amerikansk lederskap. USA kan ikke vinne AI-æraen gjennom kapasitet alene. Et teknologisk forsprang betyr lite dersom mennesker, institusjoner og myndigheter ikke har nok tillit til teknologien til å ta den i bruk. Sterke sikkerhetstiltak er ikke en innrømmelse på bekostning av innovasjon. De er en del av infrastrukturen som kreves for utbredt bruk. – og for varig amerikansk lederskap.
Vi trenger sårt nasjonale standarder for KI, og alle som jobber med den mest avanserte KI-utviklingen, kan se hvor presserende dette er. Inntil Kongressen griper inn, bør delstatene fortsette å ta initiativ for å fylle tomrommet og heve standarden.
OpenAI har støttet Californias SB 53, New Yorks RAISE Act, Illinois’ SB 315 og uavhengige revisjoner i lovgivningen om sikkerhet for avanserte KI-modeller som er til behandling i Massachusetts. Vi oppfordrer delstatene til å samles om disse felles sikkerhetstiltakene. Slik kan de skape en nasjonal minstestandard i praksis som Kongressen til slutt kan lovfeste – en tilnærming vi kaller omvendt føderalisme. Men harmonisering betyr ikke at kravene skal fryses fast.
I dag støtter vi formelt ytterligere fire lovforslag i California som har blitt vedtatt av den lovgivende forsamlingen og er på vei til guvernør Newsom. Sammen dekker de utfyllende deler av økosystemet for KI-sikkerhet.
SB 813(åpnes i et nytt vindu) ville etablere en prosess for å utpeke kvalifiserte, uavhengige organisasjoner som er i stand til å vurdere AI-risikoer. Som vi har uttalt i vår (åpnes i et nytt vindu)plan for sikkerhet for avanserte AI-modeller(åpnes i et nytt vindu), foretrekker vi at uavhengige tekniske vurderinger blir pålagt på føderalt nivå, der beslutningstakere kan fastsette ensartede standarder for vurderernes kvalifikasjoner, sikkerhet og tilgang til svært sensitiv informasjon. I mangel av føderale tiltak kan California imidlertid bidra til å etablere spillereglene for et sikkert og velfungerende nasjonalt system for uavhengige vurderinger som gir bedre sikkerhetsresultater.
AB 1405(åpnes i et nytt vindu) vil innføre krav til registrering, uavhengighet, åpenhet og ansvarlighet for AI-revisorer.
SB 1119(åpnes i et nytt vindu) ville kreve aldersverifisering, risikovurderinger, uavhengige revisjoner, foreldrekontroller og tiltak for å beskytte barn og ungdom mot skadelig innhold når de bruker chatboter som fungerer som følgesvenner. Vi har nylig signalisert vår støtte til dette lovforslaget, som bygger på tiltak for å beskytte unge som OpenAI har fremmet gjennom produktene våre, globale politiske prinsipper og støtte til (åpnes i et nytt vindu)Parents & Kids Safe AI Act(åpnes i et nytt vindu), samt beskyttelsestiltak som er innebygd i ChatGPT for tenåringer – inkludert strengere standardinnstillinger på sensitive områder, stilletid, studietid og påminnelser om å ta pauser.
AB 1864(åpnes i et nytt vindu) ville kreve at leverandører av gensyntese og produsenter av benchtop-utstyr for syntese følger føderale kontrollstandarder, noe som vil styrke et viktig fysisk sikkerhetstiltak mot biologiske trusler muliggjort av AI.
Noen av disse lovforslagene støttet vi ikke tidligere, men støtter nå etter å ha vurdert dem på nytt i lys av det betydelige kapasitetsløftet vi har sett den siste tiden.
Disse lovforslagene er ikke en erstatning for føderal regulering. Dette er seriøse tiltak som kan beskytte mennesker nå, vise hvordan gjennomførbare sikkerhetstiltak kan se ut, og bidra til å skape momentum for føderale tiltak.
Lover alene vil ikke gjøre avansert AI trygg. Vi trenger også konkrete rutiner i laboratoriene som utvikler de mest avanserte systemene. Det mest presserende stedet å starte er overvåking.
Dette er særlig viktig for feilinnretting – når en modell forfølger et mål på måter som bryter med menneskelige intensjoner eller fastsatte grenser, uten at det krever bevissthet eller ondsinnede hensikter. Etter hvert som modeller får større selvstendighet, bruker kraftigere verktøy og arbeider over lengre tid, bør utviklerne pålegges å overvåke slik feilinnrettet atferd og dokumentere at effektive sikkerhetstiltak er på plass.
Overvåking må knyttes til tydelige krav om offentliggjøring. Slik vi tok til orde for i California, bør selskaper pålegges å gi berørte parter skriftlig varsel uten ugrunnet opphold når modellene deres under utvikling eller evaluering uten tillatelse omgår en annen organisasjons sikkerhetskontroller og i vesentlig grad får tilgang til, endrer eller ødelegger organisasjonens beskyttede systemer eller konfidensielle informasjon. Vi støtter også føderale rapporteringskrav for andre alvorlige KI-hendelser og arbeider med å definere hvilke hendelser som bør omfattes, og hva disse kravene bør innebære.
Som vi fortalte forrige uke, utvikler OpenAI et rammeverk for rapportering av alvorlige hendelser med modellavvik og systematisk overvåking av aktiviteten til banebrytende modeller, inkludert intern bruk. Dette begynner som et selskapsdrevet initiativ, men vi håper det kan bidra til å gi grunnlag for bredere føderal politikk og rapporteringskrav.
Vi ønsker å samarbeide med andre laboratorier om bransjedrevne standarder. Eventuelle bransjedrevne standarder vil utfylle – ikke erstatte – obligatoriske føderale sikkerhetstiltak og demokratisk tilsyn. Men vi har gått inn i en annen fase av KI-kapasitet, og alt bør vurderes – inkludert hva som kan utvikles frivillig utenfor myndighetene som et umiddelbart tiltak.
Alle slike standarder må til syvende og sist også rekke utover landegrensene. Modeller, forskning og teknisk kompetanse beveger seg globalt, og svikt i de kraftigste systemene kan få konsekvenser langt utenfor landet der de utvikles. USA må etablere troverdige standarder hjemme dersom landet skal være ledende internasjonalt – og vi er stadig mer overbevist om at det vil være nødvendig med forenlige internasjonale standarder.
Mulighetsvinduet for KI-politikk står åpent – enn så lenge. Vi har tenkt å bruke det.
Det betyr å handle raskt, med ydmykhet og vilje til å tilpasse oss. Det betyr å støtte seriøse forslag som hever sikkerhetsnivået vesentlig, selv når de ikke er akkurat slik vi selv ville utformet dem. Og det betyr å styrke rammeverket etter hvert som teknologien utvikler seg.
Ingen første skritt vil være perfekt. Men den største risikoen nå er å vente for lenge med å ta det.


