Muligheden for at forme AI-politikken er åben. Vi må handle.
Af Chris Lehane, Chef for globale affærer hos OpenAI
Vi er trådt ind i et nyt kapitel for AI-kapaciteter, og det kræver et nyt kapitel i AI-politikken. Ingen virksomhed, branche eller regering kan håndtere denne udfordring alene. Vi må håndtere denne situation med fokus på meningsfuld handling frem for perfektion i politikudformningen.
Her er, hvad vi gør på nuværende tidspunkt:
Arbejder for obligatoriske nationale sikkerhedskrav til AI. Vi ønsker at samarbejde med Kongressen om obligatorisk, kapacitetsbaseret national AI-sikkerhedsregulering.
Fastholdelse af momentum i delstaterne. Indtil Kongressen handler, vil vi fortsat støtte delstatslovgivning, der styrker det bredere økosystem for AI-sikkerhed. I dag annoncerer vi vores støtte til fire lovforslag i Californien: SB 813 om den overordnede infrastruktur for uafhængige sikkerhedsvurderinger, AB 1405 om standarder for AI-revisorer, SB 1119 om beskyttelse af unge, og AB 1864 om sikkerhedsforanstaltninger mod AI-understøttede biologiske trusler.
Fremme af brancheledede standarder. Vi vil samarbejde med andre banebrydende laboratorier om at fremme standarder for banebrydende AI og opbygge en frivillig indsats nu, med eller uden støtte fra myndighederne.
Opbygning af globale standarder. Vi vil arbejde for kompatible internationale tilgange til at måle kapaciteter, håndtere risici, bevare menneskelig kontrol og fastslå, hvornår og hvordan udviklingen bør bremses eller standses, også selv om det betyder, at udviklingen af modelkapaciteter bremses.
Vores chefforsker Jakub Pachocki skrev for nylig, at maskinintelligensens hurtige fremmarch, herunder muligheden for rekursiv selvforbedring, kræver "ekstrem forsigtighed". OpenAI vil fortsat arbejde på tekniske løsninger til alignment og overvågning, opbygge defensive systemer og bremse udviklingen, når det er nødvendigt. Men det tekniske arbejde i de enkelte laboratorier er ikke nok. Vi har også brug for fælles standarder, blandt andet for, hvornår udviklingen bør bremses eller standses.
Der er enormt meget på spil. Avanceret AI kan fremskynde udviklingen af nye lægemidler, styrke kritisk infrastruktur, skabe flere økonomiske muligheder og hjælpe med at løse videnskabelige problemer, som har modstået generationers menneskelige indsats. Men de kapaciteter, der gør modeller mere nyttige, indebærer også risici, og de vil ikke forblive begrænsede til nogle få laboratorier for banebrydende AI. Modeller udviklet verden over, herunder åbne modeller, vil i stigende grad nærme sig dagens banebrydende modeller og blive bredt tilgængelige.
Astras kapaciteter, de tidlige tegn på AI-drevet acceleration af forskning, og Jakubs essay peger alle i samme retning: AI udvikler sig hurtigt, og politikken skal følge med.
Greg Brockman har beskrevet et "mulighedsvindue for forsvarere"(åbner i et nyt vindue): en begrænset periode, hvor banebrydende AI kan hjælpe forsvarere med at styrke kritiske systemer, før stærke offensive kapaciteter bliver udbredt. Politiske beslutningstagere står i en tilsvarende situation: muligheden for at etablere holdbare sikkerhedsforanstaltninger svinder, før AI-kapaciteterne overhaler de institutioner, der er ansvarlige for at styre dem.
Efterhånden som kapaciteterne vokser, skal tilliden til sikkerheden i stigende grad bestemme tempoet for AI's fremskridt. Sikkerhed står ikke i vejen for fremskridt; den gør det muligt for fremskridt at nå længere og gavne flere mennesker.
Vi har styrket overvågning, tilpasning, og sikkerhedsforanstaltninger gennem hele modellens udviklingscyklus, herunder stærkere isolering af arbejdsbelastninger inden for banebrydende forskning, udvidet overvågning af modeladfærd under værktøjsstøttet træning og evalueringer, samt klarere regler for, hvornår bekymringer skal eskaleres. For Astra har vi også indført universel overvågning af hele forløb, herunder tankerækker, samt en obligatorisk evalueringskontrol af tilpasning før bredere intern implementering.
Disse sikkerhedsforanstaltninger skal fortsat være på forkant med kapaciteterne. Når fremdrift vil udgøre en uacceptabel sikkerhedsrisiko, vil vi sænke tempoet i eller standse udviklingen eller udrulningen af systemer, som vi ikke kan sikre tilstrækkeligt, sådan som vi har gjort før, og som det kræves i henhold til vores beredskabsramme(åbner i et nyt vindue).
Fuldt autonom rekursiv selvforbedring—hvor AI-systemer på egen hånd driver efterfølgende generationer af stadig mere kapabel AI—sker ikke i dag. Vi bør ikke forfølge det, før det kan gøres på sikker vis.
Men AI fremskynder allerede dele af den forskning, der bruges til at udvikle og tilpasse den næste generation af modeller. Vores seneste forskning viser, at AI-agenter kan udføre nogle opgaver, som det ville tage dygtige forskere flere dage at udføre. Dette er ikke rekursiv selvforbedring, men det er et tegn på den retning, udviklingen bevæger sig i.
Denne acceleration kan og skal også rettes mod sikkerhed. Vores mål er på sikker vis at udvikle automatiserede AI-forskere, som arbejder under menneskeligt tilsyn for at fremme både deep-learning og tilpasning–ved at bruge hver generation af AI til at bidrage til at gøre den næste sikrere, bedre tilpasset og lettere at kontrollere, ikke blot mere kapabel.
Regeringer bør udvikle fælles metoder til at måle disse fremskridt, bevare meningsfuld menneskelig kontrol og fastsætte fælles sikkerhedsgrænser for, hvornår og hvordan udviklingen bør bremses eller standses. Hvis vi ikke kan opfylde visse sikkerhedsgrænser uden at bremse væksten i kapacitet, bør vi prioritere førstnævnte. Jo stærkere teknologien bliver, desto stærkere skal sikkerhedsforanstaltningerne omkring den være.
Udsigten til AI-accelereret AI-udvikling kræver mere end frivillige forpligtelser. USA har brug for obligatorisk, kapacitetsbaseret national regulering, der kan udvikle sig i takt med teknologien.
Vores plan for demokratisk styring af banebrydende AI udstikker vejen mod et holdbart føderalt rammeværk: fælles krav til test og uafhængig vurdering, stærkere cybersikkerhedsforanstaltninger, klare regler for indberetning af hændelser, større nationalt beredskab, og fælles tiltag for at spore fremskridtene mod rekursiv selvforbedring.
Flere seriøse forslag om sikkerhed inden for banebrydende AI er nu ved at tage form i Kongressen. Vi vil fortsat bidrage konstruktivt og forventer at støtte lovgivning, der hæver sikkerhedsniveauet væsentligt. Når indsatserne er så høje, må det perfekte ikke blive det godes fjende. Kongressen bør handle, før den afslutter sin session.
Et nationalt rammeværk bør være stærk, men nøje målrettet. Krav til sikkerhed inden for banebrydende AI bør gælde for de få ressourcestærke laboratorier, der udvikler de mest kapable systemer—ikke for opstartsvirksomheder, små udviklere eller forskere, der arbejder langt fra det banebrydende grænseområde. Forpligtelserne bør stå mål med kapaciteterne og risiciene.
Politik for sikkerhed inden for banebrydende AI bør heller ikke blive politik for åbne vægtmodeller under et andet navn. Åbne modeller kan være en del af løsningen, særligt inden for cybersikkerhed og dér, hvor behov for suverænitet, sikkerhed eller dataresidens taler for lokal implementering. De fleste konkurrerer ikke i det banebrydende grænseområde, men om omkostninger, kontrol og latenstid. Som vi bekræftede ved at underskrive brevet om åbne vægtmodeller og amerikansk AI-lederskab(åbner i et nyt vindue), har USA brug for både åbne og lukkede modeller. Et føderalt rammeværk bør håndtere banebrydende kapaciteter og risici uden at svække konkurrencen, forankre etablerede aktørers position eller drive innovation til udlandet.
Et seriøst offentligt rammeværk bør mindske, ikke øge, magtkoncentrationen. I dag fastsætter banebrydende AI-laboratorier i vid udstrækning selv reglerne for håndtering af risiciene ved banebrydende AI. Demokratisk ansvarlige standarder, uafhængig verifikation og reel gennemsigtighed ville erstatte det fragmenterede system af privat styring.
Dette er afgørende for amerikansk lederskab. USA kan ikke vinde AI-æraen på kapacitet alene. Et teknologisk forspring betyder kun lidt, hvis mennesker, institutioner og regeringer ikke har tilstrækkelig tillid til teknologien til at tage den i brug. Stærke sikkerhedsforanstaltninger er ikke en indrømmelse på innovationens bekostning. De er en del af den infrastruktur, der er nødvendig for bred anvendelse—og for et varigt amerikansk lederskab.
Vi har virkelig behov for nationale standarder for AI, og enhver, der arbejder med banebrydende AI, kan se, hvor presserende det er. Indtil Kongressen handler, bør delstaterne fortsat træde til for at udfylde tomrummet og hæve standarden.
OpenAI har støttet Californiens SB 53, New Yorks RAISE Act, Illinois’ SB 315 samt uafhængige revisioner i den lovgivning om sikkerhed inden for banebrydende AI, der behandles i Massachusetts. Vi opfordrer delstaterne til at samles om disse fælles sikkerhedsforanstaltninger. Når de gør det, kan de skabe et nationalt de facto-grundniveau, som Kongressen i sidste ende kan lovfæste—en tilgang, vi kalder omvendt føderalisme. Men harmonisering betyder ikke, at kravene fastlåses.
I dag støtter vi officielt yderligere fire lovforslag i Californien, som er blevet vedtaget af den lovgivende forsamling og nu skal godkendes af guvernør Newsom. Tilsammen omhandler de komplementære dele af økosystemet for AI-sikkerhed.
SB 813(åbner i et nyt vindue) vil indføre en proces til udpegning af kvalificerede, uafhængige organisationer, der kan vurdere AI-risici. Som vi har anført i vores (åbner i et nyt vindue)plan for sikkerhed inden for banebrydende AI(åbner i et nyt vindue), foretrækker vi, at uafhængige tekniske vurderinger kræves på føderalt niveau, hvor beslutningstagere kan fastsætte ensartede standarder for bedømmernes kvalifikationer, sikkerhed og adgang til yderst følsomme oplysninger. I mangel af føderale tiltag kan Californien imidlertid bidrage til at fastsætte spillereglerne for et sikkert, kompetent nationalt system for uafhængige vurderinger, der giver bedre sikkerhedsresultater.
AB 1405(åbner i et nyt vindue) vil indføre krav om registrering, uafhængighed, gennemsigtighed og ansvarlighed for AI-revisorer.
SB 1119(åbner i et nyt vindue) vil kræve alderssikring, risikovurderinger, uafhængige revisioner, forælderkontroller og beskyttelse mod skadeligt indhold for børn og unge, der bruger AI-ledsagere. Vi har for nylig tilkendegivet vores støtte til dette lovforslag, som bygger videre på de tiltag for unges sikkerhed, som OpenAI har fremmet gennem vores produkter, globale politiske principper og støtte til (åbner i et nyt vindue)Parents & Kids Safe AI Act(åbner i et nyt vindue), samt den beskyttelse, der er indbygget i ChatGPT til teenagere—herunder stærkere standardindstillinger på følsomme områder, Stilletid, Studietid og påmindelser om pauser.
AB 1864(åbner i et nyt vindue) vil kræve, at udbydere af gensyntese og producenter af bordbaseret synteseudstyr følger føderale screeningsstandarder. Dermed styrkes en vigtig fysisk sikkerhedsforanstaltning mod AI-understøttede biologiske trusler.
Nogle af disse lovforslag støttede vi ikke tidligere, men vi støtter dem nu efter at have genovervejet dem i lyset af det nylige spring i de kapaciteter, vi har set.
Disse lovforslag er ikke en erstatning for føderal regulering. De er seriøse tiltag, der kan beskytte mennesker nu, vise, hvordan praktisk anvendelige sikkerhedsforanstaltninger ser ud, og bidrage til at skabe momentum for en føderal indsats.
Love alene vil ikke gøre avanceret AI sikker. Vi har også brug for konkrete praksisser i de laboratorier, der udvikler de mest avancerede systemer. Det mest presserende sted at starte er overvågning.
Dette er særligt vigtigt i forbindelse med fejltilpasning—når en model forfølger et mål på måder, der strider mod menneskelig hensigt eller fastlagte grænser, uden at det kræver bevidsthed eller ondsindede hensigter. Efterhånden som modeller får større autonomi, bruger mere kraftfulde værktøjer og arbejder over længere perioder, bør udviklere være forpligtede til at overvåge denne fejltilpassede adfærd og påvise, at effektive sikkerhedsforanstaltninger er indført.
Overvågning skal være knyttet til klare oplysningskrav. Som vi har argumenteret for i Californien, bør virksomheder pålægges at give omgående skriftlig besked til berørte parter, når deres modeller under udvikling eller evaluering omgår en anden organisations sikkerhedskontroller uden tilladelse og i væsentlig grad får adgang til, ændrer eller ødelægger organisationens beskyttede systemer eller fortrolige oplysninger. Vi støtter også føderale rapporteringskrav for andre alvorlige AI-hændelser og arbejder på at definere, hvilke hændelser der bør omfattes, og hvad disse krav bør indebære.
Som vi oplyste i sidste uge, er OpenAI ved at udvikle en ramme for rapportering af væsentlige hændelser med fejltilpasning og systematisk overvågning af aktiviteten i banebrydende modeller, herunder intern brug. Dette begynder som en virksomhedsledet indsats, men vi håber, at det kan bidrage til udviklingen af en bredere føderal politik og rapporteringskrav.
Vi ønsker at samarbejde med andre laboratorier om brancheledede standarder. Eventuelle brancheledede standarder ville supplere—ikke erstatte—obligatoriske føderale sikkerhedsforanstaltninger og demokratisk tilsyn. Men vi er gået ind i en anden fase af AI-kapaciteter, og alle muligheder bør tages i betragtning—herunder at overveje, hvad der kan udvikles på frivillig basis uden for det offentlige som et umiddelbart skridt.
Alle sådanne standarder skal i sidste ende også række ud over nationale grænser. Modeller, forskning og teknisk ekspertise bevæger sig globalt, og svigt i de mest kapable systemer kan medføre konsekvenser langt ud over det land, hvor de er udviklet. USA er nødt til at etablere troværdige standarder nationalt, hvis landet skal føre an internationalt—og vi er i stigende grad overbeviste om, at kompatible internationale standarder bliver nødvendige.
Muligheden for at forme AI-politikken er åben, indtil videre. Vi har tænkt os at udnytte den.
Det betyder at handle med hast, ydmyghed og en vilje til at tilpasse sig. Det betyder at støtte seriøse forslag, der hæver sikkerhedsniveauet væsentligt, selv når de ikke er præcis, som vi selv ville have udformet dem. Og det betyder at styrke rammeværket, efterhånden som teknologien udvikler sig.
Intet første skridt bliver perfekt. Men den største risiko nu er at vente for længe med at tage det.


