Overslaan naar hoofdinhoud
OpenAI

Het venster voor AI-beleid staat open. We moeten handelen.

Door Chris Lehane, Chief Global Affairs Officer bij OpenAI

Bezig met laden...

We zijn een nieuw hoofdstuk ingegaan wat betreft de mogelijkheden van AI, en dat vraagt om een nieuw hoofdstuk voor AI-beleid. Geen enkel bedrijf, geen enkele sector en geen enkele overheid kan deze uitdaging alleen aangaan. We moeten dit moment aangrijpen met een voorkeur voor betekenisvolle actie boven perfect beleid.

Dit is wat we doen:

  1. Aandringen op verplichte nationale AI-veiligheidseisen. We willen met het Congres samenwerken aan verplichte nationale, op capaciteiten gebaseerde AI-veiligheidsregelgeving.

  2. Het momentum in de staten vasthouden. Totdat het Congres in actie komt, blijven we wetgeving op staatsniveau steunen die het bredere ecosysteem voor AI-veiligheid versterkt. Vandaag kondigen we onze steun aan voor vier wetsvoorstellen in Californië: SB 813 over de algemene infrastructuur voor onafhankelijke veiligheidsbeoordelingen, AB 1405 over normen voor AI-auditors, SB 1119 over bescherming van jongeren en AB 1864 over waarborgen tegen door AI mogelijk gemaakte biologische dreigingen.

  3. Door de sector geleide normen ontwikkelen. We zullen met andere laboratoria voor grensverleggende AI samenwerken aan normen voor grensverleggende AI en nu, met of zonder steun van de overheid, een vrijwillig initiatief opzetten.

  4. Wereldwijde normen ontwikkelen. We zullen pleiten voor compatibele internationale benaderingen om capaciteiten te meten, risico's te beheersen, menselijke controle te behouden en te bepalen wanneer en hoe de ontwikkeling moet worden vertraagd of stopgezet, zelfs als dat betekent dat de ontwikkeling van modelcapaciteiten wordt vertraagd.

Onze Chief Scientist Jakub Pachocki schreef⁠ onlangs dat de snelle opkomst van machine-intelligentie, waaronder de mogelijkheid van recursieve zelfverbetering, vraagt om "uiterste voorzichtigheid". OpenAI blijft werken aan technische oplossingen voor afstemming en monitoring, defensieve systemen bouwen en de ontwikkeling waar nodig vertragen. Maar technisch werk binnen afzonderlijke laboratoria is niet genoeg. We hebben ook gedeelde normen nodig, onder meer voor wanneer de ontwikkeling moet vertragen of stoppen.

Er staat enorm veel op het spel. Geavanceerde AI kan de ontwikkeling van nieuwe geneesmiddelen⁠ versnellen, kritieke infrastructuur⁠ versterken, economische kansen⁠ vergroten en helpen bij het oplossen van wetenschappelijke vraagstukken⁠ die ondanks generaties van menselijke inspanning onopgelost zijn gebleven. Maar de mogelijkheden die modellen nuttiger maken, brengen ook risico's met zich mee en zullen niet beperkt blijven tot enkele grensverleggende laboratoria. Modellen die wereldwijd worden ontwikkeld, waaronder open modellen, zullen steeds dichter bij de huidige grensverleggende voorhoede komen en breed beschikbaar worden.

De mogelijkheden van Astra, de eerste aanwijzingen voor versnelling van onderzoek door AI en het essay van Jakub wijzen allemaal in dezelfde richting: AI ontwikkelt zich snel en het beleid moet daarmee gelijke tred houden.

Greg Brockman heeft een "venster voor verdedigers" beschreven⁠(opent in een nieuw venster): een beperkte periode waarin grensverleggende AI verdedigers kan helpen kritieke systemen te versterken voordat krachtige offensieve mogelijkheden wijdverbreid raken. Beleidsmakers staan voor een vergelijkbaar moment: een steeds kleiner wordend tijdsvenster waarin zij duurzame waarborgen moeten vaststellen voordat de mogelijkheden van AI de instellingen die er toezicht op moeten houden voorbijstreven.

Naarmate de mogelijkheden groeien, moet het vertrouwen in de veiligheid steeds meer het tempo van de AI-vooruitgang bepalen. Veiligheid staat vooruitgang niet in de weg; ze zorgt ervoor dat vooruitgang verder kan reiken en meer mensen ten goede kan komen.

We hebben de waarborgen voor monitoring, afstemming en beveiliging gedurende de hele ontwikkelingscyclus van modellen versterkt. Dat omvat sterkere isolatie voor workloads voor grensverleggend onderzoek, uitgebreidere monitoring van modelgedrag tijdens trainingen en evaluaties waarbij tools worden gebruikt, en duidelijkere regels voor het melden en opschalen van zorgen. Voor Astra hebben we ook universele monitoring van volledige trajecten ingevoerd, inclusief chain-of-thought, evenals een verplichte afstemmingsevaluatie vóór bredere interne inzet.

Die waarborgen moeten de mogelijkheden voor blijven. Wanneer doorgaan een onaanvaardbaar veiligheidsrisico zou opleveren, vertragen of stoppen we de ontwikkeling of uitrol van systemen waarvoor we onvoldoende waarborgen kunnen bieden, zoals we eerder hebben gedaan en zoals vereist volgens ons preparedness framework⁠(opent in een nieuw venster).

Voorbereiden op recursieve zelfverbetering

Volledig autonome recursieve zelfverbetering, waarbij AI-systemen zelfstandig opeenvolgende generaties van steeds krachtigere AI voortbrengen, vindt vandaag niet plaats. We moeten dit niet nastreven tenzij en totdat dit veilig kan gebeuren.

AI versnelt echter nu al delen van het onderzoek dat wordt gebruikt om de volgende generatie modellen te ontwikkelen en af te stemmen. Ons nieuwste onderzoek⁠ toont aan dat AI-agents sommige taken kunnen uitvoeren waar ervaren onderzoekers meerdere dagen voor nodig zouden hebben. Dit is geen recursieve zelfverbetering, maar het is wel bewijs van de richting die deze ontwikkeling inslaat.

Die versnelling kan en moet ook worden ingezet voor veiligheid. Ons doel is om op veilige wijze geautomatiseerde AI-onderzoekers te bouwen die onder menselijk toezicht zowel deep learning als afstemming bevorderen, waarbij we elke generatie AI gebruiken om de volgende veiliger, beter afgestemd en gemakkelijker te beheersen te maken, en niet alleen krachtiger.

Overheden moeten gemeenschappelijke methoden ontwikkelen om deze vooruitgang te meten, betekenisvolle menselijke controle te behouden en gedeelde veiligheidsdrempels vast te stellen voor wanneer en hoe de ontwikkeling moet vertragen of stoppen. Als we bepaalde veiligheidsdrempels niet kunnen halen zonder de groei van mogelijkheden te vertragen, moeten we prioriteit geven aan het halen van die veiligheidsdrempels. Hoe krachtiger de technologie wordt, hoe sterker de bijbehorende waarborgen moeten worden.

Samenwerken met het Congres aan verplichte nationale veiligheidseisen voor AI

Het vooruitzicht van door AI versnelde AI-ontwikkeling vraagt om meer dan vrijwillige toezeggingen. De Verenigde Staten hebben verplichte, op capaciteiten gebaseerde nationale regelgeving nodig die kan meegroeien met de technologie.

Onze Blauwdruk voor democratisch bestuur van grensverleggende AI⁠ schetst een weg naar een duurzaam federaal kader: gemeenschappelijke vereisten voor tests en onafhankelijke beoordelingen, sterkere cyberbeveiligingsmaatregelen, duidelijke regels voor incidentrapportage, grotere nationale paraatheid en gezamenlijke maatstaven om de voortgang richting recursieve zelfverbetering te volgen.

In het Congres krijgen nu meerdere serieuze voorstellen voor de veiligheid van grensverleggende AI vorm. We blijven constructief meedenken en verwachten wetgeving te steunen die de veiligheidslat wezenlijk hoger legt. Nu er zoveel op het spel staat, mogen we het beste niet de vijand van het goede laten zijn. Het Congres moet in actie komen voordat het uiteengaat.

Een nationaal kader moet krachtig zijn, maar zorgvuldig toegespitst. Veiligheidseisen voor grensverleggende AI moeten gelden voor de handvol goed gefinancierde laboratoria die de krachtigste systemen ontwikkelen, niet voor startups, kleine ontwikkelaars of onderzoekers die lang niet aan de grens van AI-ontwikkeling opereren. De verplichtingen moeten in verhouding staan tot de capaciteiten en risico's.

Ook mag veiligheidsbeleid voor grensverleggende AI geen beleid voor modellen met open gewichten onder een andere naam worden. Open modellen kunnen deel uitmaken van de oplossing, vooral op het gebied van cyberbeveiliging en wanneer behoeften rond soevereiniteit, beveiliging of dataresidentie lokale inzet wenselijk maken. De meeste concurreren niet aan de grens van AI-ontwikkeling, maar op kosten, controle en latentie. Zoals we bevestigden door de brief Open Weights and American AI Leadership⁠(opent in een nieuw venster) te ondertekenen, heeft Amerika zowel open als gesloten modellen nodig. Een federaal kader moet grensverleggende capaciteiten en risico's aanpakken zonder de concurrentie te verzwakken, de positie van gevestigde partijen te versterken of innovatie naar het buitenland te verdrijven.

Een serieus publiek kader moet de machtsconcentratie verminderen, niet vergroten. Grensverleggende laboratoria bepalen nu grotendeels zelf hun regels voor het beheersen van de bijbehorende grensverleggende risico's. Democratisch controleerbare normen, onafhankelijke verificatie en wezenlijke transparantie zouden dat versnipperde stelsel van privaat bestuur vervangen.

Dit is essentieel voor Amerikaans leiderschap. De Verenigde Staten kunnen het AI-tijdperk niet alleen op basis van technische capaciteiten winnen. Een technische voorsprong heeft weinig waarde als mensen, instellingen en overheden de technologie onvoldoende vertrouwen om haar te gebruiken. Sterke waarborgen zijn geen concessie die ten koste gaat van innovatie. Ze maken deel uit van de infrastructuur die nodig is voor brede toepassing en duurzaam Amerikaans leiderschap.

Het momentum in de staten vasthouden

We hebben dringend nationale standaarden voor AI nodig, en iedereen die aan grensverleggende AI werkt, ziet de urgentie. Totdat het Congres in actie komt, moeten staten het vacuüm blijven opvullen en de lat hoger leggen.

OpenAI heeft steun gegeven aan SB 53 van Californië, de RAISE Act van New York, SB 315 van Illinois en onafhankelijke audits in de wetgeving over de veiligheid van grensverleggende AI die in Massachusetts wordt overwogen. We moedigen staten aan om zich achter deze gemeenschappelijke waarborgen te scharen. Zo kunnen zij de facto een nationale basis creëren die het Congres uiteindelijk wettelijk kan vastleggen, een aanpak die we ⁠omgekeerd federalisme⁠ noemen. Maar harmonisatie betekent niet dat vereisten worden bevroren.

Vandaag spreken we officieel onze steun uit voor vier aanvullende Californische wetsvoorstellen die door het parlement zijn aangenomen en nu naar gouverneur Newsom gaan. Samen pakken ze complementaire onderdelen van het ecosysteem voor AI-veiligheid aan.

SB 813⁠(opent in een nieuw venster) zou een procedure instellen voor het aanwijzen van gekwalificeerde, onafhankelijke organisaties die AI-risico's kunnen beoordelen. Zoals we in onze ⁠(opent in een nieuw venster)blauwdruk voor de veiligheid van grensverleggende AI⁠(opent in een nieuw venster) hebben aangegeven, geven we er de voorkeur aan dat onafhankelijke technische beoordelingen op federaal niveau verplicht worden gesteld. Zo kunnen beleidsmakers consistente normen vaststellen voor de kwalificaties en beveiliging van beoordelaars en voor hun toegang tot uiterst gevoelige informatie. Bij gebrek aan federale maatregelen kan Californië echter helpen de spelregels vast te stellen voor een veilig en capabel nationaal systeem van onafhankelijke beoordelingen dat betere veiligheidsresultaten oplevert.

AB 1405⁠(opent in een nieuw venster) zou vereisten invoeren voor de registratie, onafhankelijkheid, transparantie en verantwoordingsplicht van AI-auditors.

SB 1119⁠(opent in een nieuw venster) zou leeftijdsverificatie, risicobeoordelingen, onafhankelijke audits, ouderlijk toezicht en waarborgen tegen schadelijke inhoud vereisen voor kinderen en tieners die companionchatbots gebruiken. We hebben onlangs onze steun uitgesproken⁠ voor dit wetsvoorstel, dat voortbouwt op maatregelen voor de veiligheid van jongeren die OpenAI heeft bevorderd via onze producten, ⁠mondiale beleidsprincipes⁠ en steun voor de ⁠(opent in een nieuw venster)Parents & Kids Safe AI Act⁠(opent in een nieuw venster), evenals op de beschermingsmaatregelen die in ChatGPT voor tieners zijn ingebouwd, waaronder strengere standaardinstellingen voor gevoelige onderwerpen, Quiet Hours, Study Hours en herinneringen om pauze te nemen.

AB 1864⁠(opent in een nieuw venster) zou aanbieders van gensynthese en fabrikanten van compacte syntheseapparatuur voor laboratoria verplichten de federale screeningsnormen te volgen. Daarmee wordt een belangrijke fysieke waarborg tegen door AI mogelijk gemaakte biologische dreigingen versterkt.

Sommige van deze wetsvoorstellen steunden we in het verleden niet, maar na heroverweging in het licht van de recente snelle toename van de capaciteiten steunen we ze nu wel.

Deze wetsvoorstellen zijn geen vervanging voor federale regelgeving. Het zijn serieuze inspanningen die mensen nu kunnen beschermen, laten zien hoe werkbare waarborgen eruitzien en kunnen helpen momentum op te bouwen voor federale actie.

Oproep tot branchenormen voor het monitoren van grensverleggende AI

Wetten alleen maken geavanceerde AI niet veilig. We hebben ook concrete werkwijzen nodig binnen de laboratoria die de krachtigste systemen ontwikkelen. Monitoring is het dringendste startpunt.

Dit is vooral belangrijk bij gebrekkige afstemming: wanneer een model een doel nastreeft op manieren die indruisen tegen menselijke intentie of vastgestelde grenzen, zonder dat daarvoor bewustzijn of kwaadwillende intentie vereist is. Naarmate modellen autonomer worden, krachtigere hulpmiddelen gebruiken en langer actief blijven, moeten ontwikkelaars verplicht worden om op dit gebrekkig afgestemde gedrag te monitoren en aan te tonen dat er effectieve waarborgen zijn.

Monitoring moet gekoppeld zijn aan duidelijke openbaarmakingsvereisten. Zoals we in Californië hebben bepleit, moeten bedrijven verplicht worden getroffen partijen onmiddellijk schriftelijk op de hoogte te stellen wanneer hun modellen tijdens de ontwikkeling of evaluatie zonder toestemming de beveiligingsmaatregelen van een andere organisatie omzeilen en zich in wezen toegang verschaffen tot de beveiligde systemen of vertrouwelijke informatie van die organisatie, deze wijzigen of deze vernietigen. We steunen ook federale meldingsvereisten voor andere ernstige AI-incidenten en werken eraan te bepalen welke incidenten hieronder moeten vallen en wat die vereisten moeten inhouden.

Zoals we vorige week bekendmaakten, ontwikkelt OpenAI een kader voor het melden van ingrijpende incidenten met modelmisalignment en voor het systematisch monitoren van de activiteit van grensverleggende modellen, inclusief intern gebruik. We beginnen hiermee als bedrijfsinitiatief, maar hopen dat het kan bijdragen aan breder federaal beleid en bredere rapportagevereisten.

We willen met andere laboratoria samenwerken aan door de sector geleide normen. Eventuele door de sector geleide normen zouden verplichte federale waarborgen en democratisch toezicht aanvullen, niet vervangen. We zijn echter een nieuwe fase van AI-capaciteiten ingegaan en alle opties moeten openliggen, waaronder de mogelijkheid om als onmiddellijke stap vrijwillige initiatieven buiten de overheid op te zetten.

Dergelijke normen moeten uiteindelijk ook nationale grenzen overstijgen. Modellen, onderzoek en technische expertise verspreiden zich wereldwijd, en problemen met de krachtigste systemen kunnen gevolgen hebben tot ver buiten het land waar ze zijn ontwikkeld. De Verenigde Staten moeten in eigen land geloofwaardige normen vaststellen om internationaal het voortouw te kunnen nemen. We raken er bovendien steeds meer van overtuigd dat compatibele internationale normen noodzakelijk zullen zijn.

Benut het moment

Het venster voor AI-beleid staat voorlopig open. We zijn van plan het te benutten.

Dat betekent dat we met urgentie en bescheidenheid handelen en bereid zijn ons aan te passen. Het betekent dat we serieuze voorstellen steunen die de veiligheidslat wezenlijk hoger leggen, zelfs als ze niet precies zijn wat wij zouden hebben ontworpen. En het betekent dat we het kader versterken naarmate de technologie zich ontwikkelt.

Geen enkele eerste stap zal perfect zijn. Maar het grotere risico is nu dat we te lang wachten om die stap te zetten.

Auteurs

Chris Lehane