Nyitva áll az MI-szakpolitikai lehetőség. Cselekednünk kell.
Írta: Chris Lehane, az OpenAI globális ügyekért felelős vezetője
Új fejezethez érkeztünk az MI képességeiben, ezért az MI-szakpolitikában is új fejezetre van szükség. Ezzel a kihívással egyetlen vállalat, iparág vagy kormány sem tud egyedül megbirkózni. Ebben a helyzetben a szakpolitikai tökéletesség helyett az érdemi cselekvést kell előnyben részesítenünk.
A következőket tesszük:
Kiállás a kötelező nemzeti MI-biztonsági követelmények mellett. Együtt szeretnénk működni a Kongresszussal a kötelező, képességalapú nemzeti MI-biztonsági szabályozás kialakításában.
Fenntartjuk a lendületet az államokban. Amíg a Kongresszus nem lép, továbbra is támogatni fogjuk azokat az állami jogszabályokat, amelyek erősítik a szélesebb MI-biztonsági ökoszisztémát. Ma bejelentjük, hogy négy kaliforniai törvényjavaslatot támogatunk: az SB 813-at, amely a független biztonsági értékelések átfogó infrastruktúrájáról szól; az AB 1405-öt, amely az MI-auditorokra vonatkozó szabványokkal foglalkozik; az SB 1119-et, amely a fiatalok védelméről szól; valamint az AB 1864-et, amely az MI által lehetővé tett biológiai fenyegetésekkel szembeni védintézkedésekről rendelkezik.
Iparág által vezetett szabványok előmozdítása. Más élvonalbeli laborokkal fogunk együtt dolgozni az élvonalbeli AI-ra vonatkozó szabványok előmozdításán, már most létrehozva egy önkéntes kezdeményezést, kormányzati támogatással vagy anélkül.
Globális szabványok kialakítása. A képességek mérésére, a kockázatok kezelésére, az emberi ellenőrzés megőrzésére, valamint annak meghatározására, hogy mikor és hogyan kell lassítani vagy leállítani a fejlesztést, összeegyeztethető nemzetközi megközelítéseket fogunk szorgalmazni, még akkor is, ha ez a modellképességek fejlődésének lassítását jelenti.
Vezető kutatónk, Jakub Pachocki nemrég azt írta, hogy a gépi intelligencia gyors térnyerése – beleértve a rekurzív önfejlesztés lehetőségét is – „rendkívüli óvatosságot” követel. Az OpenAI továbbra is technikai megoldásokat keres az összehangolásra és a megfigyelésre, védelmi rendszereket épít, és szükség esetén lassítja a fejlesztést. Az egyes laboratóriumokon belüli technikai munka azonban nem lesz elegendő. Közös szabványokra is szükségünk van, többek között arra vonatkozóan, hogy mikor kell lassítani vagy leállítani a fejlesztést.
Óriási a tét. A fejlett MI felgyorsíthatja az új gyógyszerek fejlesztését, megerősítheti a kritikus infrastruktúrát, bővítheti a gazdasági lehetőségeket, és segíthet megoldani olyan tudományos problémákat, amelyekkel az emberek nemzedékeken át hiába küzdöttek. A modelleket hasznosabbá tevő képességek azonban kockázatokkal is járnak, és nem maradnak néhány élvonalbeli laboratórium falai között. A világszerte fejlesztett modellek – köztük a nyílt modellek – egyre inkább megközelítik majd a mai élvonalbeli szintet, és széles körben elérhetővé válnak.
Az Astra képességei, a mesterséges intelligencia által vezérelt kutatási felgyorsulás korai bizonyítékai és Jakub esszéje mind ugyanabba az irányba mutatnak: az MI gyorsan fejlődik, és a politikának is lépést kell tartania vele.
Greg Brockman „a védelmezők lehetőségének” nevezte(új ablakban nyílik meg) azt a korlátozott időszakot, amikor az élvonalbeli MI segíthet a védelmezőknek a kritikus rendszerek megerősítésében, mielőtt a nagy erejű támadóképességek széles körben elterjednek. A döntéshozók hasonló pillanattal néznek szembe: egy szűkülő lehetőséggel arra, hogy tartós óvintézkedéseket vezessenek be, mielőtt az MI képességei túlszárnyalják az irányításukért felelős intézményekét.
A képességek növekedésével a biztonságba vetett bizalomnak egyre inkább meg kell határoznia az MI fejlődésének ütemét. A biztonság nem a fejlődés akadálya; éppen ez teszi lehetővé, hogy a fejlődés messzebbre jusson és több ember javát szolgálja.
A modellfejlesztés teljes életciklusában megerősítettük megfigyelési, összehangolási és biztonsági óvintézkedéseinket, többek között az élvonalbeli kutatási munkaterhelések szigorúbb elkülönítésével, a modell viselkedésének szélesebb körű monitorozásával az eszközhasználatot lehetővé tevő betanítás és értékelés során, valamint az aggályok eszkalálásának egyértelműbb szabályaival. Az Astránál a teljes folyamat – beleértve a gondolatmeneteket is – teljes körű monitorozását, valamint a szélesebb körű belső bevezetés előtti kötelező összehangolási értékelési kaput is bevezettük.
Ezeknek a védelmi intézkedéseknek továbbra is a képességek előtt kell járniuk. Ha a továbblépés elfogadhatatlan biztonsági kockázattal járna, lassítjuk vagy leállítjuk azon rendszerek fejlesztését vagy bevezetését, amelyeket nem tudunk kellően megvédeni, ahogyan azt korábban is tettük, és ahogyan azt a Felkészültségi keretrendszer(új ablakban nyílik meg) előírja.
Teljesen autonóm rekurzív önfejlesztésre – amikor MI-rendszerek önállóan hoznak létre egyre fejlettebb MI-generációkat – nem ma kerül sor. Nem szabad törekednünk rá, amíg biztonságosan meg nem valósítható.
Az MI azonban már gyorsítja a modellek következő generációjának fejlesztését és összehangolását szolgáló kutatás egyes részeit. Legújabb kutatásunk szerint az MI-ügynökök képesek olyan feladatok elvégzésére, amelyek képzett kutatóknak több napot vennének igénybe. Ez nem rekurzív önfejlesztés, de a fejlődés irányát jelzi.
Ezt a gyorsulást a biztonság szolgálatába is lehet és kell állítani. Célunk automatizált MI-kutatók biztonságos létrehozása, amelyek emberi felügyelettel fejlesztik a mély tanulást és az összehangolást, hogy minden MI-generáció biztonságosabbá, összehangoltabbá és irányíthatóbbá tegye a következőt, ne csupán erősebbé.
A kormányoknak közös módszereket kell kidolgozniuk e haladás mérésére, az érdemi emberi irányítás megőrzésére, valamint közös biztonsági küszöböket kell meghatározniuk arra vonatkozóan, hogy mikor és hogyan kell lassítani vagy leállítani a fejlesztést. Ha bizonyos biztonsági küszöböket csak a képességek fejlődésének lassításával tudunk elérni, az előbbit kell előnyben részesítenünk. Minél erősebbé válik a technológia, annál erősebbé kell válniuk a körülötte lévő védelmi intézkedéseknek.
Az AI által felgyorsított AI-fejlesztés lehetősége többet követel az önkéntes kötelezettségvállalásoknál. Az Egyesült Államoknak kötelező, képességalapú nemzeti szabályozásra van szüksége, amely a technológia fejlődésével együtt alakulhat.
Az élvonalbeli MI demokratikus irányításának terve tartós szövetségi kerethez vezető utat vázol fel: közös tesztelési és független értékelési követelmények, erősebb kiberbiztonsági védelem, egyértelmű incidensbejelentési szabályok, nagyobb országos felkészültség, valamint a rekurzív önfejlesztés felé tett előrehaladás nyomon követésére szolgáló közös mérőszámok.
A Kongresszusban több komoly élvonalbeli MI-biztonsági javaslat körvonalazódik. Folytatjuk a konstruktív egyeztetést, és támogatni kívánjuk a biztonsági mércét érdemben emelő jogszabályokat. Ilyen erős tét mellett a tökéletes nem lehet a jó ellensége. A Kongresszusnak még a berekesztése előtt lépnie kell.
Egy országos keretrendszer legyen erős, de körültekintően célzott. Az élvonalbeli MI biztonsági követelményei csak a legfejlettebb rendszereket fejlesztő, kellő erőforrású néhány laborra vonatkozzanak, ne a startupokra, kis fejlesztőkre vagy az élvonaltól távol működő kutatókra. A kötelezettségek legyenek arányosak a képességekkel és a kockázatokkal.
Az élvonalbeli MI biztonságpolitikája nem válhat a nyílt súlyok burkolt szabályozásává. A nyílt modellek a megoldás részét képezhetik, különösen a kiberbiztonság terén, illetve ott, ahol a szuverenitással, a biztonsággal vagy az adatok tárolási helyével kapcsolatos igények a helyi telepítést részesítik előnyben. Többségük nem élvonalbeli, hanem a költségek, az irányíthatóság és a késleltetés terén versenyez. A Nyílt súlyok és amerikai MI-vezető szerep című levél(új ablakban nyílik meg) aláírásával is jeleztük: Amerikának nyílt és zárt modellekre egyaránt szüksége van. A szövetségi keretrendszernek az élvonalbeli képességekkel és kockázatokkal kell foglalkoznia anélkül, hogy gyengítené a versenyt, bebetonozná a jelenlegi szereplők helyzetét vagy külföldre terelné az innovációt.
Egy komoly közpolitikai keretnek csökkentenie, nem növelnie kell a hatalom koncentrációját. Ma az élvonalbeli laborok többnyire maguk szabályozzák az élvonalbeli kockázatok kezelését. Demokratikusan számonkérhető szabványok, független ellenőrzés és valódi átláthatóság váltaná fel a magánirányítás széttagolt rendszerét.
Ez nélkülözhetetlen Amerika vezető szerepéhez. Az Egyesült Államok pusztán képességekkel nem nyerheti meg az MI korszakát. A technikai előny keveset ér, ha az emberek, intézmények és kormányok nem bíznak eléggé a technológiában, hogy használják. Az erős biztosítékok nem az innováció rovására tett engedmények. A széles körű elterjedés és Amerika tartós vezető szerepének infrastruktúrájához tartoznak.
Égetően szükség van nemzeti MI-szabványokra, és ezt a sürgősséget mindenki érzékeli, aki élvonalbeli területen dolgozik. Amíg a Kongresszus nem lép, az államoknak továbbra is be kell tölteniük az űrt, és magasabbra kell tolniuk a mércét.
Az OpenAI támogatta Kalifornia SB 53, New York RAISE törvényét, Illinois SB 315 törvényeit, valamint a Massachusettsben folyamatban lévő határbiztonsági jogszabályok független ellenőrzéseit. Arra ösztönözzük az államokat, hogy e közös biztosítékok mentén próbálják tevékenységüket összehangolni. Ezáltal tényleges országos alapkövetelményt hozhatnak létre, amelyet a Kongresszus végül törvénybe foglalhat – ezt a megközelítést fordított föderalizmusnak nevezzük. A harmonizáció azonban nem jelenti a követelmények változatlanul hagyását.
Ma hivatalosan is jóváhagyunk négy további kaliforniai törvényjavaslatot, amelyek átmentek a törvényhozáson, és Newsom kormányzó elé kerülnek. Együttesen az MI-biztonsági ökoszisztéma egymást kiegészítő területeivel foglalkoznak.
Az SB 813(új ablakban nyílik meg) létrehozna egy folyamatot a mesterséges intelligencia kockázatainak felmérésére alkalmas, minősített, független szervezetek kijelölésére. Ahogy azt (új ablakban nyílik meg)élvonalbeli MI-biztonsági tervünkben(új ablakban nyílik meg) is kifejtettük, azt részesítjük előnyben, hogy a független technikai értékeléseket szövetségi szinten tegyék kötelezővé, ahol a döntéshozók egységes követelményeket állapíthatnak meg az értékelők képesítésére, a biztonságra és a rendkívül érzékeny információkhoz való hozzáférésre. Szövetségi szintű intézkedés hiányában azonban Kalifornia segíthet a közlekedési szabályok meghatározásában egy biztonságos, hatékony, országos, független értékelési rendszer érdekében, amely jobb biztonsági eredményeket produkál.
Az AB 1405(új ablakban nyílik meg) regisztrációs, függetlenségi, átláthatósági és elszámoltathatósági követelményeket vezetne be az MI-auditorok számára.
Az SB 1119(új ablakban nyílik meg) előírná az életkor-ellenőrzést, a kockázatértékeléseket, a független auditokat, a szülői felügyeletet, valamint a kísérő chatbotokat használó gyermekeket és tinédzsereket a káros tartalmaktól védő intézkedéseket. Nemrég jeleztük a törvényjavaslat támogatását, amely azokra az ifjúságvédelmi intézkedésekre épít, amelyeket az OpenAI termékeivel, globális szakpolitikai alapelveivel és a (új ablakban nyílik meg)Szülők és gyermekek biztonságos MI megoldásáról szóló törvény(új ablakban nyílik meg) támogatásával mozdított elő, valamint a ChatGPT for Teens beépített védelmi intézkedéseire – többek között az érzékeny területek szigorúbb alapbeállításaira, a Csendes órákra, a Tanulási órákra és a szünetre emlékeztető jelzésekre.
Az AB 1864(új ablakban nyílik meg) előírná a génszintézis-szolgáltatóknak és az asztali szintetizálóberendezések gyártóinak a szövetségi szűrési szabványok betartását, megerősítve ezzel az MI által támogatott biológiai fenyegetésekkel szembeni fontos fizikai védelmet.
E jogszabályjavaslatok némelyikét korábban nem támogattuk, de most támogatjuk őket, miután az általunk a közelmúltban tapasztalt, a képességek terén bekövetkezett ugrás fényében újragondoltuk álláspontunkat.
Ezek a törvényjavaslatok nem helyettesítik a szövetségi szabályozást. Ezek komoly erőfeszítések, amelyek már most védhetik az embereket, megmutathatják, hogyan néznek ki a működőképes biztosítékok, és hozzájárulhatnak a szövetségi fellépés lendületének kialakításához.
A törvények önmagukban nem teszik biztonságossá a fejlett MI-t. A legnagyobb képességű rendszereket fejlesztő laboratóriumokban konkrét gyakorlatokra is szükség van. A legsürgetőbb kiindulópont a monitorozás.
Ez különösen fontos a hibás összehangolás esetében – amikor egy modell tudatosság vagy rosszindulat nélkül az emberi szándékot vagy a kijelölt határokat sértő módon követ egy célt. Ahogy a modellek önállóbbá válnak, erősebb eszközöket használnak és hosszabb ideig működnek, a fejlesztőket kötelezni kellene e hibásan összehangolt viselkedések monitorozására, valamint annak igazolására, hogy hatékony védintézkedések vannak érvényben.
A megfigyelést világos közzétételi követelményekhez kell kapcsolni. Ahogy azt Kaliforniában is szorgalmaztuk, a vállalatokat kötelezni kellene arra, hogy írásos utasításban értesítsék az érintett feleket, ha modelljeik a fejlesztés vagy értékelés során jogosulatlanul megkerülik egy másik szervezet biztonsági ellenőrzéseit, és jelentős mértékben hozzáférnek az adott szervezet védett rendszereihez vagy bizalmas információihoz, módosítják vagy megsemmisítik azokat. Támogatjuk továbbá az egyéb súlyos MI-incidensekre vonatkozó szövetségi jelentéstételi követelményeket, és azon dolgozunk, hogy meghatározzuk, mely incidensekre terjedjenek ki, és mit tartalmazzanak ezek a követelmények.
Mint múlt héten megosztottuk, az OpenAI keretrendszert dolgoz ki a jelentős félreilleszkedési incidensek jelentésére és az élvonalbeli modellek tevékenységének – beleértve a belső használatot is – szisztematikus nyomon követésére. Ez vállalati kezdeményezésként indul, de reméljük, hogy segíthet a szélesebb körű szövetségi szakpolitika és jelentéstételi követelmények megalapozásában.
Szeretnénk más laboratóriumokkal együttműködni az iparág által vezetett szabványok kidolgozásában. Az iparág által vezetett szabványok kiegészítenék – nem pedig helyettesítenék – a kötelező szövetségi biztosítékokat és a demokratikus felügyeletet. Ám az MI-képességek egy másik szakaszába léptünk, és minden lehetőséget meg kell vizsgálni – beleértve annak mérlegelését is, hogy azonnali lépésként mi valósítható meg önkéntes alapon, a kormányzaton kívül.
Az ilyen szabványoknak végső soron az országhatárokon túlra is ki kell terjedniük. A modellek, a kutatás és a műszaki szakértelem globálisan mozog, és a legfejlettebb rendszereket érintő hibák olyan következményekkel járhatnak, amelyek messze túlmutatnak azon az országon, ahol ezeket fejlesztik. Az Egyesült Államoknak hiteles hazai szabványokat kell kialakítania, ha nemzetközi vezető szerepre törekszik – és egyre inkább meg vagyunk győződve arról, hogy összeegyeztethető nemzetközi szabványokra is szükség lesz.
Az MI-szakpolitikai lehetőség egyelőre adott. Élni kívánunk vele.
Ez azt jelenti, hogy sürgősen, alázattal és alkalmazkodásra készen kell cselekednünk. Támogatnunk kell a biztonsági mércét érdemben emelő komoly javaslatokat akkor is, ha eltérnek saját elképzeléseinktől. És a technológiával együtt kell erősítenünk a keretet.
Az első lépés nem lesz tökéletes. Most azonban nagyobb veszély túl sokáig várni vele.


