Standardit tekoälyn seuraavaan vaiheeseen
Missiomme on varmistaa, että yleinen tekoäly hyödyttää koko ihmiskuntaa. Kuten Sam Altman ja Jakub Pachocki ovat äskettäin kuvanneet, suuntaamme työtämme kohti tätä missiota kolmen päätavoitteen avulla:
Ohjaamme tekoälyn kehityksen seuraavaa vaihetta rakentamalla automatisoidun tekoälytutkijan, kehittämällä sen avulla ratkaisuja linjausongelmaan ja etsimällä tapoja pitää ihmiset mukana itsekehityksen kierrossa.
Tuomme kaikkien ulottuville erittäin älykkäiden koneiden mahdollistaman tieteellisen kehityksen ja talouskasvun hyödyt.
Annamme jokaiselle mahdollisuuden hyödyntää henkilökohtaista AGI:tä.
Tekoäly vauhdittaa omaa tutkimus- ja kehitystyötämme, ja tekoälyä hyödyntävä tutkimus on johtanut matematiikan edistysaskeliin, myös Navier–Stokesin millenniumongelman parissa. Tämä kehitys on erittäin lupaavaa kahden muun tavoitteemme kannalta. Se voi johtaa merkittäviin lääketieteellisiin löytöihin, laajasti saatavilla olevaan terveydenhuoltoon sekä pienyritysten ja yksittäisten yrittäjien taloudellisten mahdollisuuksien vahvistumiseen kaikkialla.
Tekoäly kehittyy lukuisissa yrityksissä ja maissa, ja koko alan edistys muuttaa kaikkien kohtaamia mahdollisuuksia ja haasteita. Muiden hyötyjensä ohella kyvykäs ja ihmisten arvojen kanssa linjassa oleva tekoäly auttaa olennaisesti tämän siirtymän hallinnassa: se vahvistaa puolustusta, edistää linjaustutkimusta sekä auttaa ihmisiä ymmärtämään ja ohjaamaan tekoälyn kehityksen seuraavia vaiheita.
Siirtymän turvallinen hallinta edellyttää, että linjaustutkimus pysyy näiden kyvykkyyksien tahdissa, jotta meidän ja muiden rakentamat järjestelmät säilyvät ihmisten arvojen mukaisina ja ihmisten hallinnassa. Tämä on yhä tärkeämpää tekoälyjärjestelmien kyvykkyyden ja autonomisuuden kasvaessa, myös niiden ottaessa vastuulleen yhä suuremman osan tekoälyn omasta tutkimuksesta ja kehityksestä. Tekoälyn jatkuvan kehityksen pitäminen turvallisena ja hyödyllisenä edellyttää sekä linjaustutkimuksen edistymistä että yhteisiä standardeja, jotka ohjaavat kehitystä laboratorioissa ja eri maissa.
Automatisoitu tekoälytutkimus voi sisältää eriasteista ihmisten valvontaa. Kun tekoälyjärjestelmät tekevät yhä suuremman osan peräkkäisten tekoälysukupolvien kehitystyöstä, ne voivat ohjata yhä enemmän rekursiivisen itsekehityksen (RSI) prosessia, vaikka ihmiset olisivat edelleen mukana. Prosessin automatisoituessa tekoälyn kehitysvauhti voi kiihtyä nopeasti.
Uskomme automatisoidun tekoälytutkimuksen tuottavan malleja, jotka parantavat suoraan ihmisten elämää. Se voi alentaa edistyneen älykkyyden kustannuksia, jotta ihmiset kaikkialla maailmassa voivat hyötyä siitä. Automatisoitu tutkimus voi myös auttaa parantamaan linjausta merkittävästi ja rakentamaan puolustusta yhä kyvykkäämpää tekoälyä vastaan – automatisoitu tekoälytutkija voi olla samalla automatisoitu tekoälyn turvallisuustutkija. Kyvykkäämmät ja paremmin linjatut järjestelmät voisivat auttaa turvaamaan kriittistä infrastruktuuria, puolustautumaan vaarallisilta tekoälyagenteilta ja kehittämään uusia suojatoimia.
Täysin autonomista RSI:tä ei tapahdu tällä hetkellä, eikä sitä pidä tavoitella, ellei ja ennen kuin se voidaan toteuttaa turvallisesti. Päätöksen etenemisestä ja sen tavasta on perustuttava kykyymme säilyttää ihmisten hallinta sekä hyötyjä ja riskejä koskeviin tietoon perustuviin demokraattisiin valintoihin(avautuu uudessa ikkunassa). Ilman asianmukaista huolellisuutta ja varovaisuutta toteutettu RSI voisi johtaa siihen, että ihmiset menettävät tekoälyn kehityksen käytännön hallinnan eivätkä enää pysty valvomaan tutkimusprosesseja, joita he eivät ymmärrä. Tämän seurauksena tekoäly voisi muuttua vaarallisemmaksi, huonommin linjatuksi ja kokonaisuutena uhaksi ihmisille. Julkistamamme Hugging Face -häiriö ei johtunut suoraan RSI:stä, mutta se antaa esimakua riskeistä, jotka voivat muuttua paljon vakavammiksi ilman vankkoja suojatoimia ja linjausta.
Edistyneen tekoälyn kehittämisen turvallisuuskäytäntöjä koskevat kansainväliset standardit voivat olla kehityksen tahdittamisessa yhtä tärkeitä kuin itse linjaustutkimus. Standardien avulla voidaan luoda yhteiset määritelmät laadukkaalle näytölle ja sopia teknisten suojatoimien tinkimättömyyttä koskevista vähimmäisvaatimuksista. Lyhyesti sanottuna ne auttavat vastaamaan kysymykseen: ”Miltä katastrofaalisen tekoälyriskin hyvä lieventäminen näyttää?”
Nykyiset demokraattiset instituutiot, kuten Center for AI Standards and Innovation (CAISI), osavaltioiden lait ja tekoälyä koskeva liittovaltiollinen kehys, voivat kaikki edistää tätä, samoin kuin uudenlaiset julkisen ja yksityisen sektorin kumppanuudet(avautuu uudessa ikkunassa). Tekoälyä kuitenkin kehitetään ja otetaan käyttöön useissa maissa, sen käyttö leviää maailmanlaajuisesti, ja sen vaikutukset koskettavat todennäköisesti tavalla tai toisella kaikkia ennemmin tai myöhemmin.
Siksi standardien kehittämiseen tarvitaan kansainvälisiä toimia, jotta voidaan ratkaista eräitä keskeisiä haasteita:
Pirstaleisuus – Eri maiden arvioinnit, raportointivaatimukset ja häiriöiden määritelmät voivat olla ristiriidassa keskenään, mikä vaikeuttaa näytön vertailua, uusien kyvykkyyksien ymmärtämistä ja valtioiden rajat ylittäviin riskeihin reagoimista.
Yhteistoiminta – Kunkin maan itsenäiset toimet voivat johtaa tuloksiin, joita mikään maa ei halua. RSI voi vauhdittaa itse tekoälytutkimusta mahdollisesti niin paljon, että yhteinen kykymme ymmärtää kehitystä, arvioida riskejä ja ylläpitää merkityksellistä ihmisten valvontaa ei pysy mukana.
Epätasaisesti jakautunut kapasiteetti – Edistyneen tekoälyn kehitystyö ja siihen liittyvä asiantuntemus eivät jakaudu tasaisesti eri puolille maailmaa. Tämä kärjistää kumpaakin edellä mainittua ongelmaa.
Nämä haasteet koskevat sekä avoimia että suljettuja malleja.
Selvyyden vuoksi: jokaisen automatisoitua tekoälytutkimusta tai muita edistyneitä kyvykkyyksiä tavoittelevan tekoälylaboratorion on kannettava vastuu työn turvallisuudesta omavastuun perusperiaatteiden ja voimassa olevien lakien mukaisesti. Perustelumme standardeille pohjautuvat vallan keskittymisen välttämiseen ja parempien käytännön tulosten saavuttamiseen. Standardit antavat useammille laboratorioiden ulkopuolisille sidosryhmille mahdollisuuden vaikuttaa tämän teknologian kehitykseen. Ne tarjoavat myös näkyvät periaatteet, joihin voidaan luottaa yksittäisten laboratorioiden käytännöistä riippumatta. Saamme myös todennäköisesti parempia tuloksia, jos osapuolet ratkaisevat edellä mainittuja haasteita yhteistyössä.
Siksi Yhdysvaltojen tulisi mielestämme johtaa hanketta, jossa eri maat kehittävät yhteistyössä edistynyttä tekoälyä, myös RSI:tä, koskevia maailmanlaajuisia teknisiä standardeja.
Vaikka odotamme tämän konseptin muuttuvan huomattavasti ajan myötä, kaksi näkökohtaa ovat olennaisia.
Yksi tapa toteuttaa tämä olisi hyödyntää kehittyvää tekoälyn turvallisuusinstituuttien verkostoa – esimerkiksi Australiassa, Kanadassa, Saksassa, Ranskassa, Keniassa, Japanissa, Koreassa, Singaporessa, Intiassa ja Yhdistyneessä kuningaskunnassa jo toimivia instituutteja – ja edistää standardien laatimista CAISI:n ja kansallisten toimialajärjestöjen kautta. Erityishuomio kohdistuisi (1) edistyneisiin tekoälymalleihin ja niiden kehittäjiin kyvykkyysvertailuilla mitattuina sekä (2) automatisoidun tekoälytutkimuksen, myös RSI:n, hyötyjen ja riskien hallintaan. Yhdysvallat voi jatkaa CAISI:n vuonna 2024 perustaman International Network for Advanced AI Measurement, Evaluation, and Science -verkoston(avautuu uudessa ikkunassa) työtä. Verkosto kokoaa julkisia instituutioita tekemään yhteistyötä tekoälyn mittaamisen, arvioinnin ja tutkimuksen parissa.
Tässä työssä kehitettävät standardit muodostaisivat yhteisen teknisen perustan kyvykkyyksien mittaamiselle ja arvioinnille, riskinarvioinnille sekä suojatoimien riittävyyden määrittämiselle. Nämä tekniset standardit eivät olisi tekoälymallien lisenssejä, pakollisia ennakkoarviointeja tai hyväksyntävaatimuksia. Kansalliset hallitukset päättäisivät, sisällytetäänkö standardit niiden omiin oikeusjärjestelmiin ja miten se tehtäisiin.
Työn tulisi myös tukea kilpailukykyistä tekoälyekosysteemiä kuulemalla avoimien ja suljettujen mallien kehittäjiä, riippumattomia teknisiä asiantuntijoita sekä tiedeyhteisöä. Yhteiset standardit on kehitettävä avoimesti ja suunniteltava niin, etteivät ne suosi tiettyjä yrityksiä, maita tai liiketoimintamalleja esimerkiksi vaikeuttamalla uusien toimijoiden tai avoimien painojen mallien kehittäjien kilpailua.
Kuten olemme ehdottaneet(avautuu uudessa ikkunassa), tässä lähestymistavassa voidaan ottaa oppia esimerkiksi ilmailusta ja rahoitusvakaudesta. Näillä aloilla maat ovat kehittäneet yhteisiä teknisiä standardeja ja luotettuja yhteistyökanavia luopumatta kansallisesta päätösvallastaan. Sen tulisi myös tehdä tiivistä yhteistyötä vakiintuneiden ja uudempien standardointiorganisaatioiden, kuten ISO:n(avautuu uudessa ikkunassa), Frontier Model Forumin(avautuu uudessa ikkunassa), Agentic AI Foundationin(avautuu uudessa ikkunassa) ja Open Secure AI Alliancen(avautuu uudessa ikkunassa), sekä käyttöönottoon keskittyvien organisaatioiden kanssa. Näihin kuuluu Appia Foundation, joka kehittää kansainväliset standardit tekoälyn käytännön arviointeihin yhdistäviä määrityksiä.
Kansainväliset tekoälystandardit ovat erityisen tärkeitä tekoälytutkimuksen kasvavan autonomisuuden ja rekursiivisen itsekehityksen hallinnassa. Ne voisivat sisältää erityisesti seuraavia standardeja:
RSI:n kannalta olennaisen tekoälykehityksen sekä tekoäly-yrityksessä tehtävän autonomisen tutkimuksen määrän arviointi. Tutkimuksen nopeutumista koskeva tuore raporttimme on ensimmäinen panoksemme tähän työhön.
Automatisoidun tekoälytutkimuksen ihmisten suorittama valvonta, mukaan lukien se, millaisten automatisoitujen tutkimusprosessien tulisi käynnistää välitön ihmisen tekemä tarkastus.
Linjaukseen ja automatisoituun tekoälytutkimukseen liittyvien häiriöiden luokittelu, seuranta, raportointi ja käsittely, mukaan lukien yhteiset vakavuustasot ja raportointikynnykset. Linjausvirheiden raportointikehyksemme on varhainen panos tähän työhön.
Näiden standardien lisäksi pidämme tärkeänä, että kriittisen infrastruktuurin ylläpitäjät ja hallitukset kaikkialla maailmassa perustavat suojattuja viestintäkanavia. Niissä voidaan jakaa kansalliseen turvallisuuteen liittyviä huolenaiheita, uusia haavoittuvuuksia ja uhkia sekä edistyneen tekoälyn nopeasti kehittyvän turvallisuusalan parhaita käytäntöjä. Yhdysvaltojen ja Kiinan välinen vuoropuhelu näistä aiheista olisi myönteinen askel, ja tulevat neuvottelut järjestetään otolliseen aikaan.
Tekoälyn kehityksen tahdittamisessa ei ole kyse ennalta määrätyn nopeuden ylläpitämisestä. Teknisesti kyse on siitä, että linjaustutkimus ja sen tulosten käyttöönotto pysyvät kyvykkyyksien kehityksen edellä. Yhteiskunnallisesti kyse on standardien, instituutioiden ja yhteistyön hyödyntämisestä niin, että teollisuuden verkostot, yhteiskunnalliset suhteet ja markkinavoimat vahvistavat toisiaan ja tuottavat kaikkia hyödyttäviä tuloksia. Tästä jälkimmäisestä on esimerkkinä äskettäinen kehotus yhteisiin toimiin kyberpuolustuksessa.
Yhdysvalloilla on hyvät edellytykset ottaa johtoasema, koska sen tekoälyteollisuus on teknisesti edistynyt ja maalla on yhä etuoikeutettu asema maailmanlaajuisissa verkostoissa esimerkiksi rahoituksen, kaupan, puolustuksen, teknologian ja tietojärjestelmien aloilla. Johtoaseman ottaminen nyt ratkaisee, muovaako Yhdysvallat maailmanlaajuiset tekoälyn puitteet vai joutuuko se seuraamaan sivusta, kun sen ympärille vakiintuu pirstaleinen, epätasainen ja konfliktien repimä järjestelmä. Samalla ratkeaa, vahvistaako edistynyt tekoäly Yhdysvaltojen ja sen liittolaisten nykyisiä verkostoja. Johtajuuden puute voi heikentää niitä.
Geopoliittisessa kilpailussa ei ole kyse vain teknisestä etumatkasta vaan myös tekoälyn käyttöönotosta ja leviämisestä. Jälkimmäisen ratkaisee yhä useammin se, kuka edistää käytännöllistä yhteistyötä ja järkeviä pelisääntöjä, joita yritykset ja yhteiskunnat kaikkialla tarvitsevat voidakseen rakentaa tulevaisuutensa tämän teknologian varaan.
Vahva kansallinen hallinto yhdistettynä käytännön kansainväliseen yhteistyöhön tarjoaa tien tehokkaampiin suojatoimiin, jatkuvaan innovointiin ja tekoälyn hyötyjen laajaan saatavuuteen.


