Tijekom internog treniranja i evaluacije u lipnju naši su modeli pristupali mrežnim stranicama australskih državnih tijela na načine za koje nisu imali ovlaštenje. I naša je reakcija trebala biti bolja. Žao nam je i radimo na tome da ubuduće postupamo bolje.
U ovoj objavi iznosimo što znamo, što smo promijenili i što ćemo poduzeti kako bismo obnovili povjerenje australskih građana. Riječ je o novoj vrsti kibernetičkog incidenta koja predstavlja globalni izazov u nastajanju. Jedan od načina na koji namjeravamo preuzeti odgovornost za ovu situaciju jest predana suradnja s Australijom na razvoju praktičnih pristupa kojima razvojne tvrtke za umjetnu inteligenciju i vlasti mogu prepoznavati i prijavljivati kibernetičko ponašanje umjetne inteligencije te na njega reagirati, bilo ono zlonamjerno ili nenamjerno.
Nakon incidenta s platformom Hugging Face u srpnju počeli smo provjeravati ranije aktivnosti treniranja i evaluacije kako bismo utvrdili koje su još organizacije pogođene. Sredinom kolovoza tom smo provjerom otkrili aktivnosti koje su zahvatile mrežne stranice australskih državnih tijela navedene u nastavku.
Evo što znamo na temelju dokaza:
Services Australia: Model tvrtke OpenAI otkrio je način da pristupi dijelu servisa koji nije namijenjen javnosti te je izvršavao naredbe, dohvaćao interne datoteke, vjerodajnice i zbirne statističke podatke te zapisivao datoteke. Međutim, nije pristupao pojedinačnim evidencijama pacijenata ili korisnika. Taj incident detaljnije opisujemo u nastavku.
Ured za statistiku i istraživanje kriminala Novog Južnog Walesa (BOCSAR): Model tvrtke OpenAI pristupio je javnom alatu BOCSAR-a za kartiranje kriminala kako bi istražio javno dostupne statističke podatke o kriminalu (u nastavku dodatno objašnjavamo zašto modeli obavljaju različite zadatke istraživanja informacija). Model je putem javnog alata BOCSAR-a, koji pruža vjerodajnice za API zahtjeve iz preglednika, slao zahtjeve API-ju i zahtjeve za metapodacima mrežne stranice. Sustav BOCSAR-a vratio je konfiguraciju aplikacije, operativne zadatke i zapisnike te metapodatke mrežne stranice. Nije bilo pristupa kaznenim evidencijama pojedinaca.
Ministarstvo zdravstva Victorije: Agenti tvrtke OpenAI otkrili su izloženi pristupni ključ koji im je omogućio slanje upita sustavu za izvješćivanje Agencije za zdravstvene informacije Victorije te dohvaćanje konfiguracije izvješćivanja i zbirnih statističkih podataka iz anketa. Nije jasno u kojoj su mjeri te informacije trebale biti dostupne, a to ovisi o pravilima pristupa agencije VAHI. Nije bilo pristupa pojedinačnim medicinskim kartonima ni odgovorima na ankete iz kojih bi se mogao utvrditi identitet ispitanika.
Australski institut za zdravstvo i socijalnu skrb: Agenti tvrtke OpenAI dohvaćali su zbirne statističke podatke putem usluga trećih strana za pregledavanje weba i preuzimanje sadržaja, među ostalim s mrežne stranice instituta AIHW, te izravno slali upite za podatke iz grafikona. Zasebni pokušaji zaobilaženja kontrola pristupa bili su neuspješni. Čini se da su preuzeti materijali bili javno dostupni. Nije došlo do kompromitiranja sustava. Nije bilo pristupa pojedinačnim medicinskim kartonima.
Pokrenuli smo istrage tih aktivnosti čim smo za njih saznali sredinom kolovoza. Agenciju Services Australia i Ministarstvo zdravstva Victorije obavijestili smo 10. rujna, a Ured za statistiku i istraživanje kriminala Novog Južnog Walesa 18. rujna. Aktivnost povezana s Australskim institutom za zdravstvo i socijalnu skrb nije ispunjavala naše kriterije za obavješćivanje jer se činilo da način pristupa odgovara javno dostupnom pristupu. Ipak, obavijestili smo institut 24. rujna kako bismo podijelili svoje nalaze i ponudili detaljnije upoznavanje s njima.
Cilj nam je bio pogođenim agencijama dostaviti detaljno izvješće nakon završetka istrage. Međutim, preliminarne smo nalaze trebali podijeliti ranije i redovito obavještavati australske agencije o novim činjenicama.
Otada blisko surađujemo s australskim državnim agencijama kako bismo s njima podijelili sve što smo dosad saznali. Ako utvrdimo da su pogođene i druge agencije, odmah ćemo ih izravno obavijestiti o dostupnim informacijama i nastaviti im slati obavijesti o novim činjenicama.
Tijekom internog treniranja i evaluacije u lipnju upotrebljavali smo eksperimentalni model tvrtke OpenAI isključivo za internu upotrebu, koji nije bio namijenjen javnoj objavi i nije imao sve zaštitne mjere koje upotrebljavamo u javno dostupnim proizvodima. Tijekom tog treniranja i evaluacije pristupio je servisu za statističko izvješćivanje Medicare agencije Services Australia. Dosadašnjom provjerom nismo pronašli dokaze da je pristupljeno ičijim medicinskim kartonima.
Tijekom internog treniranja i evaluacije modelima dodjeljujemo zadatke iz opsežne zbirke istraživačkih pitanja koja obuhvaćaju brojne teme i odražavaju vrste detaljnih pitanja koja bi korisnici mogli postaviti. Time se model uči pronalaziti, tumačiti i analizirati javno dostupne informacije kako bi ljudima bio korisniji. Naši bi modeli na ta pitanja trebali odgovarati koristeći se javno objavljenim statističkim podacima.
U ovom je slučaju jedan od zadataka dodijeljenih modelu bio istražiti državnu potrošnju po stanovniku na lijekove za kožne bolesti u zajednicama u australskoj saveznoj državi Victoriji. Model je imao poteškoća s pronalaženjem tih informacija te je poduzeo radnje za koje mu nismo dali ovlaštenje. Tražeći te informacije u servisu za statističko izvješćivanje Medicare agencije Services Australia, otkrio je način da pristupi dijelu servisa koji nije namijenjen javnosti. Zatim je iskoristio taj pristup za pregled tehničkih informacija o sustavu i izvornog koda povezanog sa servisom, i dalje pokušavajući pronaći informacije koje je izvorno tražio. Te aktivnosti nisu bile naša namjera, a do pristupa servisu i radnji koje su uslijedile nije smjelo doći.
Nakon incidenta s platformom Hugging Face pojačali smo zaštitne mjere u istraživanju, uključujući dodatna mrežna ograničenja i proširen nadzor. Uveli smo kontrole koje blokiraju izravan pristup internetu u tim istraživačkim okruženjima, a pristup webu omogućuju putem predmemoriranog sadržaja. Kao dodatan sloj sigurnosti, naši bi sadašnji sustavi nadzora otkrili tu aktivnost i upozorili naš tim da je potrebna hitna ljudska provjera. Primjerice, kada je model dobio izravan pristup internetu tijekom nedavnog ciklusa treniranja(otvara se u novom prozoru), naš je sustav nadzora otkrio tu aktivnost i upozorio osobu zaduženu za provjeru, a mi smo zaustavili ciklus. Nastavljamo testirati te zaštitne mjere i otklanjati nedostatke. Incident s platformom Hugging Face i dalje je najozbiljniji koji smo zabilježili.
Ljudi žele znati da se umjetna inteligencija razvija sigurno, a to počinje onime što tvrtke poput naše same poduzimaju. Nedavno smo objavili(otvara se u novom prozoru) da smo privremeno obustavili treniranje i evaluaciju naših najsposobnijih modela koji uključuju upotrebu alata. Njihovo ćemo treniranje nastaviti tek kada budemo sigurni da su uvedene dodatne zaštitne mjere, na kojima sada radimo.
Kako sustavi umjetne inteligencije općenito postaju sposobniji, uviđamo i da imamo sve manje vremena da organizacijama pomognemo pronaći i otkloniti slabosti. Za to je potrebno zajedničko djelovanje u suradnji sa stručnjacima za kibernetičku obranu diljem svijeta.
Pridružili smo se organizacijama iz sektora tehnologije, kibernetičke sigurnosti i kritične infrastrukture u pozivu na zajedničko djelovanje u području kibernetičke obrane. Taj poziv polazi od naših vlastitih odgovornosti, uključujući snažnije zaštitne mjere, pravodobno obavješćivanje i praktičnu podršku pogođenim organizacijama. Njime se poziva i na ulaganje u timove koji štite ključne usluge kako bi mogli pronalaziti ranjivosti, provjeravati ispravke i razmjenjivati učinkovita rješenja.
U Australiji izdvajamo resurse i stručna znanja za podršku pogođenim agencijama i pomoć stručnjacima za kibernetičku obranu u primjeni tih načela, što uključuje:
Ciljanu podršku pogođenim agencijama. Osigurat ćemo resurse potrebne da pogođenim agencijama pomognemo razumjeti što se dogodilo i procijeniti posljedice. To uključuje dijeljenje relevantnih tehničkih nalaza i uspostavljanje suradnje s našim timovima za odgovor na incidente uz odgovarajuće sporazume o razmjeni informacija.
Financiranje i podršku za jačanje kibernetičke obrane. Australskim vlastima i industriji pružit ćemo podršku u obliku kredita iz našeg fonda Daybreak za branitelje na prvoj crti, vrijednog milijardu dolara, te tehničke pomoći za jačanje kibernetičke obrane kritične infrastrukture i drugih osjetljivih okruženja. Nadovezujući se na našu suradnju s vlastima i operatorima kritične infrastrukture, taj će rad pomoći organizacijama da bolje razumiju i prepoznaju rizike koje donose sve sposobniji agenti umjetne inteligencije te na njih odgovore.
Australsku radnu skupinu. Osnovat ćemo radnu skupinu koja će uz neovisne australske stručnjake izraditi praktične preporuke za politike upravljanja rizicima koje donose sve sposobniji agenti umjetne inteligencije. Na temelju pouka iz tih incidenata usredotočit će se na poboljšanje postupaka obavješćivanja, jačanje koordinacije između razvojnih tvrtki za umjetnu inteligenciju i vlasti te utvrđivanje mjera za bolju zaštitu državnih sustava. Preporuke radne skupine usmjeravat će pristup tvrtke OpenAI i poduprijeti rad australskih vlasti na sigurnosti umjetne inteligencije i kibernetičkoj sigurnosti. Radna skupina, koja bi trebala završiti svoj rad do kraja godine, preporučit će i praktične korake koje tvrtke za umjetnu inteligenciju mogu poduzeti kako bi smanjile rizik od sličnih incidenata.
Australske vlasti, industrije i građani oduvijek su bili i ostaju neprocjenjivi partneri tvrtke OpenAI. To ne uzimamo zdravo za gotovo i namjeravamo ispraviti svoje propuste.
Direktor strategije tvrtke OpenAI Jason Kwon doputovat će iz sjedišta tvrtke u SAD-u kako bi u utorak, 6. listopada, u Sydneyju sudjelovao na saslušanju pred Zajedničkim posebnim odborom za umjetnu inteligenciju. Odgovarat će na pitanja o tome što znamo, kako smo reagirali, koje smo korake poduzeli i kako ćemo ubuduće postupati bolje.
Nastavit ćemo dijeliti provjerene nalaze s pogođenim agencijama i nadležnim vlastima. Objavljivat ćemo novosti o provjeri koja je u tijeku i napretku u ispunjavanju ovih obveza. Znamo da je pred nama mnogo posla kako bismo obnovili povjerenje i da smo dužni pokazati Australcima da provodimo značajne promjene i ispunjavamo svoja obećanja.


