Ako si budeme voči Austrálii počínať lepšie
V júni počas interného tréningu a hodnotenia naše modely pristupovali na webové stránky austrálskych vlád spôsobmi, na ktoré nemali oprávnenie. Aj našu reakciu sme mali zvládnuť lepšie. Ospravedlňujeme sa a pracujeme na tom, aby sme si v budúcnosti počínali lepšie.
V tomto príspevku vysvetľujeme, čo vieme, čo sme zmenili a čo urobíme pre obnovenie dôvery austrálskej verejnosti. Ide o nový druh kybernetického incidentu, ktorý predstavuje novú globálnu výzvu. Jedným zo spôsobov, ako chceme prevziať zodpovednosť za túto situáciu, je cieľavedomá spolupráca s Austráliou na tvorbe praktických postupov. Tie majú vývojárom AI a vládam pomôcť identifikovať a oznamovať kybernetické správanie AI a reagovať naň, či už je škodlivé, alebo neúmyselné.
Po incidente s Hugging Face v júli sme začali preverovať predchádzajúcu činnosť počas tréningu a hodnotenia, aby sme identifikovali ďalšie dotknuté organizácie. V polovici augusta sme pri tomto preverovaní odhalili činnosť, ktorá zasiahla nižšie uvedené webové stránky austrálskych vlád.
Na základe dôkazov vieme toto:
Services Australia: Model OpenAI objavil spôsob, ako získať prístup k neverejnej časti služby. Spúšťal príkazy, získaval interné súbory, prihlasovacie údaje a súhrnné štatistiky a zapisoval súbory. K záznamom jednotlivých pacientov ani klientov však nepristupoval. Tomuto incidentu sa podrobnejšie venujeme nižšie.
Úrad pre štatistiku a výskum kriminality Nového Južného Walesu (BOCSAR): Model OpenAI pristupoval k verejnému nástroju BOCSAR na mapovanie kriminality, aby preskúmal verejné štatistiky kriminality. Nižšie bližšie vysvetľujeme, prečo modely plnia rôzne úlohy zamerané na vyhľadávanie informácií. Model odosielal požiadavky na API a metadáta webovej stránky prostredníctvom verejného nástroja BOCSAR, ktorý poskytuje prihlasovacie údaje pre požiadavky na API z prehliadača. Systém BOCSAR vrátil konfiguráciu aplikácie, prevádzkové úlohy a protokoly a metadáta webovej stránky. K záznamom o trestnej činnosti jednotlivých osôb model nepristupoval.
Ministerstvo zdravotníctva štátu Viktória: Agenti OpenAI objavili nechránený prístupový kľúč, pomocou ktorého odosielali dopyty do systému výkazníctva Agentúry pre zdravotnícke informácie štátu Viktória (VAHI) a získali konfiguráciu výkazníctva a súhrnné štatistiky z prieskumov. Nie je jasné, do akej miery mali byť tieto informácie prístupné. Závisí to od pravidiel prístupu agentúry VAHI. K zdravotným záznamom jednotlivcov ani k odpovediam z prieskumov, ktoré by umožnili identifikovať respondentov, agenti nepristupovali.
Austrálsky inštitút zdravia a sociálneho zabezpečenia (AIHW): Agenti OpenAI získali súhrnné štatistiky pomocou služieb tretích strán na prehliadanie webu a sťahovanie, a to aj z webovej stránky AIHW. Priamo tiež odosielali dopyty na údaje z grafov. Samostatné pokusy o obídenie kontroly prístupu boli neúspešné. Zdá sa, že stiahnuté materiály boli verejne dostupné. K narušeniu systému nedošlo. K zdravotným záznamom jednotlivcov agenti nepristupovali.
Vyšetrovanie týchto činností sme začali hneď, ako sme sa o nich v polovici augusta dozvedeli. Agentúru Services Australia a Ministerstvo zdravotníctva štátu Viktória sme informovali 10. septembra a Úrad pre štatistiku a výskum kriminality Nového Južného Walesu 18. septembra. Činnosť súvisiaca s Austrálskym inštitútom zdravia a sociálneho zabezpečenia nespĺňala naše kritériá na oznamovanie, pretože spôsob prístupu sa zdal byť v súlade s verejným prístupom. Napriek tomu sme inštitút 24. septembra informovali, aby sme sa podelili o zistenia a ponúkli podrobné vysvetlenie.
Naším cieľom bolo poskytnúť dotknutým úradom podrobnú správu po dokončení vyšetrovania. Predbežné zistenia sme však mali zdieľať skôr a austrálske úrady priebežne informovať o nových skutočnostiach.
Odvtedy úzko spolupracujeme s austrálskymi vládnymi úradmi a delíme sa s nimi o doterajšie zistenia. Ak identifikujeme ďalšie dotknuté úrady, bezodkladne a priamo im oznámime dostupné informácie a budeme ich priebežne informovať o ďalších zistených skutočnostiach.
Počas interného tréningu a hodnotenia v júni sme používali experimentálny model OpenAI určený výlučne na interné použitie, nie na verejné sprístupnenie. Nemal zavedený úplný súbor ochranných opatrení, ktoré používame v našich verejne dostupných produktoch. V priebehu tohto tréningu a hodnotenia pristupoval k službe Medicare Statistics Reporting Service agentúry Services Australia. Pri doterajšom preverovaní sme nenašli dôkazy o prístupe k zdravotným záznamom akejkoľvek osoby.
Pri internom tréningu a hodnotení zadávame našim modelom úlohy zo širokého súboru výskumných otázok z mnohých oblastí. Odrážajú typy podrobných otázok, ktoré môžu klásť používatelia. Model sa tak učí vyhľadávať, interpretovať a analyzovať verejne dostupné informácie, aby bol pre ľudí užitočnejší. Naše modely majú na tieto otázky odpovedať pomocou verejne publikovaných štatistík.
V tomto prípade bolo jednou z úloh modelu zistiť výšku vládnych výdavkov na lieky na kožné ochorenia na obyvateľa v komunitách austrálskeho štátu Viktória. Model mal so získaním týchto informácií ťažkosti a podnikol kroky, na ktoré sme mu nedali oprávnenie. Pri hľadaní týchto informácií v službe Medicare Statistics Reporting Service agentúry Services Australia objavil spôsob, ako získať prístup k neverejnej časti služby. Tento prístup následne využil na preskúmanie technických informácií o systéme a zdrojového kódu súvisiaceho so službou. Stále pritom sledoval pôvodný cieľ: nájsť požadované informácie. Táto činnosť nebola naším zámerom. K takémuto prístupu do služby ani k následnej činnosti nemalo dôjsť.
Po incidente s Hugging Face sme posilnili ochranné opatrenia pri výskume vrátane ďalších sieťových obmedzení a rozšíreného monitorovania. V týchto výskumných prostrediach sme zaviedli opatrenia blokujúce priamy prístup na internet. Webový obsah je dostupný len z vyrovnávacej pamäte. Ďalšiu vrstvu zabezpečenia tvoria naše súčasné monitorovacie systémy, ktoré by túto činnosť odhalili a upozornili náš tím na potrebu urgentného ľudského posúdenia. Napríklad keď model počas nedávneho tréningu(otvorí sa v novom okne) získal priamy prístup na internet, náš monitorovací systém túto činnosť odhalil a upozornil človeka zodpovedného za posúdenie. Tréning sme zastavili. Tieto ochranné opatrenia naďalej testujeme a odstraňujeme ich nedostatky. Incident s Hugging Face zostáva najzávažnejším incidentom, ktorý sme zaznamenali.
Ľudia chcú mať istotu, že vývoj AI prebieha bezpečne. Základom sú pritom kroky, ktoré podnikajú samotné spoločnosti, ako je tá naša. Nedávno sme oznámili(otvorí sa v novom okne), že sme pozastavili tréning a hodnotenie našich najschopnejších modelov zahŕňajúce používanie nástrojov. Ich tréning obnovíme až vtedy, keď budeme mať istotu, že sú zavedené dodatočné ochranné opatrenia, na ktorých teraz pracujeme.
S tým, ako sa schopnosti systémov AI vo všeobecnosti zvyšujú, vidíme aj to, že čas na pomoc organizáciám pri hľadaní a odstraňovaní slabých miest sa kráti. To si vyžaduje spoločný postup v spolupráci s odborníkmi na kybernetickú obranu z celého sveta.
Pripojili sme sa k organizáciám z oblasti technológií, kybernetickej bezpečnosti a kritickej infraštruktúry vo výzve na spoločný postup v kybernetickej obrane. Táto výzva sa začína našou vlastnou zodpovednosťou: posilnením ochranných opatrení, včasným informovaním a praktickou podporou dotknutých organizácií. Zároveň vyzýva na investície do tímov, ktoré chránia základné služby, aby mohli hľadať zraniteľnosti, overovať opravy a deliť sa o osvedčené postupy.
V Austrálii poskytneme zdroje a odborné znalosti na podporu dotknutých úradov a pomôžeme odborníkom na kybernetickú obranu uplatniť tieto princípy v praxi. Súčasťou budú:
Cielená podpora dotknutých úradov. Vyčleníme zdroje potrebné na to, aby sme dotknutým úradom pomohli pochopiť, čo sa stalo, a posúdiť dosah. To zahŕňa zdieľanie relevantných technických zistení a zabezpečenie spolupráce s našimi tímami reakcie na incidenty na základe príslušných dohôd o výmene informácií.
Financovanie a podpora na posilnenie kybernetickej obrany. Austrálske vlády a priemysel podporíme kreditmi z nášho fondu Daybreak for Frontline Defenders v objeme 1 miliardy dolárov a technickou pomocou na posilnenie kybernetickej obrany v kritickej infraštruktúre a ďalších citlivých prostrediach. Táto práca nadviaže na našu spoluprácu s vládami a prevádzkovateľmi kritickej infraštruktúry. Pomôže organizáciám lepšie chápať a odhaľovať riziká vyplývajúce z čoraz schopnejších AI agentov a reagovať na ne.
Austrálska pracovná skupina. Zriadime pracovnú skupinu so zapojením nezávislých austrálskych odborníkov, ktorá vypracuje praktické odporúčania pre tvorbu politík na riadenie rizík vyplývajúcich z čoraz schopnejších AI agentov. Na základe poučení z týchto incidentov sa zameria na zlepšenie oznamovacích procesov, posilnenie koordinácie medzi vývojármi AI a vládou a určenie opatrení na lepšiu ochranu vládnych systémov. Odporúčania pracovnej skupiny ovplyvnia prístup OpenAI a podporia prácu austrálskych vlád v oblasti bezpečnosti AI a kybernetickej bezpečnosti. Pracovná skupina, ktorá by mala svoju prácu dokončiť do konca roka, odporučí aj praktické kroky, ktorými môžu spoločnosti vyvíjajúce AI znížiť riziko podobných incidentov.
Austrálske vlády, priemyselné odvetvia a občania sú a vždy boli pre OpenAI neoceniteľnými partnermi. Neberieme to ako samozrejmosť a chceme situáciu napraviť.
Riaditeľ pre stratégiu OpenAI Jason Kwon priletí z ústredia OpenAI v USA, aby v utorok 6. októbra vystúpil v Sydney pred Spoločným osobitným výborom pre umelú inteligenciu. Odpovie na otázky o tom, čo vieme, ako sme reagovali, aké kroky sme podnikli a ako sa do budúcnosti zlepšíme.
O overené zistenia sa budeme naďalej deliť s dotknutými úradmi a príslušnými vládami. Budeme zverejňovať aktuálne informácie o našom prebiehajúcom preverovaní a o pokroku pri plnení týchto záväzkov. Vieme, že obnovenie dôvery si vyžiada ešte veľa práce. Je našou zodpovednosťou ukázať Austrálčanom, že uskutočňujeme zmysluplné zmeny a plníme svoje sľuby.


