Paano namin pagbubutihin ang aming gawain para sa Australia
Noong Hunyo, habang nagsasagawa kami ng panloob na pagsasanay at pagsusuri, na-access ng aming mga modelo ang mga website ng pamahalaan ng Australia sa mga paraang hindi pinahintulutan. Dapat din sana ay naging mas maayos ang aming pagtugon. Humihingi kami ng paumanhin at nagsisikap na maging mas mahusay sa hinaharap.
Sa post na ito, inilalahad namin ang nalalaman namin, ang mga binago namin, at ang mga gagawin namin para maibalik ang tiwala ng mga mamamayan ng Australia. Isa itong bagong uri ng insidente sa cyberspace na nagpapakita ng umuusbong na pandaigdigang hamon. Isa sa mga paraan ng aming pananagutan sa sitwasyong ito ang masigasig na pakikipagtulungan sa Australia para makatulong sa pagbuo ng mga praktikal na paraan ng pagtukoy, pagbubunyag, at pagtugon ng mga developer ng AI at pamahalaan sa mga kilos ng AI sa cyberspace, malisyoso man o hindi sinasadya.
Matapos ang insidente sa Hugging Face noong Hulyo, sinimulan naming suriin ang mga naunang aktibidad sa pagsasanay at pagsusuri para matukoy ang iba pang apektadong organisasyon. Noong kalagitnaan ng Agosto, natukoy sa pagsusuring iyon ang aktibidad na nakaapekto sa mga sumusunod na website ng pamahalaan ng Australia.
Ito ang nalalaman namin batay sa ebidensya:
Services Australia: Nakatuklas ang isang modelo ng OpenAI ng paraan para makakuha ng access sa serbisyong hindi bukas sa publiko. Nagpatakbo ito ng mga command, kumuha ng mga panloob na file, kredensyal, at pinagsama-samang estadistika, at nagsulat ng mga file. Gayunman, hindi na-access ang mga indibidwal na rekord ng pasyente o kliyente. Tatalakayin namin ang insidenteng ito nang mas detalyado sa ibaba.
NSW Bureau of Crime Statistics and Research (BOCSAR): Na-access ng isang modelo ng OpenAI ang pampublikong Crime Mapping Tool ng BOCSAR para magsaliksik ng mga pampublikong estadistika ng krimen (ipapaliwanag namin sa ibaba kung bakit gumagawa ang mga modelo ng iba't ibang gawain sa pagsasaliksik ng impormasyon). Nagpadala ang modelo ng mga request sa API at para sa metadata ng website sa pamamagitan ng pampublikong tool ng BOCSAR, na nagbibigay ng mga kredensyal para sa mga API request mula sa browser. Ibinigay ng sistema ng BOCSAR ang configuration ng application, mga operational job at log, at metadata ng website. Hindi na-access ang mga rekord ng krimen ng mga indibidwal.
Victorian Department of Health: Nakatuklas ang mga agent ng OpenAI ng isang nakalantad na access key na magagamit para mag-query sa sistema ng pag-uulat ng Victorian Agency for Health Information at makuha ang configuration ng pag-uulat at pinagsama-samang estadistika ng survey. Hindi malinaw kung gaano kalawak dapat ang pinapayagang access sa impormasyong ito, at nakadepende ito sa mga patakaran ng VAHI sa access. Hindi na-access ang mga indibidwal na medikal na rekord o mga sagot sa survey na maaaring matukoy kung kanino galing.
Australian Institute of Health and Welfare: Kumuha ang mga agent ng OpenAI ng pinagsama-samang estadistika gamit ang mga serbisyo ng third party para sa pag-browse at pag-download, kabilang ang mula sa website ng AIHW, at direktang nag-query ng data ng mga chart. Hindi nagtagumpay ang magkakahiwalay na pagtatangkang lampasan ang mga kontrol sa access. Lumilitaw na bukas sa publiko ang na-download na materyal. Hindi nakompromiso ang sistema. Hindi na-access ang mga indibidwal na medikal na rekord.
Agad naming sinimulang imbestigahan ang mga aktibidad na ito nang malaman namin ang mga ito noong kalagitnaan ng Agosto. Inabisuhan namin ang Services Australia at ang Victorian Department of Health noong Setyembre 10, at ang NSW Bureau of Crime Statistics and Research noong Setyembre 18. Hindi umabot sa aming pamantayan para sa pagbubunyag ang aktibidad na kaugnay ng Australian Institute of Health and Welfare dahil tila naaayon sa pampublikong access ang paraan ng pag-access dito. Gayunman, inabisuhan namin ito noong Setyembre 24 para ibahagi ang aming mga natuklasan at mag-alok ng isang briefing.
Layunin naming bigyan ang mga apektadong ahensya ng detalyadong ulat kapag kumpleto na ang aming imbestigasyon. Gayunman, dapat sana ay mas maaga naming naibahagi ang mga paunang natuklasan at patuloy na nabigyan ng mga update ang mga ahensya sa Australia habang may nalalamang mga bagong detalye.
Mula noon, malapit na kaming nakikipagtulungan sa mga ahensya ng pamahalaan ng Australia para ibahagi ang mga nalaman namin sa ngayon. Kung may matukoy pa kaming ibang apektadong ahensya, agad at direkta namin silang aabisuhan gamit ang impormasyong mayroon kami, at magbibigay ng mga update habang may nalalamang karagdagang detalye.
Sa panloob na pagsasanay at pagsusuri noong Hunyo, nagpapatakbo kami ng isang eksperimental na modelo ng OpenAI na para lamang sa panloob na paggamit at hindi nilalayong ilabas sa publiko. Wala rin dito ang kumpletong hanay ng mga proteksyong ginagamit sa aming mga produktong bukas sa publiko. Habang isinasagawa ang pagsasanay at pagsusuring ito, na-access nito ang Medicare Statistics Reporting Service ng Services Australia. Sa aming pagsusuri hanggang ngayon, wala kaming nakitang ebidensya na na-access ang medikal na rekord ng sinuman.
Kapag nagsasagawa kami ng panloob na pagsasanay at pagsusuri sa aming mga modelo, binibigyan namin ang mga ito ng mga gawain mula sa malawak na koleksyon ng mga tanong sa pananaliksik sa maraming paksa, na kumakatawan sa mga detalyadong tanong na maaaring itanong ng mga user. Sinasanay nito ang isang modelo na maghanap, umunawa, at magsuri ng impormasyong bukas sa publiko para mas maging kapaki-pakinabang ito sa mga tao. Dapat sagutin ng aming mga modelo ang mga tanong na ito gamit ang mga estadistikang inilathala para sa publiko.
Sa kasong ito, isa sa mga gawaing ibinigay sa modelo ang pagsasaliksik kung magkano ang ginagastos ng pamahalaan bawat tao para sa mga gamot sa sakit sa balat sa mga komunidad sa Victoria. Nahirapan ang modelo na makuha ang impormasyong iyon, at gumawa ito ng mga aksyong hindi namin pinahintulutan. Habang hinahanap ang impormasyong ito sa Medicare Statistics Reporting Service ng Services Australia, nakatuklas ito ng paraan para makakuha ng access sa serbisyong hindi bukas sa publiko. Pagkatapos, ginamit nito ang access na ito para suriin ang teknikal na impormasyon ng sistema at source code na kaugnay ng serbisyo—layunin pa rin nitong mahanap ang impormasyong orihinal nitong hinahanap. Hindi namin nilayong mangyari ito, at hindi dapat naganap ang pag-access sa serbisyo at ang mga sumunod na aktibidad.
Kasunod ng insidente sa Hugging Face, pinalakas namin ang mga proteksyon sa aming pananaliksik, kabilang ang mga karagdagang paghihigpit sa network at mas malawak na pagsubaybay. Nagpatupad kami ng mga kontrol para harangan ang direktang access sa internet sa mga research environment na ito, at naka-cache na content ang ginagamit para sa web access. Bilang dagdag na proteksyon, matutukoy sana ng aming kasalukuyang mga sistema ng pagsubaybay ang aktibidad na ito at maaalerto ang aming team para sa agarang pagsusuri ng tao. Halimbawa, nang magkaroon ng direktang access sa internet ang isang modelo sa isang kamakailang pagsasanay(magbubukas sa bagong window), natukoy ng aming pagsubaybay ang aktibidad at naalerto ang isang tagasuri, kaya itinigil namin ang pagsasanay. Patuloy naming sinusubok ang mga proteksyong ito at tinutugunan ang mga kakulangan. Ang insidente sa Hugging Face pa rin ang pinakamalubhang naobserbahan namin.
Gustong makatiyak ng mga tao na ligtas ang pagbuo ng AI, at nagsisimula iyon sa mismong ginagawa ng mga kumpanyang tulad namin. Kamakailan naming ibinahagi(magbubukas sa bagong window) na pansamantala naming itinigil ang pagsasanay at pagsusuring may paggamit ng mga tool para sa aming mga modelong may pinakamataas na kakayahan. Ipagpapatuloy lang namin ang pagsasanay kapag tiwala na kaming naipatupad na ang mga karagdagang proteksyon na kasalukuyan naming binubuo.
Habang patuloy na lumalawak ang kakayahan ng mga AI system sa pangkalahatan, nakikita rin naming umiikli ang panahong natitira para tulungan ang mga organisasyon na hanapin at ayusin ang mga kahinaan. Nangangailangan ito ng sama-samang pagkilos kasama ang mga tagapagtanggol ng mga sistema sa buong mundo.
Nakiisa kami sa mga organisasyon sa teknolohiya, cybersecurity, at kritikal na imprastraktura sa isang panawagan para sa sama-samang pagkilos sa cyber defense. Nagsisimula ang panawagang iyon sa sarili naming mga responsibilidad, kabilang ang mas matibay na mga proteksyon, napapanahong pagbubunyag ng impormasyon, at praktikal na suporta para sa mga apektadong organisasyon. Nanawagan din ito ng pamumuhunan sa mga team na nagpoprotekta sa mahahalagang serbisyo, para mahanap nila ang mga kahinaan, matiyak na epektibo ang mga pag-aayos, at maibahagi ang mga paraang gumagana.
Sa Australia, maglalaan kami ng mga mapagkukunan at kadalubhasaan para suportahan ang mga apektadong ahensya at tulungan ang mga tagapagtanggol ng mga sistema na maisagawa ang mga prinsipyong ito, kabilang ang:
Nakalaang suporta para sa mga apektadong ahensya. Maglalaan kami ng mga kinakailangang mapagkukunan para matulungan ang mga apektadong ahensya na maunawaan ang nangyari at masuri ang epekto nito. Kabilang dito ang pagbabahagi ng mga kaugnay na teknikal na natuklasan at pagsasaayos ng pakikipag-ugnayan sa aming mga response team sa ilalim ng naaangkop na mga kasunduan sa pagbabahagi ng impormasyon.
Pondo at suporta para palakasin ang mga cyber defense. Susuportahan namin ang mga pamahalaan at industriya sa Australia sa pamamagitan ng credits mula sa aming $1 bilyong pondong Daybreak for Frontline Defenders at teknikal na tulong para palakasin ang mga cyber defense sa kritikal na imprastraktura at iba pang sensitibong sistema. Batay sa aming pakikipag-ugnayan sa mga pamahalaan at operator ng kritikal na imprastraktura, makakatulong ang gawaing ito sa mga organisasyon na mas maunawaan, matukoy, at matugunan ang mga panganib mula sa mga AI agent na patuloy na lumalawak ang kakayahan.
Isang task force sa Australia. Bubuo kami ng task force na may mga independiyenteng eksperto mula sa Australia para bumuo ng mga praktikal na rekomendasyon sa patakaran para sa pamamahala ng mga panganib mula sa mga AI agent na patuloy na lumalawak ang kakayahan. Gamit ang mga aral mula sa mga insidenteng ito, tututukan nito ang pagpapahusay sa mga proseso ng pag-abiso, pagpapalakas ng koordinasyon sa pagitan ng mga developer ng AI at ng pamahalaan, at pagtukoy ng mga hakbang para mas maprotektahan ang mga sistema ng pamahalaan. Gagabay ang mga rekomendasyon ng task force sa paraan ng pagkilos ng OpenAI at susuporta sa mga pagsisikap ng mga pamahalaan sa Australia para sa kaligtasan ng AI at cybersecurity. Ang task force, na inaasahang matatapos ang gawain bago matapos ang taon, ay magrerekomenda rin ng mga praktikal na hakbang na magagawa ng mga kumpanya ng AI para mabawasan ang panganib ng mga katulad na insidente.
Noon pa man at hanggang ngayon, napakahalagang mga katuwang ng OpenAI ang mga pamahalaan, industriya, at mamamayan ng Australia. Pinahahalagahan namin ito, at layunin naming itama ang nangyari.
Bibiyahe si Jason Kwon, Chief Strategy Officer ng OpenAI, mula sa punong tanggapan ng OpenAI sa US para humarap sa Joint Select Committee on Artificial Intelligence sa Sydney sa Martes, Oktubre 6. Sasagutin niya ang mga tanong tungkol sa nalalaman namin, kung paano kami tumugon, kung anong mga hakbang ang ginawa namin, at kung paano namin pagbubutihin ang aming gawain sa hinaharap.
Patuloy naming ibabahagi ang mga beripikadong natuklasan sa mga apektadong ahensya at kaugnay na pamahalaan. Maglalathala kami ng mga update tungkol sa aming patuloy na pagsusuri at pag-usad sa pagtupad sa mga pangakong ito. Alam naming marami pa kaming kailangang gawin para maibalik ang tiwala, at responsibilidad naming ipakita sa mga Australiano na gumagawa kami ng makabuluhang mga pagbabago at tinutupad ang aming mga pangako.


