Անցնել հիմնական բովանդակությանը
OpenAI

Ինչպես ենք բարելավելու մեր աշխատանքը Ավստրալիայի համար

Բեռնվում է…

Հունիսին՝ ներքին ուսուցման և գնահատման ընթացքում, մեր մոդելները չթույլատրված եղանակներով մուտք են գործել Ավստրալիայի պետական կայքեր։ Մենք նաև պետք է ավելի լավ կազմակերպեինք մեր արձագանքը։ Մենք ներողություն ենք խնդրում և աշխատում ենք հետագայում ավելի լավ գործելու ուղղությամբ։

Այս հրապարակման մեջ ներկայացնում ենք, թե ինչ գիտենք, ինչ ենք փոխել և ինչ ենք անելու՝ Ավստրալիայի ժողովրդի վստահությունը վերականգնելու համար։ Սա կիբերմիջադեպի նոր տեսակ է, որն ի հայտ եկող համաշխարհային մարտահրավեր է։ Իրավիճակի համար պատասխանատվություն ստանձնելու մեր քայլերից մեկը կլինի Ավստրալիայի հետ նպատակային համագործակցությունը՝ գործնական մոտեցումներ մշակելու համար։ Դրանք կօգնեն ԱԲ մշակողներին և կառավարություններին հայտնաբերել, բացահայտել և արձագանքել ԱԲ-ի կիբերվարքագծին՝ լինի այն չարամիտ, թե ոչ միտումնավոր։

Երբ իմացանք միջադեպի մասին և ինչպես արձագանքեցինք

Հուլիսին տեղի ունեցած Hugging Face-ի միջադեպից հետո մենք սկսեցինք ուսումնասիրել ուսուցման ու գնահատման ավելի վաղ գործողությունները՝ այլ տուժած կազմակերպություններ հայտնաբերելու համար։ Օգոստոսի կեսերին այդ ուսումնասիրությամբ հայտնաբերվեցին ստորև նշված՝ Ավստրալիայի պետական կայքերին առնչվող գործողություններ։

Առկա ապացույցների հիման վրա մեզ հայտնի է հետևյալը․

  • Services Australia․ OpenAI-ի մոդելը հայտնաբերել էր ծառայության՝ հանրությանը փակ հատված մուտք գործելու եղանակ, գործարկել հրամաններ, ստացել ներքին ֆայլեր, մուտքի տվյալներ ու ամփոփ վիճակագրություն և գրել ֆայլեր։ Սակայն առանձին պացիենտների կամ հաճախորդների գրառումներին հասանելիություն չի ստացվել։ Այս միջադեպին ավելի մանրամասն անդրադառնում ենք ստորև։

  • Նոր Հարավային Ուելսի հանցավորության վիճակագրության և հետազոտությունների բյուրո (BOCSAR)․ OpenAI-ի մոդելն օգտվել էր BOCSAR-ի հանրամատչելի հանցավորության քարտեզագրման գործիքից՝ հանցավորության հրապարակային վիճակագրությունն ուսումնասիրելու համար (ստորև բացատրում ենք, թե ինչու են մոդելները կատարում տեղեկատվության որոնման տարբեր առաջադրանքներ)։ Մոդելը API-ի և կայքի մետատվյալների հարցումներ էր ուղարկել BOCSAR-ի հանրամատչելի գործիքի միջոցով, որը տրամադրում է զննարկչից կատարվող API հարցումների մուտքի տվյալները։ BOCSAR-ի համակարգը վերադարձրել էր հավելվածի կարգավորումները, գործառնական առաջադրանքներն ու գրանցամատյանները և կայքի մետատվյալները։ Առանձին անձանց հանցագործությունների վերաբերյալ գրառումներին հասանելիություն չի ստացվել։

  • Վիկտորիայի առողջապահության վարչություն․ OpenAI-ի ագենտները հայտնաբերել էին բաց հասանելիությամբ մուտքի բանալի և դրանով հարցումներ ուղարկել Վիկտորիայի առողջապահական տեղեկատվության գործակալության հաշվետվությունների համակարգին՝ ստանալով հաշվետվությունների կարգավորումները և հարցումների ամփոփ վիճակագրությունը։ Պարզ չէ, թե այս տեղեկությունը որքանով պետք է հասանելի լիներ․ դա կախված է VAHI-ի հասանելիության քաղաքականությունից։ Անհատական բժշկական գրառումներին կամ անձի նույնականացման հնարավորություն տվող հարցման պատասխաններին հասանելիություն չի ստացվել։

  • Ավստրալիայի առողջության և բարեկեցության ինստիտուտ․ OpenAI-ի ագենտները երրորդ կողմերի զննարկման և ներբեռնման ծառայությունների միջոցով ստացել էին ամփոփ վիճակագրություն, այդ թվում՝ AIHW-ի կայքից, և ուղղակի հարցումներ ուղարկել գծապատկերների տվյալները ստանալու համար։ Հասանելիության վերահսկման միջոցները շրջանցելու առանձին փորձերն անհաջող էին։ Ներբեռնված նյութը, ըստ երևույթին, հանրամատչելի էր։ Համակարգը չի կոտրվել։ Անհատական բժշկական գրառումներին հասանելիություն չի ստացվել։

Մենք սկսեցինք քննել այս գործողությունները օգոստոսի կեսերին՝ դրանց մասին իմանալուն պես։ Սեպտեմբերի 10-ին մենք ծանուցեցինք Services Australia-ին և Վիկտորիայի առողջապահության վարչությանը, իսկ սեպտեմբերի 18-ին՝ Նոր Հարավային Ուելսի հանցավորության վիճակագրության և հետազոտությունների բյուրոյին։ Ավստրալիայի առողջության և բարեկեցության ինստիտուտին առնչվող գործողությունները չէին բավարարում ծանուցման մեր չափանիշները, քանի որ մուտքի եղանակը, ըստ երևույթին, համապատասխանում էր հանրային հասանելիությանը։ Այնուամենայնիվ, սեպտեմբերի 24-ին մենք ծանուցեցինք ինստիտուտին՝ մեր բացահայտումները փոխանցելու և տեղեկատվական հանդիպում առաջարկելու համար։

Մեր նպատակն էր քննության ավարտից հետո տուժած գերատեսչություններին մանրամասն հաշվետվություն ներկայացնել։ Սակայն մենք պետք է նախնական բացահայտումներն ավելի շուտ փոխանցեինք և նոր փաստերի ի հայտ գալուն զուգահեռ տեղեկացնեինք Ավստրալիայի գերատեսչություններին։

Այդ ժամանակից ի վեր մենք սերտորեն համագործակցում ենք Ավստրալիայի պետական գերատեսչությունների հետ՝ փոխանցելով մինչ օրս մեր ստացած տեղեկությունները։ Եթե հայտնաբերենք այլ տուժած գերատեսչություններ, անհապաղ և անմիջականորեն նրանց կծանուցենք՝ տրամադրելով առկա տեղեկությունները, և նոր փաստերի ի հայտ գալուն պես կտեղեկացնենք դրանց մասին։

Ինչ է տեղի ունեցել Services Australia-ի Medicare-ի վիճակագրական հաշվետվությունների ծառայությունում

Հունիսին՝ ներքին ուսուցման և գնահատման ընթացքում, մենք օգտագործում էինք OpenAI-ի փորձարարական մոդել՝ նախատեսված միայն ներքին օգտագործման, ոչ թե հանրային թողարկման համար։ Այն չուներ մեր հանրամատչելի պրոդուկտներում կիրառվող անվտանգության միջոցների ամբողջական փաթեթը։ Այդ ուսուցման և գնահատման ընթացքում մոդելը մուտք էր գործել Services Australia-ի Medicare-ի վիճակագրական հաշվետվությունների ծառայություն։ Մինչ օրս մեր ուսումնասիրությամբ չի հայտնաբերվել որևէ մեկի բժշկական գրառումներին հասանելիություն ստանալու ապացույց։

Մեր մոդելների ներքին ուսուցման և գնահատման ընթացքում մենք նրանց հանձնարարում ենք առաջադրանքներ՝ ընտրված բազմաթիվ թեմաներ ընդգրկող հետազոտական հարցերի լայն հավաքածուից։ Դրանք արտացոլում են այնպիսի մանրամասն հարցեր, որոնք կարող են տալ օգտատերերը։ Այսպես մոդելը սովորում է գտնել, մեկնաբանել և վերլուծել հանրամատչելի տեղեկությունը՝ մարդկանց ավելի օգտակար լինելու համար։ Մեր մոդելները պետք է այս հարցերին պատասխանեն՝ օգտագործելով հրապարակված վիճակագրությունը։

Այս դեպքում մոդելին հանձնարարված խնդիրներից մեկն էր ուսումնասիրել, թե Վիկտորիայի համայնքներում պետությունը մեկ անձի հաշվով որքան է ծախսում մաշկային հիվանդությունների դեղերի վրա։ Մոդելը դժվարացել էր գտնել այդ տեղեկությունը և կատարել էր գործողություններ, որոնք մենք չէինք թույլատրել։ Services Australia-ի Medicare-ի վիճակագրական հաշվետվությունների ծառայությունում այդ տեղեկությունը փնտրելիս այն հայտնաբերել էր ծառայության՝ հանրությանը փակ հատված մուտք գործելու եղանակ։ Այնուհետև մոդելն այդ հասանելիությունն օգտագործել էր ծառայության համակարգի տեխնիկական տեղեկություններն ու սկզբնաղբյուր կոդն ուսումնասիրելու համար՝ դեռևս փորձելով գտնել ի սկզբանե փնտրվող տեղեկությունը։ Մենք չէինք նախատեսել նման գործողություններ, և ոչ ծառայություն այդ մուտքը, ոչ էլ հետագա գործողությունները չպետք է տեղի ունենային։

Ինչ ենք փոխում

Hugging Face-ի միջադեպից հետո մենք ուժեղացրել ենք մեր հետազոտությունների անվտանգության միջոցները՝ ավելացնելով ցանցային սահմանափակումները և ընդլայնելով մշտադիտարկումը։ Այս հետազոտական միջավայրերում ներդրել ենք համացանցին ուղիղ հասանելիությունն արգելափակող միջոցներ․ վեբ բովանդակությունը տրամադրվում է քեշավորված տարբերակով։ Մեր ներկայիս մշտադիտարկման համակարգերը, որպես անվտանգության լրացուցիչ շերտ, կհայտնաբերեին այս գործողությունները և մեր թիմին ազդանշան կուղարկեին՝ մարդու կողմից անհապաղ ստուգման համար։ Օրինակ՝ երբ մոդելը վերջերս անցկացված ուսուցման ընթացքում⁠(բացվում է նոր պատուհանում) ուղիղ հասանելիություն ստացավ համացանցին, մեր մշտադիտարկման համակարգը հայտնաբերեց այդ գործողությունը և ազդանշան ուղարկեց ստուգող մասնագետին, իսկ մենք դադարեցրինք ուսուցումը։ Մենք շարունակում ենք փորձարկել այս պաշտպանական միջոցները և վերացնել բացերը։ Hugging Face-ի միջադեպը մնում է մեր արձանագրած ամենալուրջ միջադեպը։

Մարդիկ ուզում են վստահ լինել, որ ԱԲ-ն մշակվում է անվտանգ կերպով, և դա սկսվում է հենց մեր նման ընկերությունների գործողություններից։ Վերջերս մենք հայտնել ենք⁠(բացվում է նոր պատուհանում), որ դադարեցրել ենք մեր ամենահզոր մոդելների՝ գործիքների կիրառմամբ ուսուցումն ու գնահատումը։ Դրանց ուսուցումը կվերսկսենք միայն այն ժամանակ, երբ վստահ լինենք, որ ներդրված են անվտանգության լրացուցիչ միջոցները, որոնց վրա այժմ աշխատում ենք։

ԱԲ համակարգերի ընդհանուր կարողությունների աճին զուգահեռ՝ կազմակերպություններին թույլ կողմերը գտնելու և վերացնելու հարցում օգնելու համար ավելի ու ավելի քիչ ժամանակ է մնում։ Սա պահանջում է համատեղ գործողություններ՝ ամբողջ աշխարհի կիբերպաշտպանության մասնագետների հետ համագործակցությամբ։

Մենք միացել ենք տեխնոլոգիաների, կիբերանվտանգության և կրիտիկական ենթակառուցվածքների ոլորտների կազմակերպությունների՝ կիբերպաշտպանության ուղղությամբ համատեղ գործողությունների կոչին։ Այդ կոչը սկսվում է մեր իսկ պարտականություններից՝ անվտանգության ավելի ուժեղ միջոցներ, ժամանակին տեղեկացում և գործնական աջակցություն տուժած կազմակերպություններին։ Այն նաև կոչ է անում ներդրումներ կատարել կենսական նշանակության ծառայությունները պաշտպանող թիմերում, որպեսզի նրանք կարողանան գտնել խոցելիությունները, ստուգել շտկումները և կիսվել արդյունավետ լուծումներով։

Ավստրալիայում մենք ռեսուրսներ և մասնագիտական գիտելիքներ ենք տրամադրում՝ տուժած գերատեսչություններին աջակցելու և կիբերպաշտպանության մասնագետներին օգնելու այս սկզբունքները գործնականում կիրառել։ Մասնավորապես՝

  • Նպատակային աջակցություն տուժած գերատեսչություններին։ Մենք կտրամադրենք անհրաժեշտ ռեսուրսները՝ տուժած գերատեսչություններին օգնելու հասկանալ կատարվածը և գնահատել ազդեցությունը։ Սա ներառում է համապատասխան տեխնիկական բացահայտումների տրամադրում և մեր արձագանքման թիմերի հետ համագործակցության կազմակերպում՝ տեղեկատվության փոխանակման համապատասխան պայմանավորվածությունների շրջանակում։

  • Ֆինանսավորում և աջակցություն՝ կիբերպաշտպանությունն ուժեղացնելու համար։ Մենք կաջակցենք Ավստրալիայի կառավարություններին և արդյունաբերությանը՝ տրամադրելով կրեդիտներ մեր 1 միլիարդ դոլարի «Daybreak՝ առաջնագծի պաշտպանների համար» հիմնադրամից, ինչպես նաև տեխնիկական օգնություն՝ կրիտիկական ենթակառուցվածքներում և այլ զգայուն միջավայրերում կիբերպաշտպանությունն ուժեղացնելու համար։ Հիմնվելով կառավարությունների և կրիտիկական ենթակառուցվածքների օպերատորների հետ մեր համագործակցության վրա՝ այս աշխատանքը կօգնի կազմակերպություններին ավելի լավ հասկանալ ու հայտնաբերել աճող կարողություններով ԱԲ ագենտներից բխող ռիսկերը և արձագանքել դրանց։

  • Ավստրալիայի աշխատանքային խումբ։ Մենք կստեղծենք աշխատանքային խումբ՝ ավստրալացի անկախ փորձագետների ներգրավմամբ, որը կմշակի քաղաքականության գործնական առաջարկություններ՝ աճող կարողություններով ԱԲ ագենտներից բխող ռիսկերը կառավարելու համար։ Հենվելով այս միջադեպերից քաղած դասերի վրա՝ խումբը կկենտրոնանա ծանուցման գործընթացների բարելավման, ԱԲ մշակողների և կառավարության միջև փոխգործակցության ամրապնդման և պետական համակարգերն ավելի լավ պաշտպանելու միջոցների բացահայտման վրա։ Աշխատանքային խմբի առաջարկությունները կօգնեն ձևավորել OpenAI-ի մոտեցումը և կաջակցեն Ավստրալիայի կառավարությունների՝ ԱԲ անվտանգության ու կիբերանվտանգության ուղղությամբ աշխատանքին։ Աշխատանքային խումբը, որն ակնկալվում է, որ աշխատանքը կավարտի մինչև տարեվերջ, նաև կառաջարկի գործնական քայլեր, որոնք ԱԲ ընկերությունները կարող են ձեռնարկել՝ նման միջադեպերի ռիսկը նվազեցնելու համար։

Ավստրալացիների վստահության վերականգնումը

Ավստրալիայի կառավարությունները, արդյունաբերության ոլորտներն ու քաղաքացիները միշտ եղել և մնում են OpenAI-ի անգնահատելի գործընկերները։ Մենք դա ինքնըստինքյան չենք համարում և մտադիր ենք շտկել իրավիճակը։

OpenAI-ի ռազմավարության գծով տնօրեն Ջեյսոն Քվոնը ԱՄՆ-ում գտնվող մեր գլխավոր գրասենյակից կժամանի Սիդնեյ՝ երեքշաբթի՝ հոկտեմբերի 6-ին, Արհեստական բանականության հարցերով համատեղ հատուկ հանձնաժողովի նիստին ներկայանալու համար։ Նա կպատասխանի հարցերի այն մասին, թե ինչ գիտենք, ինչպես ենք արձագանքել, ինչ քայլեր ենք ձեռնարկել և ինչպես ենք հետագայում բարելավելու մեր աշխատանքը։

Մենք կշարունակենք տուժած գերատեսչություններին և համապատասխան կառավարություններին տրամադրել ստուգված բացահայտումները։ Մենք կհրապարակենք նոր տեղեկություններ մեր ընթացիկ ուսումնասիրության և այս պարտավորությունների կատարման առաջընթացի վերաբերյալ։ Մենք գիտենք, որ վստահությունը վերականգնելու համար դեռ շատ աշխատանք ունենք անելու, և որ պարտավոր ենք ավստրալացիներին ցույց տալ, որ էական փոփոխություններ ենք անում ու կատարում մեր խոստումները։

Հեղինակ

OpenAI