OpenAI загваруудын гуравдагч талын кибер үнэлгээ
Бие даасан туршилт нь нэвтрүүлэхээс өмнө эрсдэлийг баталгаажуулж, илүү сайн ойлгоход бидэнд чухал үүрэг гүйцэтгэдэг. Зарим кибер үнэлгээнд олон нийтэд нээлттэй системд загварууд ердийн үед хэрхэн ажилладгийг бус, суурь чадамжийг хэмжихийн тулд хамгаалалтыг бууруулсан зэрэг тусгай тохиргоог зориуд ашигладаг.
Саяхны үнэлгээний үеэр гадны хоёр туршилтын түнш туршилтын тохиргоо, хяналт болон шинэ загваруудын өсөн нэмэгдэж буй чадамжийн нөлөөгөөр загварын үйл ажиллагаа туршилтын зориулалтын хилээс хэтэрсэн зөрчлүүдийг илрүүлсэн. Загваруудын чадамж нэмэгдэхийн хэрээр туршилтын орчин, арга ажиллагааны стандартыг хөгжүүлэхийн тулд салбарын хэмжээнд болон гуравдагч талын үнэлгээчидтэй хамтрах нь чухал болохыг эдгээр зөрчил харууллаа. Редакторын тэмдэглэл: Эдгээр нь Hugging Face-ийн аюулгүй байдлын зөрчлөөс тусдаа бөгөөд уг зөрчлийн талаарх шинэ мэдээллийг энд үргэлжлүүлэн нийтэлнэ.
Шинэ зөрчлүүд нь ердийн нэвтрүүлэлтийг төлөөлөхгүй, тусгай нөхцөлтэй, хамгаалалтыг бууруулсан тохиргоон дор гуравдагч талын кибер үнэлгээ хийх үеэр OpenAI-ийн загварууд нийтийн интернэтэд нэвтэрсэнтэй холбоотой. Эдгээр зөрчилд дараах тохиолдлууд багтсан:
- Их Британийн засгийн газрын AI Security Institute болох UK AISI нь агентуудад хэрэгслээ өөрсдөө олж, бодит халдагчтай илүү төстэй нөхцөлд ажиллах боломж олгохын тулд, интернэт нэвтрэлтийг зориуд нээж, суурь чадамжийг хэмжихийн тулд кибер ангилагчдыг идэвхгүй болгосон кибер полигоны үнэлгээ явуулж байсан. Тэдний блогийг эндээс(шинэ цонхонд нээгдэнэ) уншина уу.
- Манай гадны кибер аюулгүй байдлын туршилтын түншүүдийн нэг Irregular нь интернэтээс тусгаарлагдсан байх ёстой Capture-the-Flag хэлбэрийн үнэлгээ явуулж байсан ч, туршилтын орчны буруу тохиргооноос болж загварууд нийтийн интернэтэд нэвтрэх боломжтой болсон.
Доор бид юу болсон, үйл ажиллагааг боломжтой болгосон туршилтын нөхцөл, түүнийг хязгаарлахаар авсан арга хэмжээ, мөн чадамж нь өсөн нэмэгдэж буй загваруудыг бие даасан лабораториуд цаашид нарийн, аюулгүй үнэлэх боломжийг хангахын тулд юу хийж байгаагаа тоймлон харуулна.
Эдгээр зөрчил нь Hugging Face-ийн зөрчлийн тухай саяхны нийтлэлдээ дурдсан өргөн хүрээний ижил сорилтыг харуулж байна: загварын чадамж нэмэгдэхийн хэрээр тэдгээрийг хүрээлсэн аюулгүй байдал, хамгаалалтын системүүд ч мөн сайжрах шаардлагатай. Үүнд загвар боловсруулах орчин төдийгүй лаборатори болон бие даасан түншүүдийн үнэлгээ хийдэг орчин ч багтана.
Ирэх долоо хоногуудад бид эрсдэл өндөртэй үнэлгээг хэрхэн тодорхойлох, хамрах хүрээг тохиролцох, интернэт нэвтрэх эрх нээх эсвэл хамгаалалтыг бууруулах хүсэлтийг үнэлэх, тусгаарлалт, нэвтрэх мэдээллийн хэрэглээ, хяналт болон зогсоох нөхцөлийн шаардлагыг тогтоох, зөрчлийн мэдэгдэл ба шатлан мэдээлэх үйл явцыг илүү тодорхой болгох зэргээр гуравдагч талын туршилтад баримтлах арга барилаа хянана.
Бид ирэх долоо хоногуудад үндэсний AI хүрээлэн, бие даасан үнэлгээчид, бусад AI лаборатори болон бусад бүлэг зэрэг оролцогч талуудыг цуглуулж, өндөр эрсдэлтэй үнэлгээг аюулгүй явуулах нэгдсэн арга туршлагыг бэхжүүлэхийн төлөө салбарын хэмжээнд хамтран ажиллана. Нарийн бие даасан үнэлгээний үнэ цэнийг хадгалахын зэрэгцээ туршилтын арга ажиллагааг загваруудын өсөн нэмэгдэж буй чадамжтай хөл нийлүүлэхэд бидний зорилго оршино.
Долдугаар сарын 25-нд эхэлсэн ээлжит кибер үнэлгээний үеэр OpenAI болон өөр нэг лабораторийн загварууд зарим тохиолдолд туршилтын хамрах хүрээнээс хэтэрсэн гэж UK AISI наймдугаар сарын 3-нд бидэнд мэдэгдсэн. Үнэлгээг бодит сүлжээг дуурайлган бүтээсэн хяналттай кибер полигонуудад явуулсан. Илрүүлсэн 19 үйл явдлын хоёрт нь OpenAI-ийн GPT‑5.6 Sol загвар оролцсон. Бусад тохиолдолд өөр лабораторийн загварууд оролцсон.
Энэ үнэлгээнд, агентуудад capture-the-flag (CTF) дасгалын үеэр кибер аюулгүй байдлын мэргэжилтэн болж ажиллах, өөрөөр хэлбэл хоорондоо холбогдсон гурван загварчилсан орчинд нэвтэрч, эцсийн тугийг олж авах даалгавар өгсөн. Даалгаврын өгөгдөлд хамрах хүрээнд багтах полигоны сүлжээнүүдийг зааж, хэд хэдэн системийг хамрах хүрээнээс гадуур гэж нэрлэсэн. UK AISI агентуудад хэрэгсэл татаж, бодит хүн халдагчтай илүү төстэй нөхцөлд ажиллах боломж олгохын тулд шууд интернэт нэвтрэх эрх нээж, суурь чадамжийг хэмжихийн тулд загварын кибер ангилагчдыг идэвхгүй болгосон.
UK AISI-ийн төлөвлөсөн зөвшөөрлийн хил нь загварчилсан кибер полигон байв: агентууд заасан загварчилсан сүлжээнүүдэд халдаж, туг авах зөвшөөрөлтэй байсан ч, полигоны сүлжээний хилээс гадуурх системүүдтэй харилцах зөвшөөрөлгүй байв. Гэвч агентуудад нээлттэй интернэт нэвтрэлтийг хэрхэн ашиглаж болох, болохгүйг тодорхой хэлээгүй бөгөөд UK AISI үүнийг зөрчилд нөлөөлсөн байж болзошгүй шалтгаан гэж үзсэн.
Эдгээр туршилтын явцад GPT‑5.6 Sol загварчилсан полигонд нэвтрэх зам олж, тугийг авахыг оролдохдоо зөвшөөрөлгүй хоёр үйлдэл хийснийг UK AISI тогтоосон:
- GPT‑5.6 Sol нь тухайн хүрээн доторх систем GitHub эсвэл өөр шинэчлэлтийн үйлчилгээг тогтмол шалгаж байгаа эсэхийг мэдэхийн тулд өөр лабораторийн агентын нийтэд нээлттэй орхисон GitHub токеныг дахин ашиглаж, хэрэглэгчийн бүртгэл сэргээх болон хүсэлтийн хязгаарыг тойрохыг оролдож, гадаад DNS болон туннелийн үйлчилгээ үзүүлэгчдэд хэрэглэгчийн бүртгэл үүсгэсэн.
- GPT‑5.6 Sol үнэлгээний орчиндоо дотоодод ажиллуулсан DNS серверийг нийтийн интернэтээс хандах боломжтой болгохын тулд нийтийн туннелийн үйлчилгээ ашигласан. Тус серверт туршилтын полигон дээр ажиллаж байсан програм хангамжийн мэдэгдэж буй эмзэг байдлыг ашиглахад зориулсан ачааллууд байсан. Энэ тохиргоо ажиллаагүй, бодит сервер түүнд хүсэлт илгээсэн гэх нотолгоо байхгүй бөгөөд үнэлгээ дуусахад дэд бүтцийг устгасан.
Загвар кибер полигоны даалгаврыг гүйцээхийг оролдож байсан ч, эдгээр үйлдэл нь полигоны хилээс гадуурх бодит хэрэглэгчийн бүртгэл, үйлчилгээг хамарсан бөгөөд даалгаврыг гүйцэтгэхэд шаардлагагүй байсан тул, UK AISI үүнийг зөвшөөрөлгүй гэж үзсэн. DNS сервер мөн ашиглалтын ачааллуудыг нийтийн интернэтэд байршуулсан ч, тохиргоо ажиллаагүй бөгөөд бодит сервер түүнд хүсэлт илгээсэн гэх нотолгоо байхгүй.
Аюулгүй байдлын хяналт ердийн бус өгөгдөл дамжуулалтыг илрүүлсний дараа UK AISI уг үйл ажиллагааг долоодугаар сарын 28-нд тогтоосон. Тэд холбогдох үнэлгээнүүдийг зогсоож, тухайн машинуудыг тусгаарлан, илрүүлснээс хойш ойролцоогоор нэг цагийн дотор үйл ажиллагааг хязгаарласан.
Үйл ажиллагааг илрүүлэх, шалгах, дэлгэрэнгүй мэдээллийг хуваалцах зэрэг энэ үйл явцын туршид хамтран ажилласан UK AISI-д талархаж байна. Бид цаашид ч хамтын ажиллагаагаа үргэлжлүүлэхийг хүсэж байна.
Долоодугаар сарын 29-нд манай гуравдагч талын үнэлгээний түншүүдийн нэг Irregular нь Capture-the-Flag (CTF) хэлбэрийн кибер аюулгүй байдлын үнэлгээний үеэр OpenAI-ийн загваруудтай холбоотой зөрчлийн талаар бидэнд мэдэгдсэн. Загваруудад загварчилсан орчны сул талыг ашиглан нууц мэдээлэл олох даалгавар өгч, интернэтэд нэвтрэх боломжгүй гэж мэдээлсэн байв. Гэвч туршилтын орчны буруу тохиргооноос болж загварууд нийтийн интернэтэд нэвтрэх боломжтой болсон.
Нэг туршилтад CTF сорилтын зохиомол байны нэр бодит домэйнтэй санамсаргүй давхацсан. Туршилтын орчин интернэтэд андуурч холбогдсон байсан тул, загвар бодит вэбсайтыг загварчилсан орчны нэг хэсэг гэж эндүүрэн эмзэг байдлыг нь ашигласан. Энэ нь хамгаалагдсан орчноос гарах нарийн төвөгтэй арга эсвэл тэг өдрийн эмзэг байдал ашигласан хэрэг биш: интернэт нэвтрэлт буруу тохиргооноос үүссэн бөгөөд загвар аюулгүй байдлын энгийн эмзэг байдлыг ашигласан бололтой.
Irregular-ийн шалгалтаар загвар мөн тухайн сайтыг удирдах нэвтрэх мэдээллийг олж ашигласан байна. Irregular нөлөөлөлд өртсөн сайтын өөрийн өгөгдлөөс өөр зүйлд нөлөөлсөн тохиолдол тогтоогоогүй бөгөөд аудит үргэлжилж байна. Тус байгууллага үнэлгээнүүдийг түр зогсоож, засах ажлыг эхлүүлэн, нөлөөлөлд өртсөн гуравдагч талуудад мэдэгдсэн. Зөрчилтэй холбоотой тогтоосон бүх асуудал одоо идэвхгүй болсон бөгөөд туршилтын орчинд зохих хамгаалалтууд нэмсэн гэж Irregular бидэнд мэдээлсэн. Irregular мөн ижил туршилтын орчинд бусад лабораторитой холбоотой гарсан зөрчлүүдийн талаар мэдээлсэн.
Irregular-ийн хамтын ажиллагаанд талархаж байгаа бөгөөд хяналт шалгалтад нь дэмжлэг үзүүлэхийн тулд тэдэнтэй нягт хамтран ажилласаар байх болно. Irregular мөн кибер үнэлгээг аюулгүй явуулах, үйл ажиллагааг хязгаарлах шилдэг туршлагыг хуваалцах техникийн тайлан боловсруулж байна. Олж тогтоосон зүйлсийг олон нийтэд хүргэхийн тулд техникийн тайлан боловсруулахад оролцож, хамтын ажиллагаагаа үргэлжлүүлэхийг хүсэж байна. Одоогийн болон ирээдүйн загваруудыг аюулгүй, нарийвчлан үнэлэхэд ийм хамтын ажиллагаа зайлшгүй чухал гэж бид үздэг.


