Загварын мэдлэг нэрэх зохион байгуулалттай ажиллагааг таслан зогсоох
Бид загваруудынхаа хамгаалагдсан сэтгэн бодох үйл явцын бүртгэлийг гаргаж авах зорилготой, зохион байгуулалттай ажиллагааг саяхан илрүүлж, таслан зогсоолоо. Энэ ажиллагааны хамгийн эхний шинж тэмдэг долоодугаар сарын эхний долоо хоногт ажиглагдсан. Энэ нь нэг загварын гаралт эсвэл сэтгэн бодох үйл явцын бүртгэлийг өөр загварыг сургах, хуулбарлах, сайжруулахад системтэйгээр, зөвшөөрөлгүй ашигладаг хортой зорилготой мэдлэг нэрэх ажиллагааны шинжтэй байна. Хамгаалагдсан сэтгэн бодох үйл явцын бүртгэл гэдэг нь загвар даалгаврыг хэрхэн шийдвэрлэж буйг харуулсан дотоод бүртгэл юм. Үүнийг гаргаж авснаар эцсийн хариултад оруулаагүй мэдээлэл ил болж, бусад этгээд загварын чадамжийг хуулбарлахад ашиглаж болно.
Уг ажиллагааг явуулсан этгээдүүд манай шифрлэлтийг эвдээгүй, өгөгдлийн санд халдаагүй, хадгалсан хэрэглэгчийн харилцан ярианд шууд хандах эрх олж аваагүй. Харин тэд загвартай харилцах үйл явцыг зориуд гажуудуулж, хамгаалагдсан сэтгэн бодох үйл явцын бүртгэлийг хүсэлт гаргагчид харагдах хэлбэрээр дахин гаргуулсан. Үүнийг зохион байгуулалттайгаар, өргөн хүрээнд хийсэн нь манай үйлчилгээний нөхцөлийг зөрчсөн. Ийм аргаар ашиглаж болох эмзэг байдал нь зөвхөн OpenAI-ийн загваруудад хамаарахгүй. Хортой зорилготой мэдлэг нэрэх ажиллагааны эсрэг хамтын хамгаалалтыг бэхжүүлэхийн тулд бид энэ тухай мэдээллийг Хил хязгаарын загварын форумаар дамжуулан салбарын түншүүдтэйгээ хуваалцсан.
Энэ мэдээллийг нийтлэхээсээ өмнө бид цар хүрээ, болзошгүй нөлөөг нь судалж, эрсдэлийг бууруулах арга хэмжээг өөрсдөө хэрэгжүүлсэн. Мөн энэ төрлийн халдлагаас хамгаалах арга хэмжээ бүрдсэн эсэхийг нягтлахын тулд судлаачид болон салбарын түншүүдтэйгээ мэдээлэл хуваалцаж, санал авсан. Эрсдэлийг бууруулах нэмэлт арга хэмжээ болон шалгах ажиллагаа үргэлжилж байна. Одоо олж мэдсэн зүйлээ хуваалцах нь нийт экосистемийн хамгаалалтыг бэхжүүлэхэд тусална гэж бид үзэж байна.
Эдгээр этгээд хамгаалагдсан сэтгэн бодох үйл явцын бүртгэлийг шинэ аргаар гаргаж авахыг оролдож байв. Тухайлбал, нэг харилцан ярианаас шифрлэсэн бүртгэлийг хуулж аваад, өөр харилцан ярианд загвараас түүний шифрийг тайлж, далд агуулгыг нь буулгаж бичихийг хүссэн.
Мөн аюулгүй байдлын хараат бус судлаачид(шинэ цонхонд нээгдэнэ) загвар хоорондын ажиллагаа болон харилцан ярианы шахалттай холбоотой эмзэг байдлуудыг хариуцлагатайгаар мэдээлэх журмаар бидэнд мэдэгдсэн. Бид тэдний олж илрүүлсэн зүйлсийг шалгаж, тодорхойлсон халдлагын аргууд нь бодитоор хэрэгжих боломжтойг баталгаажуулсан. Тэдний ажил энэ төрлийн халдлагыг илүү өргөн хүрээнд ойлгож, эрсдэлийг бууруулах арга хэмжээг түргэсгэхэд тусалсан.
Уг ажиллагаа долоодугаар сарын 1-нд эхэлж, эхэндээ цөөн хүсэлттэй байсан. Харин долоодугаар сарын 24, 25-нд огцом нэмэгдэж, холбогдох мэдээлэл гаргаж авах хэв маягийг ашигласан 4,000 гаруй хэрэглэгчийн 16,000 хүсэлт1 ажиглагдсан. Цааш шалгахад 15,000 гаруй хэрэглэгчийн бүлэгт өгөгдлийн ижил төстэй хэв маяг бүхий холбоотой үйл ажиллагаа илэрсэн бөгөөд бид үүнийг долоодугаар сарын 28 гэхэд бүрэн таслан зогсоосон.
Уг ажиллагааны арга барил цаг хугацааны явцад өөрчлөгдөж байсан. Энэ нь хортой зорилготой мэдлэг нэрэх ажиллагаа бол олон давхар, дасан зохицох хамгаалалт шаарддаг, аюулгүй байдлын өргөн хүрээний сорилт гэдгийг дахин харууллаа.
Тухайн хугацаанд бидний ажигласан бүх этгээд нэг эх үүсвэрээс удирдуулж байсан эсэх нь тодорхойгүй. Гэхдээ уг ажиллагааны гол хэсгийг Kimi-г хөгжүүлэгч Moonshot AI-тай холбоотой хүмүүс явуулсан гэж бид үзэж байна.
Хортой зорилготой мэдлэг нэрэх ажиллагаа нь аюулгүй байдал болон үндэсний аюулгүй байдалд эрсдэл учруулдаг. Гаргаж авсан сэтгэн бодох үйл явцын бүртгэлийг ашиглан өөр загвар сургахдаа эх загварын хэрэглэгчид харагдах гаралтад хэрэглэдэг хамгаалалтыг нь хадгалахгүй байж болно. Мөн мэдлэг нэрэх аргыг өргөн хүрээнд ашигласнаар аюулгүй байдалд ижил хэмжээний хөрөнгө оруулалт хийхгүйгээр дэвшилтэт чадамжийг илүү хурдан шилжүүлэн авах боломжтой. Загварууд эерэг болон хортой зорилгоор давхар ашиглаж болох салбаруудад чадамжтай болох тусам эдгээр эрсдэл улам нэмэгдэнэ.
Энэ эрсдэл зөвхөн OpenAI-д хамаарахгүй. Дээр дурдсанчлан, ижил төстэй аргууд бусад дэвшилтэт хиймэл оюуны системд ч нөлөөлж болзошгүй. Тиймээс энэ нь салбар даяар хамтран ажиллах шаардлагатай, аюулгүй байдлын нийтлэг сорилт юм.
Бид бүртгэлүүдэд арга хэмжээ авах, техникийн хяналт хэрэгжүүлэх, түншүүдтэйгээ хамтран ажиллах замаар саяхны мэдлэг нэрэх ажиллагааны эрсдэлийг бууруулсан. Залилангийн бүртгэлүүдийг хааж эсвэл хязгаарлан, бүртгүүлэх үйл явц болон дэд бүтцийн хяналтыг чангатгаж, холбогдох сүлжээнүүдийн хяналтыг өргөжүүлсэн.
Мөн хэрэглэгчид, ажлын талбарууд, байгууллагууд болон загварын бүлгүүдийн хооронд сэтгэн бодох үйл явцын далд бүртгэлийг хамгаалах хамгаалалтыг бэхжүүлсэн. Өөр хэрэглэгчийн сэтгэн бодох үйл явцын шифрлэсэн бүртгэлийг аль хэдийн олж авсан этгээд түүнийг дахин оруулж, агуулгыг нь сэргээн авах боломжтой байсан сувгийг хаасан. Мөн сэтгэн бодох үйл явцын бүртгэлийг ил болгож болзошгүй урсгал гаралтыг илрүүлж, саатуулах шалгалтуудыг нэмсэн. Холбогдох ажиллагаа гуравдагч талын үйлчилгээгээр дамжих болсон үед бид тухайн үйлчилгээ үзүүлэгчидтэй хамтран оролцсон бүртгэлүүдийг илрүүлж, үйл ажиллагааг нь таслан зогсоосон.
Эцэст нь, бусад хил хязгаарын загвар хөгжүүлэгчид болон төрийн салбарын түншүүд ижил төстэй ажиллагааг хайж илрүүлэн, хамгаалалтаа бэхжүүлэх боломжтой байлгахын тулд бид холбогдох үр дүнг Хил хязгаарын загварын форум болон төрийн мэдээлэл солилцох зохих сувгаар хуваалцсан. Сэтгэн бодох үйл явцын бүртгэлийг зөөвөрлөх эсвэл дахин оруулж ашиглах боломж олгодог системүүд мөн ижил төстэй эрсдэлтэй тулгарч болзошгүй.
Хил хязгаарын загварууд сайжирч, тэдгээрийн чадамжийг бага зардлаар дуурайлган бүтээх арга хайх этгээдүүд нэмэгдэхийн хэрээр хортой зорилготой мэдлэг нэрэх оролдлогууд улам нарийсна гэж бид тооцоолж байна. Ийм ажиллагаанаас хамгаалахын тулд олон давхар хяналт хэрэгжүүлж, байнга дасан зохицох шаардлагатай.
Энэ ажил хараахан дуусаагүй. Түншийн дэд бүтцэд байршуулсан системүүдэд ч бидний өөрсдөө үзүүлдэг үйлчилгээтэй ижил хамгаалалт хэрэгтэй. Харин хэрэгслийн гаралтаар дамжих халдлагаас хамгаалахад зөвхөн нүдэнд харагдах энгийн бичвэрээс гадна бусад агуулгыг ч шалгах шаардлагатай. Бид хэрэгслийн хамгаалалт, ангилагчийн хамрах хүрээ, загварын татгалзах механизмыг үргэлжлүүлэн сайжруулж, холбогдох хяналтыг үүлэн үйлчилгээний түншүүддээ нэвтрүүлж байна.
Бидний хариу арга хэмжээ цаашид гурван чиглэлд төвлөрнө: мэдээлэл гаргаж авахаас сэргийлэх техникийн хамгаалалтыг бэхжүүлэх, зохион байгуулалттай ажиллагааг илрүүлэх, таслан зогсоох арга хэмжээг сайжруулах, салбар болон төрийн байгууллагуудын хооронд аюул заналын мэдээлэл солилцох хамтын ажиллагааг гүнзгийрүүлэх.

