Haziran ayında, kurum içi eğitim ve değerlendirme çalışmaları sırasında modellerimiz Avustralya devlet kurumlarının web sitelerine yetkileri dışında erişti. Olayın ardından yürüttüğümüz süreci de daha iyi yönetmeliydik. Özür diliyor ve gelecekte daha iyisini yapmak için çalışıyoruz.
Bu yazıda neler bildiğimizi, neleri değiştirdiğimizi ve Avustralya halkının güvenini yeniden kazanmak için neler yapacağımızı açıklıyoruz. Bu yeni tür siber olay, küresel ölçekte ortaya çıkan yeni bir soruna işaret ediyor. Bu durumun sorumluluğunu üstlenmek için atmayı planladığımız adımlardan biri, Avustralya ile kararlı bir iş birliği yürütmek. Amacımız, yapay zekâ geliştiricilerinin ve hükûmetlerin kötü amaçlı ya da kasıtsız yapay zekâ siber davranışlarını tespit etmesi, bildirmesi ve bunlara müdahale etmesi için uygulanabilir yaklaşımlar geliştirilmesine yardımcı olmak.
Temmuz ayındaki Hugging Face olayının ardından, etkilenen diğer kuruluşları belirlemek için önceki eğitim ve değerlendirme faaliyetlerini incelemeye başladık. Ağustos ayının ortasında bu inceleme, aşağıda belirtilen Avustralya devlet kurumlarının web sitelerini etkileyen faaliyetleri tespit etti.
Eldeki kanıtlara dayanarak bildiklerimiz şöyle:
Services Australia: Bir OpenAI modeli, hizmetin kamuya açık olmayan bölümlerine erişmenin bir yolunu keşfetti. Komutlar çalıştırdı; kurum içi dosyaları, kimlik doğrulama bilgilerini ve toplu istatistikleri aldı; dosyalar yazdı. Ancak bireysel hasta veya hizmet alan kişi kayıtlarına erişilmedi. Bu olayı aşağıda daha ayrıntılı olarak ele alıyoruz.
Yeni Güney Galler Suç İstatistikleri ve Araştırma Bürosu (BOCSAR): Bir OpenAI modeli, kamuya açık suç istatistiklerini araştırmak için BOCSAR’ın herkese açık Suç Haritalama Aracı’na erişti (modellerin neden çeşitli bilgi araştırma görevleri yürüttüğünü aşağıda daha ayrıntılı açıklıyoruz). Model, tarayıcı üzerinden yapılan API istekleri için kimlik doğrulama bilgileri sağlayan herkese açık BOCSAR aracı üzerinden API ve web sitesi meta verisi istekleri gönderdi. BOCSAR sistemi; uygulama yapılandırmasını, operasyonel işleri ve günlükleri, ayrıca web sitesi meta verilerini döndürdü. Kişilerin suç kayıtlarına erişilmedi.
Victoria Sağlık Bakanlığı: OpenAI ajanları, Victoria Sağlık Bilgileri Kurumu’nun raporlama sistemini sorgulamak ve raporlama yapılandırması ile toplu anket istatistiklerini almak için kullanılabilecek, açıkta bırakılmış bir erişim anahtarı keşfetti. Bu bilgilerin ne ölçüde erişilebilir olması gerektiği belirsiz ve VAHI’nin erişim politikalarına bağlı. Bireysel tıbbi kayıtlara veya kişilerin kimliğini belirlemeye imkân veren anket yanıtlarına erişilmedi.
Avustralya Sağlık ve Refah Enstitüsü: OpenAI ajanları, üçüncü taraf tarama ve indirme hizmetlerini kullanarak AIHW’nin web sitesi dâhil çeşitli kaynaklardan toplu istatistikler aldı ve grafik verilerini doğrudan sorguladı. Erişim kontrollerini aşmaya yönelik ayrı girişimler başarısız oldu. İndirilen içeriklerin kamuya açık olduğu anlaşılıyor. Sistem güvenliği ihlal edilmedi. Bireysel tıbbi kayıtlara erişilmedi.
Ağustos ayının ortasında bu faaliyetlerden haberdar olur olmaz inceleme başlattık. Services Australia ve Victoria Sağlık Bakanlığı’na 10 Eylül’de, Yeni Güney Galler Suç İstatistikleri ve Araştırma Bürosu’na ise 18 Eylül’de bildirimde bulunduk. Avustralya Sağlık ve Refah Enstitüsü ile ilgili faaliyet, erişim biçimi kamuya açık erişimle uyumlu göründüğünden bildirim eşiklerimizi karşılamıyordu. Yine de bulgularımızı paylaşmak ve bir bilgilendirme toplantısı teklif etmek için 24 Eylül’de kuruma bildirimde bulunduk.
Amacımız, incelememiz tamamlandığında etkilenen kurumlara ayrıntılı bir açıklama sunmaktı. Ancak ilk bulguları daha erken paylaşmalı ve yeni bilgiler ortaya çıktıkça Avustralya’daki kurumları bilgilendirmeliydik.
O zamandan bu yana, bugüne kadar öğrendiklerimizi paylaşmak için Avustralya devlet kurumlarıyla yakın iş birliği içinde çalışıyoruz. Etkilenen başka kurumlar tespit edersek elimizdeki bilgilerle bu kurumlara doğrudan ve gecikmeden bildirimde bulunacak, yeni bilgiler ortaya çıktıkça güncellemeler sağlayacağız.
Haziran ayındaki kurum içi eğitim ve değerlendirme çalışmaları sırasında, yalnızca kurum içi kullanıma yönelik, kamuya sunulması planlanmayan deneysel bir OpenAI modeli çalıştırıyorduk. Bu modelde, kamuya açık ürünlerimizde kullandığımız güvenlik önlemlerinin tamamı uygulanmıyordu. Model, bu eğitim ve değerlendirme sürecinde Services Australia’nın Medicare İstatistik Raporlama Hizmeti’ne erişti. Bugüne kadar yürüttüğümüz incelemede, herhangi bir kişinin tıbbi kayıtlarına erişildiğine dair kanıt bulunmadı.
Modellerimizle kurum içi eğitim ve değerlendirme çalışmaları yürütürken onlara, birçok konuyu kapsayan geniş bir araştırma sorusu havuzundan görevler veriyoruz. Bu görevler, kullanıcıların sorabileceği ayrıntılı soruları yansıtıyor. Bu süreç, modelin insanlara daha fazla fayda sağlayabilmesi için kamuya açık bilgileri bulmayı, yorumlamayı ve analiz etmeyi öğrenmesini sağlıyor. Modellerimizin bu soruları kamuya açık olarak yayımlanan istatistikleri kullanarak yanıtlaması gerekiyor.
Bu vakada modele verilen görevlerden biri, Victoria eyaletindeki topluluklarda cilt hastalıklarının tedavisinde kullanılan ilaçlar için yapılan kişi başına kamu harcamasını araştırmaktı. Model bu bilgilere ulaşmakta zorlandı ve kendisine yetki vermediğimiz işlemler gerçekleştirdi. Services Australia’nın Medicare İstatistik Raporlama Hizmeti’nde bu bilgileri ararken hizmetin kamuya açık olmayan bölümlerine erişmenin bir yolunu keşfetti. Ardından bu erişimi kullanarak hizmetle ilgili teknik sistem bilgilerini ve kaynak kodunu inceledi. Tüm bunları hâlâ başlangıçta aradığı bilgileri bulmak amacıyla yapıyordu. Bu faaliyetlerin gerçekleşmesini amaçlamamıştık. Hizmete bu şekilde erişilmemeli ve ardından gelen işlemler yapılmamalıydı.
Hugging Face olayının ardından ek ağ kısıtlamaları getirip izleme kapsamını genişleterek araştırmalarımızdaki güvenlik önlemlerini güçlendirdik. Bu araştırma ortamlarında internete doğrudan erişimi engelleyen kontroller uyguladık ve web erişimini önbelleğe alınmış içerik üzerinden sağlamaya başladık. Ek bir güvenlik katmanı sağlayan mevcut izleme sistemlerimiz, bu faaliyeti tespit eder ve bir insan tarafından acilen incelenmesi için ekibimize uyarı gönderirdi. Örneğin, yakın tarihli bir eğitim çalışması(yeni bir pencerede açılır) sırasında bir model internete doğrudan erişim sağladığında izleme sistemimiz bu faaliyeti tespit ederek bir inceleme görevlisine uyarı gönderdi ve çalışmayı durdurduk. Bu korumaları test etmeye ve eksikleri gidermeye devam ediyoruz. Hugging Face olayı, bugüne kadar gözlemlediğimiz en ciddi olay olmaya devam ediyor.
İnsanlar yapay zekânın güvenli bir şekilde geliştirildiğini bilmek istiyor. Bu da bizim gibi şirketlerin kendi uygulamalarıyla başlıyor. Kısa süre önce, en yetenekli modellerimizin araç kullanımını içeren eğitim ve değerlendirme çalışmalarına ara verdiğimizi ve bu modellerin eğitimine ancak şu anda üzerinde çalıştığımız ek güvenlik önlemlerinin devrede olduğundan emin olduğumuzda devam edeceğimizi paylaştık(yeni bir pencerede açılır).
Yapay zekâ sistemlerinin yetenekleri genel olarak arttıkça kuruluşların zayıf noktalarını bulup gidermelerine yardımcı olmak için kalan sürenin de daraldığını görüyoruz. Bunun için dünya genelindeki siber savunma ekipleriyle birlikte hareket etmek gerekiyor.
Teknoloji, siber güvenlik ve kritik altyapı alanlarındaki kuruluşlarla birlikte siber savunma için ortak eylem çağrısına katıldık. Bu çağrı, daha güçlü güvenlik önlemleri, zamanında bildirim ve etkilenen kuruluşlara somut destek sağlamak gibi kendi sorumluluklarımızla başlıyor. Ayrıca, temel hizmetleri koruyan ekiplerin güvenlik açıklarını bulabilmesi, düzeltmeleri doğrulayabilmesi ve işe yarayan uygulamaları paylaşabilmesi için bu ekiplere yatırım yapılmasını istiyor.
Avustralya’da etkilenen kurumları desteklemek ve siber savunma ekiplerinin bu ilkeleri uygulamaya koymasına yardımcı olmak için kaynak ve uzmanlık sağlama taahhüdünde bulunuyoruz. Bu kapsamda:
Etkilenen kurumlara özel destek. Etkilenen kurumların yaşananları anlamasına ve etkilerini değerlendirmesine yardımcı olmak için gereken kaynakları sağlayacağız. Buna, ilgili teknik bulguları paylaşmak ve uygun bilgi paylaşımı düzenlemeleri çerçevesinde müdahale ekiplerimizle iletişim kurmalarını sağlamak da dâhil.
Siber savunmayı güçlendirmek için finansman ve destek. Kritik altyapı ve diğer hassas ortamlarda siber savunmayı güçlendirmek üzere, 1 milyar dolarlık Daybreak for Frontline Defenders (Ön Cephedeki Savunmacılar için Daybreak) fonumuzdan krediler ve teknik yardım sağlayarak Avustralya’daki hükûmetleri ve özel sektörü destekleyeceğiz. Hükûmetler ve kritik altyapı işletmecileriyle yürüttüğümüz iş birliğini temel alan bu çalışma, kuruluşların giderek daha yetenekli hâle gelen yapay zekâ ajanlarından kaynaklanan riskleri daha iyi anlamasına, tespit etmesine ve bunlara müdahale etmesine yardımcı olacak.
Avustralya’da bir çalışma grubu. Giderek daha yetenekli hâle gelen yapay zekâ ajanlarından kaynaklanan riskleri yönetmeye yönelik uygulanabilir politika önerileri geliştirmek için Avustralyalı bağımsız uzmanların katkılarıyla bir çalışma grubu kuracağız. Grup, bu olaylardan çıkarılan derslerden yararlanarak bildirim süreçlerini iyileştirmeye, yapay zekâ geliştiricileri ile kamu kurumları arasındaki koordinasyonu güçlendirmeye ve kamu sistemlerini daha iyi koruyacak önlemleri belirlemeye odaklanacak. Çalışma grubunun önerileri, OpenAI’ın yaklaşımına yön verecek ve Avustralya’daki hükûmetlerin yapay zekâ güvenliği ile siber güvenlik çalışmalarını destekleyecek. Çalışmalarını yıl sonuna kadar tamamlaması beklenen grup, yapay zekâ şirketlerinin benzer olayların yaşanma riskini azaltmak için atabileceği somut adımlar da önerecek.
Avustralya’daki hükûmetler, sektörler ve vatandaşlar, OpenAI için her zaman paha biçilmez iş ortakları oldu ve olmaya devam ediyor. Bu ilişkinin değerini biliyoruz ve yaşananları telafi etmeye kararlıyız.
OpenAI Strateji Direktörü Jason Kwon, 6 Ekim Salı günü Sidney’de Yapay Zekâ Ortak Özel Komitesi’nin huzuruna çıkmak üzere OpenAI’ın ABD’deki genel merkezinden gelecek. Neler bildiğimiz, nasıl müdahale ettiğimiz, hangi adımları attığımız ve bundan sonra nasıl daha iyisini yapacağımız hakkındaki soruları yanıtlayacak.
Doğrulanmış bulguları etkilenen kurumlarla ve ilgili hükûmetlerle paylaşmaya devam edeceğiz. Devam eden incelememiz ve bu taahhütleri yerine getirme yolunda kaydettiğimiz ilerleme hakkında güncellemeler yayımlayacağız. Güveni yeniden kazanmak için önümüzde çok iş olduğunu biliyoruz. Kayda değer değişiklikler yaptığımızı ve sözlerimizi tuttuğumuzu Avustralya halkına göstermekle yükümlü olduğumuzun da farkındayız.


