Memperkenalkan program Ganjaran Pepijat Keselamatan OpenAI
Ujian untuk isu keselamatan dan penyalahgunaan merentasi OpenAI
Hari ini, OpenAI melancarkan program Ganjaran Pepijat Keselamatan(dibuka dalam tetingkap baru) awam yang tertumpu pada mengenal pasti penyalahgunaan AI dan risiko keselamatan merentas produk kami. Seiring dengan perkembangan pesat teknologi AI, potensi cara teknologi ini boleh disalahgunakan juga turut meningkat. Matlamat kami adalah untuk memastikan sistem kami kekal selamat dan terjamin daripada salah guna atau penyalahgunaan yang boleh membawa kepada kemudaratan nyata.
Program baharu ini akan melengkapi Ganjaran Pepijat Keselamatan(dibuka dalam tetingkap baru) OpenAI dengan menerima isu yang menimbulkan risiko penyalahgunaan dan keselamatan yang bermakna, walaupun ia tidak memenuhi kriteria untuk kerentanan keselamatan. Melalui program ini, kami berharap dapat terus bekerjasama dengan penyelidik keselamatan dan keterjaminan untuk membantu kami mengenal pasti dan menangani isu yang berada di luar kategori kerentanan keterjaminan konvensional tetapi masih menimbulkan risiko yang nyata. Serahan akan dinilai oleh pasukan Ganjaran Pepijat Keselamatan dan Keterjaminan OpenAI, dan mungkin dihalakan semula antara kedua-dua program bergantung pada skop dan pemilikan.
Program baharu Ganjaran Pepijat Keselamatan(dibuka dalam tetingkap baru) memfokuskan pada senario keselamatan khusus AI yang disenaraikan di bawah:
Risiko Agentik termasuk MCP
- Suntikan prom pihak ketiga dan penyusupan keluar data: apabila teks penyerang dapat merampas kawalan ejen mangsa secara andal (termasuk Browser, ChatGPT Agent, dan produk agentik yang serupa) untuk memperdayakannya supaya melakukan tindakan yang memudaratkan atau membocorkan maklumat sensitif pengguna. Tingkah laku ini mesti boleh dihasilkan semula sekurang-kurangnya 50% daripada masa.
- Produk OpenAI agentik melakukan tindakan yang tidak dibenarkan di laman web OpenAI pada skala.
- Produk OpenAI agentik melakukan beberapa tindakan yang berpotensi berbahaya yang tidak disenaraikan di atas. Laporan yang sah di sini mesti menunjukkan kemudaratan yang munasabah dan material.
- Sebarang ujian untuk risiko MCP mesti mematuhi terma perkhidmatan pihak ketiga.
Maklumat Proprietari OpenAI
- Penjanaan model yang mengembalikan maklumat proprietari yang berkaitan dengan penaakulan.
- Kelemahan yang mendedahkan maklumat proprietari OpenAI yang lain.
Integriti Akaun dan Platform
- Kelemahan dalam integriti akaun dan isyarat integriti platform, seperti memintas kawalan anti-automasi, memanipulasi isyarat kepercayaan akaun, mengelakkan sekatan/penggantungan/pelarangan akaun, dan isu serupa.
- Isu yang membolehkan pengguna mengakses ciri, data, atau fungsi melebihi kebenaran yang sah perlu dilaporkan kepada Ganjaran Pepijat Keselamatan(dibuka dalam tetingkap baru).
Walaupun pecah sekatan berada di luar skop program ini, kami kerap menjalankan kempen ganjaran pepijat persendirian yang tertumpu pada jenis kemudaratan tertentu, seperti isu kandungan Biorisiko dalam ChatGPT Agent dan GPT‑5. Kami menjemput penyelidik yang berminat untuk memohon program ini apabila ia dibuka.
Di luar kategori yang disenaraikan di atas, jika penyelidik mengenal pasti kecacatan yang memudahkan laluan langsung kepada kemudaratan pengguna serta langkah pemulihan yang jelas dan boleh diambil tindakan, perkara ini boleh dipertimbangkan sebagai termasuk dalam skop untuk ganjaran berdasarkan kes demi kes. Pemintasan umum terhadap dasar kandungan tanpa impak yang boleh dibuktikan terhadap keselamatan atau penyalahgunaan adalah di luar skop program ini. Sebagai contoh, “pecah sekatan” yang menyebabkan model menggunakan bahasa kasar atau memulangkan maklumat yang mudah ditemui melalui enjin carian adalah di luar skop.
Penyelidik yang berminat untuk menyertai boleh memohon melalui program Ganjaran Pepijat Keselamatan(dibuka dalam tetingkap baru) kami. Kami berharap dapat bekerjasama dengan penyelidik, penggodam beretika, dan komuniti keselamatan dan keterjaminan dalam usaha mewujudkan ekosistem AI yang selamat.


