Langkau ke kandungan utama
OpenAI

10 Disember 2025

Perlindungan

Memperkukuh ketahanan siber seiring dengan kemajuan keupayaan AI

Apabila model kami semakin berkeupayaan dalam keselamatan siber, kami melabur untuk memperkukuhnya, menambah lapisan perlindungan, dan bekerjasama dengan pakar keselamatan global.

Memuat…

Keupayaan siber dalam model AI berkembang dengan pesat, memberikan manfaat yang bermakna untuk pertahanan siber serta risiko penggunaan dwi baharu yang perlu diurus dengan berhati-hati. Sebagai contoh, keupayaan yang dinilai melalui cabaran capture-the-flag (CTF) telah meningkat daripada 27% pada GPT‑5(dibuka dalam tetingkap baru) pada Ogos 2025 kepada 76% pada GPT‑5.1‑Codex‑Max(dibuka dalam tetingkap baru) pada November 2025.

Kami menjangkakan model AI yang akan datang akan meneruskan hala tuju ini; sebagai persediaan, kami merancang dan menilai seolah-olah setiap model baharu boleh mencapai tahap keupayaan keselamatan siber ‘Tinggi’, seperti yang diukur oleh Rangka Kerja Kesediaan(dibuka dalam tetingkap baru) kami. Dengan ini, yang kami maksudkan ialah model yang sama ada boleh membangunkan eksploit sifar hari jarak jauh yang berfungsi terhadap sistem yang mempunyai pertahanan kukuh, atau membantu secara bermakna dalam operasi pencerobohan perusahaan atau industri yang kompleks dan bersifat sulit yang bertujuan menghasilkan kesan di dunia sebenar. Siaran ini menerangkan bagaimana kami memikirkan perlindungan untuk model yang mencapai tahap keupayaan ini dan memastikan ia membantu pembela secara bermakna sambil mengehadkan penyalahgunaan.

Seiring dengan kemajuan keupayaan ini, OpenAI sedang melabur dalam memperkukuh modelnya untuk tugasan keselamatan siber defensif dan mencipta alat yang membolehkan pertahanan melaksanakan aliran kerja seperti mengaudit kod dan menampal kelemahan dengan lebih mudah. Matlamat kami adalah agar model dan produk kami membawa kelebihan yang ketara kepada pertahanan, yang sering berdepan kekurangan bilangan dan sumber.

Seperti domain penggunaan dwi yang lain, aliran kerja siber defensif dan ofensif sering bergantung pada pengetahuan dan teknik asas yang sama. Kami melabur dalam perlindungan untuk membantu memastikan keupayaan yang berkuasa ini terutamanya memberi manfaat kepada penggunaan defensif dan mengehadkan peningkatan keupayaan bagi tujuan berniat jahat. Keselamatan siber menyentuh hampir setiap bidang, yang bermaksud kita tidak boleh bergantung pada mana-mana satu kategori langkah perlindungan—seperti mengehadkan pengetahuan atau menggunakan akses yang telah disahkan sahaja—tetapi sebaliknya memerlukan pendekatan pertahanan mendalam yang mengimbangi risiko dan memperkasa pengguna. Dalam amalan, ini bermaksud membentuk cara keupayaan diakses, dipandu, dan diterapkan supaya model lanjutan memperkukuh keselamatan dan bukannya mengurangkan halangan kepada penyalahgunaan.

Kami melihat usaha ini bukan sebagai usaha sekali sahaja, tetapi sebagai pelaburan berterusan dan jangka panjang untuk memberikan kelebihan kepada pihak pertahanan serta terus memperkukuhkan kedudukan keselamatan infrastruktur kritikal di seluruh ekosistem yang lebih luas.

Mengurangkan penggunaan berniat jahat

Model kami direka bentuk dan dilatih untuk beroperasi dengan selamat, disokong oleh sistem proaktif yang mengesan dan bertindak balas terhadap penyalahgunaan siber. Kami terus memperhalusi perlindungan ini apabila keupayaan kami dan landskap ancaman berubah. Walaupun tiada sistem yang dapat menjamin pencegahan sepenuhnya terhadap penyalahgunaan dalam keselamatan siber tanpa menjejaskan kegunaan defensif secara teruk, strategi kami adalah untuk mengurangkan risiko melalui tumpukan keselamatan berlapis.

Sebagai asas kepada perkara ini, kami mengambil pendekatan pertahanan mendalam dengan bergantung pada gabungan kawalan akses, pengukuhan infrastruktur, kawalan egress, dan pemantauan. Kami melengkapi langkah-langkah ini dengan sistem pengesanan dan tindak balas serta program risikan ancaman dan risiko orang dalam yang khusus supaya ancaman yang muncul dapat dikenal pasti dan disekat dengan cepat. Langkah-langkah perlindungan ini direka untuk berkembang seiring dengan landskap ancaman. Kami menjangkakan perubahan dan kami membina supaya kami dapat menyesuaikan diri dengan cepat dan sewajarnya.

Berdasarkan asas ini:

  • Melatih model untuk menolak atau memberikan respons yang selamat terhadap permintaan yang berbahaya sambil kekal membantu untuk kes penggunaan pendidikan dan pertahanan yang sah: Kami sedang melatih model perbatasan kami untuk menolak atau memberikan respons yang selamat terhadap permintaan yang boleh menyebabkan penyalahgunaan siber yang jelas, sambil kekal sebaik mungkin membantu untuk kes penggunaan pertahanan dan pendidikan yang sah.
  • Sistem pengesanan: Kami memperhalusi dan mengekalkan pemantauan di seluruh sistem merentas produk yang menggunakan model perbatasan untuk mengesan aktiviti siber yang berpotensi berniat jahat. Apabila aktiviti kelihatan tidak selamat, kami mungkin menyekat output, menghalakan prom ke model yang lebih selamat atau kurang berkeupayaan, atau menaikkan kes untuk penguatkuasaan. Penguatkuasaan kami menggabungkan semakan automatik dan manusia, berdasarkan faktor seperti keperluan undang-undang, tahap keterukan dan tingkah laku berulang. Kami juga bekerjasama rapat dengan pembangun dan pelanggan perusahaan untuk menyelaraskan piawaian keselamatan serta membolehkan penggunaan yang bertanggungjawab melalui laluan peningkatan yang jelas.
  • Proses penyerang hujung ke hujung: Kami sedang bekerjasama dengan organisasi proses penyerang pakar untuk menilai dan memperbaiki mitigasi keselamatan kami. Tugas mereka adalah untuk cuba memintas semua pertahanan kami dengan beroperasi dari hujung ke hujung, sama seperti pihak lawan yang bertekad dan mempunyai sumber yang mencukupi. Ini membantu kami mengenal pasti jurang lebih awal dan memperkukuh keseluruhan sistem.

Inisiatif ekosistem untuk memperkukuh daya tahan siber 

OpenAI telah melabur awal dalam penerapan AI bagi kes penggunaan keselamatan siber defensif dan pasukan kami berkoordinasi rapat dengan pakar global untuk mematangkan kedua-dua model kami dan penerapannya. Kami menghargai komuniti global pengamal keselamatan siber yang bertungkus-lumus untuk menjadikan dunia digital kita lebih selamat dan komited untuk menyediakan alat yang berkuasa bagi menyokong keselamatan defensif. Semasa kami melaksanakan langkah-langkah perlindungan baharu, kami akan terus bekerjasama dengan komuniti keselamatan siber untuk memahami di mana AI boleh memperkukuh ketahanan secara bermakna, dan di mana langkah-langkah perlindungan yang dirancang dengan teliti adalah paling penting.

Di samping kerjasama ini, kami sedang mewujudkan satu set usaha yang direka untuk membantu pembela bergerak lebih pantas, mendasarkan perlindungan kami pada keperluan dunia sebenar, dan mempercepatkan pemulihan yang bertanggungjawab pada skala besar.

Program akses dipercayai untuk pertahanan siber

Kami akan memperkenalkan tidak lama lagi satu program akses dipercayai di mana kami meneroka penyediaan pengguna dan pelanggan yang layak yang mengusahakan pertahanan siber dengan akses berperingkat kepada keupayaan yang dipertingkatkan dalam model terkini kami untuk kes penggunaan pertahanan. Kami masih meneliti sempadan yang sesuai bagi keupayaan yang boleh kami berikan akses secara meluas dan yang mana memerlukan sekatan berperingkat, yang mungkin mempengaruhi reka bentuk masa depan program ini. Kami berhasrat agar program akses dipercayai ini menjadi asas ke arah ekosistem yang berdaya tahan.

Memperluaskan kapasiti pertahanan dengan Aardvark

Aardvark, penyelidik keselamatan kami yang membantu pembangun dan pasukan keselamatan mencari serta membaiki kelemahan secara besar-besaran, kini berada dalam beta peribadi. Ia mengimbas pangkalan kod untuk kelemahan dan mencadangkan tampalan yang boleh diterima pakai dengan cepat oleh penyelenggara. Ia telah mengenal pasti CVE baharu dalam perisian sumber terbuka dengan penaakulan keseluruhan pangkalan kod. Kami bercadang untuk menawarkan perlindungan percuma kepada repositori sumber terbuka bukan komersial terpilih bagi menyumbang kepada keselamatan ekosistem perisian sumber terbuka dan rantaian bekalan. Mohon untuk menyertai di sini.

Majlis Risiko Perbatasan

Kami akan menubuhkan Majlis Risiko Perbatasan, sebuah kumpulan penasihat yang akan menghimpunkan pembela siber berpengalaman dan pengamal keselamatan untuk bekerjasama rapat dengan pasukan kami. Majlis ini akan bermula dengan tumpuan pada keselamatan siber, dan berkembang ke domain keupayaan perbatasan yang lain pada masa hadapan. Ahli akan memberikan nasihat tentang batas antara keupayaan yang berguna dan bertanggungjawab dengan potensi penyalahgunaan dan pembelajaran ini akan secara langsung memaklumkan penilaian dan perlindungan kami. Kami akan berkongsi lebih lanjut mengenai majlis itu tidak lama lagi. 

Membangunkan pemahaman bersama tentang model ancaman bersama industri

Akhir sekali, kami menjangkakan penyalahgunaan siber mungkin boleh dilaksanakan daripada mana-mana model perbatasan dalam industri. Untuk menangani perkara ini, kami bekerjasama dengan makmal perbatasan lain melalui Frontier Model Forum, sebuah organisasi bukan untung yang disokong oleh makmal AI terkemuka dan rakan industri, untuk membangunkan pemahaman bersama tentang model ancaman dan amalan terbaik. Dalam konteks ini, pemodelan ancaman membantu mengurangkan risiko dengan mengenal pasti bagaimana keupayaan AI boleh dipersenjatakan, di mana kekangan kritikal wujud bagi pelaku ancaman yang berbeza dan bagaimana model perbatasan mungkin memberikan peningkatan yang bermakna. Kerjasama ini bertujuan untuk membina pemahaman yang konsisten di seluruh ekosistem tentang pelaku ancaman dan laluan serangan, membolehkan makmal, penyelenggara dan pihak pertahanan menambah baik langkah mitigasi mereka dengan lebih berkesan serta memastikan cerapan keselamatan kritikal tersebar dengan cepat di seluruh ekosistem. Kami juga bekerjasama dengan pasukan luaran untuk membangunkan penilaian keselamatan siber(dibuka dalam tetingkap baru). Kami berharap ekosistem penilaian bebas akan terus membantu membina pemahaman bersama tentang keupayaan model.

Bersama-sama, usaha-usaha ini mencerminkan komitmen jangka panjang kami untuk memperkukuhkan aspek pertahanan ekosistem. Apabila model menjadi lebih berkebolehan, matlamat kami adalah untuk membantu memastikan keupayaan tersebut diterjemahkan kepada kelebihan sebenar kepada pihak pertahanan—berasaskan keperluan dunia sebenar, dibentuk oleh input pakar, dan dilaksanakan dengan cermat. Di samping usaha ini, kami merancang untuk meneroka inisiatif lain dan geran keselamatan siber bagi membantu mengetengahkan idea terobosan yang mungkin tidak muncul daripada saluran tradisional, serta mengumpulkan pertahanan yang berani dan kreatif secara sumber ramai daripada bidang akademik, industri, dan komuniti sumber terbuka. Secara keseluruhan, ini ialah usaha yang berterusan, dan kami menjangkakan untuk terus mengembangkan program-program ini semasa kami mempelajari perkara yang paling berkesan dalam memajukan keselamatan dunia sebenar.