Langkau ke kandungan utama
OpenAI

24 Mac 2026

Keselamatan

Membantu pembangun membina pengalaman AI yang lebih selamat untuk remaja

Memperkenalkan satu set dasar keselamatan remaja yang diformat sebagai prom untuk gpt-oss-safeguard

Memuat…

Hari ini, kami melancarkan dasar keselamatan(dibuka dalam tetingkap baru) berasaskan prom untuk membantu pembangun mencipta perlindungan yang sesuai mengikut umur untuk remaja. Dibina untuk berfungsi dengan model keselamatan pemberat terbuka kami, gpt-oss-safeguard(dibuka dalam tetingkap baru), semua-dasar ini memudahkan cara pembangun menukar keperluan keselamatan kepada pengelas yang boleh digunakan untuk sistem dunia sebenar.

Kami melancarkan model pemberat terbuka untuk mendemokrasikan akses kepada AI yang berkuasa dan menyokong inovasi yang meluas. Pada masa yang sama, kami percaya bahawa keselamatan dan inovasi bergerak seiring, dan bahawa pembangun perlu mempunyai akses kepada model yang berkemampuan serta alat dan dasar untuk menggunakannya dengan selamat dan bertanggungjawab. Kami membangunkan semua dasar ini untuk menyokong pembangun dalam usaha keselamatan mereka untuk melindungi pengguna muda, dengan input daripada organisasi luar yang dipercayai termasuk Common Sense Media(dibuka dalam tetingkap baru) dan everyone.ai(dibuka dalam tetingkap baru).

Kami mengiktiraf bahawa remaja dan orang dewasa mempunyai keperluan yang berbeza, dan bahawa remaja memerlukan perlindungan tambahan. Semua dasar ini direka untuk membantu pembangun mengambil kira perbezaan tersebut dan membina pengalaman yang memperkasakan serta sesuai untuk pengguna yang lebih muda.

Meneruskan usaha kami yang lebih luas untuk melindungi golongan muda

Sejak sekian lama, kami komited untuk membangunkan AI yang memperluas peluang untuk golongan muda sambil memastikan mereka kekal selamat. Sebagai sebahagian daripada usaha ini, kami mengemas kini Spesifikasi Model(dibuka dalam tetingkap baru)—garis panduan yang mentakrifkan perilaku model OpenAI yang diinginkan—untuk memasukkan Prinsip Bawah-18 (U18)(dibuka dalam tetingkap baru), dan memperkenalkan perlindungan pada peringkat produk seperti kawalan ibu bapa dan ramalan umur untuk melindungi pengguna yang lebih muda dengan lebih baik. Kami juga telah menyarankan perlindungan seluruh industri melalui Rangka Tindakan Keselamatan Remaja kami.

Pelancaran hari ini dibina berdasarkan asas tersebut. Kami menyediakan dasar keselamatan ini kepada pembangun untuk menyokong mereka dalam melaksanakan perlindungan keselamatan untuk remaja dan membantu mendemokrasikan akses merentas ekosistem pemberat terbuka.

Menterjemahkan keselamatan remaja kepada dasar yang jelas dan praktikal

Walaupun pengelas keselamatan seperti gpt-oss-safeguard boleh mengesan kandungan berbahaya, ia bergantung pada takrifan yang jelas tentang kandungan tersebut. Dalam amalan, salah satu cabaran terbesar yang dihadapi oleh pembangun ialah mentakrifkan dasar yang merangkumi risiko khusus remaja dengan tepat dan boleh diterapkan secara konsisten dalam sistem sebenar.

Malah pasukan yang berpengalaman pun sering bergelut untuk menterjemahkan matlamat keselamatan peringkat tinggi kepada peraturan operasi yang tepat, terutamanya kerana hal ini memerlukan kedua-dua kepakaran subjek dan pengetahuan AI yang mendalam. Ini boleh menyebabkan jurang dalam perlindungan, penguatkuasaan yang tidak konsisten, atau penapisan yang terlalu meluas. Dasar yang jelas dan berskop baik merupakan asas yang kritikal bagi sistem keselamatan yang berkesan.

Membantu pembangun melaksanakan keselamatan remaja

Untuk menangani cabaran ini, kami melancarkan satu set dasar keselamatan(dibuka dalam tetingkap baru), yang disesuaikan dengan risiko umum yang dihadapi oleh remaja dan dimaklumkan oleh semakan teliti terhadap penyelidikan sedia ada tentang perbezaan perkembangan unik remaja. Semua dasar ini disusun sebagai prom yang boleh digunakan secara langsung dengan gpt-oss-safeguard(dibuka dalam tetingkap baru) dan model penaakulan lain, membolehkan pembangun menggunakan standard keselamatan yang konsisten dengan lebih mudah merentas sistem mereka.

Siaran awal merangkumi dasar yang merangkumi:

  • Kandungan keganasan grafik
  • Kandungan grafik seksual
  • Idealisme tubuh badan dan tingkah laku yang memudaratkan
  • Aktiviti berbahaya dan cabaran
  • Main peranan romantik atau ganas
  • Barangan dan perkhidmatan terhad umur

Dasar ini boleh digunakan untuk penapisan kandungan masa nyata, serta analisis luar talian kandungan yang dijana oleh pengguna.

Dengan menstrukturkan dasar sebagai prom, pembangun dapat mengintegrasikannya dengan lebih mudah ke dalam aliran kerja sedia ada, menyesuaikannya dengan kes penggunaan mereka, dan mengulanginya dari semasa ke semasa.

Rajah yang menggambarkan kategori dasar keselamatan remaja dan kandungan berkaitan remaja yang dimasukkan ke dalam sistem perlindungan GPT-OSS, yang menghasilkan keputusan dasar yang dimaklumkan oleh penaakulan dalaman.

Dibangunkan dengan input daripada pakar luar

Kami bekerja sama dengan organisasi luar termasuk Common Sense Media(dibuka dalam tetingkap baru) dan everyone.ai(dibuka dalam tetingkap baru) untuk memaklumkan pembangunan semua dasar ini. Kepakaran mereka membantu membentuk skop kandungan yang perlu diliputi, mengukuhkan struktur prom, dan memperhalusi kes pinggiran yang perlu dipertimbangkan semasa menilainya. 

Kerja ini mencerminkan usaha berterusan untuk bekerjasama dengan pakar dan ekosistem yang lebih luas bagi menambah baik cara sistem AI menyokong golongan muda.

“Salah satu jurang terbesar dalam keselamatan AI untuk remaja ialah kekurangan dasar yang jelas dan boleh dilaksanakan yang boleh dijadikan asas oleh pembangun. Kerap kali, pembangun bermula dari awal. Dasar berasaskan prom ini membantu menetapkan tahap keselamatan minimum yang bermakna merentas seluruh ekosistem, dan kerana ia dikeluarkan sebagai sumber terbuka, ia boleh disesuaikan dan ditambah baik dari semasa ke semasa. Kami berasa gembira melihat infrastruktur seperti ini disediakan secara meluas, dan kami berharap ia dapat memangkin lebih banyak asas bersama bagi keselamatan belia merentas industri.”

Robbie Torney, Ketua AI & Penilaian Digital, Common Sense Media

“Usaha seperti ini, yang menjadikan dasar keselamatan belia lebih dapat dilaksanakan, adalah bernilai kerana ia membantu menterjemahkan pengetahuan pakar kepada panduan yang boleh digunakan dalam sistem sebenar. Dasar kandungan merupakan langkah pertama yang penting, dan ia juga membuka ruang kepada usaha yang lebih luas tentang cara tingkah laku model boleh membentuk risiko yang berkaitan dengan belia dari semasa ke semasa. Diilhamkan oleh usaha ini dan penyelidikan kami sendiri, everyone.ai(dibuka dalam tetingkap baru) juga telah mewujudkan dasar tingkah laku awal yang memfokuskan pada risiko seperti eksklusiviti dan kebergantungan berlebihan."

Dr. Mathilde Cerioli, Ketua Saintis di everyone.AI

Titik permulaan, bukan penyelesaian yang lengkap.

Dasar ini bertujuan sebagai titik permulaan, bukan sebagai takrifan atau jaminan keselamatan remaja yang menyeluruh atau muktamad. Setiap aplikasi mempunyai risiko, khalayak dan konteks yang unik, dan pembangun berada pada kedudukan terbaik untuk memahami risiko yang mungkin ditimbulkan oleh produk dan integrasi AI mereka. Kami sangat menggalakkan pembangun untuk menyesuaikan dan memperluas dasar ini berdasarkan keperluan khusus mereka serta menggabungkannya dengan langkah perlindungan lain seperti keputusan reka bentuk produk, kawalan pengguna, ketelusan mesra remaja, sistem pemantauan dan respons yang teliti serta sesuai dengan umur. 

Kami percaya bahawa pendekatan mendalam pertahanan berlapis adalah penting untuk membina sistem AI yang lebih selamat. Dasar ini adalah hasil pengalaman dalaman kami, tetapi ia tidak mencerminkan sepenuhnya keseluruhan dasar atau langkah perlindungan dalaman OpenAI.

Jalan ke hadapan

Kami mengeluarkan aemua dasar ini sebagai sumber terbuka melalui ROOST Model Community(dibuka dalam tetingkap baru) untuk menggalakkan kolaborasi dan pengulangan. Untuk menyumbang, memberikan maklum balas, atau berkongsi dasar keselamatan remaja tambahan, lawati repositori GitHub RMC.(dibuka dalam tetingkap baru)

Pembangun dan organisasi boleh menyesuaikan dasar ini dengan aplikasi khusus mereka, menterjemahkannya ke dalam bahasa yang berbeza, dan meluaskannya untuk merangkumi bidang risiko tambahan. Lambat laun, kami berharap ini menyumbang kepada asas yang lebih kukuh dan dikongsi untuk melaksanakan dasar keselamatan dalam sistem AI.

Untuk mula menggunakan gpt-oss-safeguard, muat turunnya dari Hugging Face(dibuka dalam tetingkap baru).