SafetyKit tingkatkan skala ejen risiko guna model OpenAI canggih
Daripada prototaip dengan pratonton awal model visi hingga ke penskalaan dengan GPT‑5, ejen berbilang modaliti SafetyKit berkembang ke domain baharu dan meningkatkan ketepatan.

Hasil
95%+
Ketepatan menyemak 100% kandungan pelanggan (penilaian SafetyKit)
Hasil
16B
Token diproses setiap hari, meningkat daripada 200 juta enam bulan lalu
Hasil
10+
Tonjolkan peningkatan prestasi pada tugas visi yang paling sukar dengan GPT-5
SafetyKit(dibuka dalam tetingkap baru) membina ejen AI multimodal untuk membantu pasaran, platform pembayaran, dan fintech mengesan serta bertindak terhadap penipuan dan aktiviti yang dilarang merentas teks, imej, transaksi kewangan, penyenaraian produk, dan banyak lagi. Kemajuan besar terkini dalam penaakulan model dan pemahaman multimodal kini menjadikan ini lebih berkesan, sekali gus menetapkan penanda aras baharu untuk operasi risiko, pematuhan, dan keselamatan.
Ejen SafetyKit memanfaatkan GPT‑5, GPT‑4.1, penyelidikan mendalam, dan ejen penggunaan komputer (CUA) untuk menyemak 100% kandungan pelanggan dengan ketepatan melebihi 95% berdasarkan penilaian SafetyKit. Ia boleh membantu platform melindungi pengguna, mencegah penipuan, mengelakkan denda kawal selia, dan menguatkuasakan dasar yang kompleks yang mungkin terlepas pandang oleh sistem legasi, seperti peraturan khusus mengikut wilayah, nombor telefon yang dibenamkan dalam imej penipuan, atau kandungan eksplisit. Automasi juga boleh melindungi moderator manusia daripada terdedah kepada bahan yang menyinggung dan membolehkan mereka menumpukan perhatian pada keputusan dasar yang bernuansa.
“OpenAI memberi kami akses kepada model penaakulan dan multimodal yang paling canggih di pasaran.” Ia membolehkan kami menyesuaikan diri dengan cepat, menghantar ejen baharu dengan lebih pantas, dan mengendalikan jenis kandungan yang penyelesaian lain tidak dapat huraikan.”
Reka ejen mengikut keperluan tugas, kemudian pilih model yang tepat
Ejen-ejen SafetyKit masing-masing dibina untuk menangani kategori risiko tertentu, daripada penipuan hingga produk haram. Setiap kandungan dihalakan kepada ejen yang paling sesuai untuk pelanggaran tersebut, menggunakan model OpenAI yang optimum:
- GPT‑5 menggunakan penaakulan multimodal merentas teks, imej, dan UI untuk mengenal pasti risiko tersembunyi serta menyokong pembuatan keputusan yang berlapis dan tepat
- GPT‑4.1 dengan andal mematuhi arahan dasar kandungan yang terperinci dan mengurus aliran kerja moderasi berjumlah besar dengan cekap
- Pelarasan halus pengukuhan (RFT) meningkatkan pemanggilan semula dan ketepatan melangkaui model lalai, mencapai prestasi perbatasan dengan dasar keselamatan yang kompleks
- Penyelidikan mendalam mengintegrasikan penyiasatan dalam talian masa nyata ke dalam ulasan dan pengesahan pedagang
- Ejen Penggunaan Komputer (CUA) mengautomasikan tugas dasar yang kompleks, mengurangkan kebergantungan pada semakan manual yang mahal
Pendekatan pemadanan model ini membolehkan SafetyKit menskalakan semakan kandungan merentasi modaliti dengan nuansa dan ketepatan yang lebih tinggi berbanding penyelesaian legasi.
Sebagai contoh, ejen pengesanan penipuan melangkaui sekadar mengimbas teks. Ia menganalisis visual seperti kod QR atau nombor telefon yang dibenamkan dalam imej produk. GPT‑4.1 membantunya mentafsir imej, memahami susun atur, dan menentukan sama ada ia merupakan pelanggaran dasar.
Ejen Pendedahan Dasar menyemak senarai atau halaman pendaratan untuk bahasa yang diperlukan, seperti penafian undang-undang atau amaran pematuhan khusus wilayah. GPT‑4.1 mengekstrak bahagian yang relevan, GPT‑5 menilai pematuhan, dan ejen menandakan pelanggaran.
“Kami menganggap ejen kami sebagai aliran kerja yang dibina khusus,” kata Graunke. “Sesetengah tugas memerlukan penaakulan mendalam, manakala yang lain memerlukan konteks multimodal. OpenAI ialah satu-satunya lapisan yang memberikan prestasi yang boleh dipercayai merentasi kedua-duanya.”
Keputusan dasar sering bergantung pada perbezaan halus. Ambil contoh pasaran yang memerlukan penjual menyertakan penafian untuk produk kesejahteraan, dengan keperluan yang berbeza-beza berdasarkan tuntutan produk dan peraturan serantau. Penyedia legasi menggunakan pencetus kata kunci atau set peraturan yang tegar, yang boleh terlepas pertimbangan yang lebih mendalam yang mungkin diperlukan oleh keputusan ini, lalu menyebabkan penguatkuasaan terlepas pandang atau salah.
Ejen Pendedahan Dasar SafetyKit mula-mula merujuk dasar daripada perpustakaan dalaman SafetyKit, kemudian GPT‑5 menilai kandungan tersebut: adakah ia menyebut rawatan atau pencegahan? Adakah ia dijual di rantau yang mewajibkan pendedahan? Dan jika ya, adakah bahasa yang diperlukan itu benar-benar disertakan dalam senarai? Jika ada apa-apa yang tidak memenuhi keperluan, GPT‑5 mengembalikan output berstruktur yang digunakan oleh ejen untuk menandakan isu tersebut.
“Kekuatan GPT‑5 terletak pada sejauh mana ketepatannya dalam menaakul apabila disandarkan pada dasar sebenar,” kata Graunke. “Ia membolehkan kami membuat keputusan yang tepat dan boleh dipertahankan, termasuk dalam kes pinggiran apabila sistem lain gagal”.
Ubah setiap keluaran model menjadi kejayaan produk
SafetyKit menanda aras setiap model OpenAI baharu terhadap kes paling sukar, sering melancarkan model berprestasi terbaik pada hari yang sama. Penilaian dalaman yang teliti membolehkan pasukan mengenal pasti dengan cepat bagaimana model baharu dapat meningkatkan prestasi dan disepadukan dengan lancar ke dalam infrastruktur teras mereka.
Apabila OpenAI o3 dilancarkan, SafetyKit menggunakannya untuk meningkatkan prestasi kes luar biasa merentas bidang dasar utama. GPT‑5 menyusul, dan dalam beberapa hari, ia digunakan merentas ejen mereka yang paling mencabar, meningkatkan skor penanda aras lebih daripada 10 mata pada tugas visi mereka yang paling sukar.
“OpenAI bergerak pantas, dan kami telah merancang sistem kami untuk mengikutinya. Setiap keluaran baharu memberi kami kelebihan operasi–membuka keupayaan dan domain baharu yang sebelum ini tidak dapat kami sokong, serta meningkatkan liputan dan ketepatan yang kami berikan kepada pelanggan.”
SafetyKit juga menyalurkan penambahbaikan kembali ke dalam ekosistem, dengan berkongsi hasil penilaian, kegagalan kes luar biasa, dan cerapan khusus dasar secara langsung dengan OpenAI untuk membantu membentuk prestasi model masa hadapan bagi beban kerja yang kritikal terhadap keselamatan.
Tingkatkan pertumbuhan pelanggan dan volum dengan platform OpenAI terbaik
Seni bina SafetyKit menguatkuasakan dasar pada skala besar, memberikan kelajuan, ketepatan, dan liputan risiko yang menyeluruh. Di sebalik tabir, ia kini mengendalikan lebih daripada 16 bilion token setiap hari, meningkat daripada 200 juta enam bulan yang lalu, sambil menganalisis lebih banyak kandungan tanpa menjejaskan ketepatan.
Dalam tempoh yang sama, SafetyKit telah berkembang kepada risiko pembayaran, penipuan, pencegahan eksploitasi kanak-kanak, pencegahan pengubahan wang haram, dan pelanggan baharu dengan ratusan juta pengguna akhir di bawah perlindungan SafetyKit. Asas ini membolehkan pelanggan bertindak balas dengan pantas dan yakin terhadap risiko yang bakal muncul.
“Kami telah mewujudkan satu kitaran yang mana setiap keluaran OpenAI secara langsung mengukuhkan keupayaan kami,” kata Graunke. “Itulah sebabnya sistem ini terus bertambah baik, sentiasa mendahului risiko yang sedang berkembang.”
Keputusan sepintas lalu
- Ketepatan lebih daripada 95% dengan menyemak 100% kandungan pelanggan
- 16B token diproses setiap hari, meningkat daripada 200 juta dalam tempoh enam bulan
- Peningkatan penanda aras sebanyak lebih daripada 10 mata pada tugas penglihatan paling sukar


