Maanta, waxaan sii deynaynaa nooc hordhac cilmi-baariseed ah oo gpt-oss-safeguard ah, oo ah moodeelladayada sababaynta ee miisaankoodu furan yahay ee loogu talagalay hawlaha kala-soocidda badbaadada, kuwaas oo lagu heli karo laba cabbir: gpt-oss-safeguard-120b iyo gpt-oss-safeguard-20b. Moodeelladani waa noocyo si gaar ah loo habeeyay oo ka mid ah moodeelladayada furan ee gpt-oss waxaana lagu heli karaa isla shatiga dabacsan ee Apache 2.0, kaas oo qof kasta u oggolaanaya inuu si xor ah u isticmaalo, wax uga beddelo, una hawlgeliyo. Labada moodeelba maanta waxaa laga soo dejisan karaa Hugging Face(ku furmaa daaqad cusub).
Moodeellada gpt-oss-safeguard waxay isticmaalaan caqliyeynta si ay si toos ah u fasiraan siyaasad uu horumariyuhu bixiyay waqtiga inference-ka—iyaga oo u kala saaraya farriimaha isticmaalaha, jawaabaha moodeelka, iyo wada sheekaysiyada oo dhammaystiran iyadoo loo eegayo baahiyaha horumariyaha. Horumariyaha ayaa had iyo jeer go’aamiya siyaasadda la isticmaalayo, sidaas darteed jawaabuhu waxay noqdaan kuwo aad ugu habboon oo loogu habeeyey xaaladda isticmaalka ee horumariyaha. Moodeelku wuxuu isticmaalaa silsiladda fekerka, taas oo horumariyuhu dib u eegi karo si uu u fahmo sida moodeelku u gaarayo go'aamadiisa. Intaa waxaa dheer, siyaasadda waxaa la bixiyaa inta lagu jiro inference-ka, halkii lagu tababari lahaa moodeelka, taas oo u fududaynaysa horumariyeyaasha inay si isdaba joog ah u dib u eegaan siyaasadaha si ay u kordhiyaan waxqabadka. Habkan, oo aan markii hore u samaynay isticmaalka gudaha, aad buu uga dabacsan yahay habka dhaqanka ah ee lagu tababaro kala soocaha si uu si dadban uga soo saaro xadka go'aanka tiro badan oo tusaalooyin summadaysan ah.
gpt-oss-safeguard wuxuu u suurtageliyaa horumariyeyaasha inay qeexaan xuduudaha siyaasadda ee sida ugu habboon xaaladdooda isticmaalka. Tusaale ahaan, madal dood oo ku saabsan ciyaaraha fiidyaha ayaa laga yaabaa inay rabto inay samaysato siyaasad lagu kala saaro qoraallada ka hadlaya khiyaamada ciyaarta, ama bog qiimeynaha alaabada ah ayaa laga yaabaa inuu rabo inuu isticmaalo siyaasaddiisa gaarka ah si uu u shaandheeyo qiimeynaha u muuqda inay u badan tahay inay been-abuur yihiin.
Moodeelku waxa uu hal mar qaataa laba gelin—siyaasad iyo nuxurka lagu kala saarayo siyaasaddaas hoosteeda—wuxuuna soo saaraa gunaanad ku saabsan halka nuxurku ku dhacayo, oo ay la socoto caqliyeyntiisu. Horumariyeyaasha ayaa go'aamiya sida—haddii ayba isticmaalayaan—ay gunaanadyadaas ugu adeegsanayaan hab-socodyadooda badbaadada. Waxaan aragnay in habkan ku salaysan caqliyeynta uu si gaar ah ugu shaqeeyo xaaladaha ay:
- Waxyeellada suurtagalka ahi ay soo baxaysaa ama isbeddelayso, siyaasadduna ay u baahan tahay inay si degdeg ah ula qabsato.
- Mawduucan takhasuska ahi waa mid aad u leh kala-duwanaanshooyin yaryar, waxaana ku adag moodallada kala-soocidda ee yaryar inay si fiican ula tacaalaan.
- Horumariyayaashu ma haystaan tusaalooyin ku filan oo ay ku tababaraan kala soocaha tayo sare leh ee khatar kasta oo ka jirta madashooda.
- Dib u dhaca jawaabtu wuu ka muhiimsan yahay soo saarista summado tayo sare leh oo la sharxi karo.
Waxaan soo saaraynaa hordhaca gpt-oss-safeguard si aan uga helno faallooyin bulshada cilmi-baarista iyo badbaadada, oo aan sii horumarino waxqabadka moodeelka. Muddo bilo ah, waxaan kala shaqaynaynay sii-dayntan miisaanka furan leh ROOST(ku furmaa daaqad cusub) si aan u aqoonsano baahiyaha muhiimka ah ee horumariyaha, u tijaabino moodeelka, una soo saarno dukumentiyada horumariyaha. Iyada oo qayb ka ah daahfurkan, ROOST waxay dhisi doontaa bulsho moodeello(ku furmaa daaqad cusub), oo sidoo kale maanta la daahfurayo, si ay u sahmiso moodeellada AI ee furan si ay u ilaaliso meelaha onlaynka ah. Waxaa barbar socda sii-dayntan, waxaan daabacaynaa warbixin farsamo oo kooban oo faahfaahinaysa waxqabadka badbaadada ee moodeelka hordhaca ah.
Marka ay timaaddo badbaadada, waxaan aaminsannahay difaac lakabyo badan. Waxaan tababarnaa moodalladeenna si ay si ammaan ah uga jawaabaan, waxaana hirgelinnaa lakabyo dheeraad ah oo ilaalin ah si loo ogaado loona wax looga qabto gelinnada iyo wax-soo-saarrada suuragalka ah ee aan ammaan ahayn iyadoo la raacayo xeerarkayaga. Kala-soocayaasha badbaadada, kuwaas oo kala saara nuxurka ammaan ah iyo kan aan ammaan ahayn ee meel khatar gaar ah ah, waxay muddo dheer ahaayeen lakabka koowaad ee difaaca ee moodalladayada waaweyn ee luqadda iyo kuwa kale.
Kala-soocayaasha badbaadada ee dhaqameed, sida kuwa laga heli karo Moderation API(ku furmaa daaqad cusub)-gayaga, waxaa la horumariyaa iyadoo gacanta si taxaddar leh loogu ururiyo loona habeeyo kumannaan tusaale oo nuxur ammaan ah iyo mid aan ammaan ahayn, iyadoo la raacayo siyaasado badbaado oo hore loo qeexay. Xogtan tababarka ah, kala-soocuhu wuxuu ku bartaa inuu kala saaro natiijooyinka badbaado leh iyo kuwa aan badbaado lahayn. Habkan dhaqameed, kala-saaraha marnaba si dhab ah uma arko siyaasadda badbaadada. Taas beddelkeeda, waxay isku daydaa inay ka garato siyaasadda salka ku haysa ee loo adeegsaday calaamadeynta tusaalooyinka, iyadoo raadinaysa waxyaabaha ay iskaga mid yihiin nuxurka loo calaamadeeyay inuu yahay mid aan ammaan ahayn iyo kala duwanaanshaha u dhexeeya nuxurka aan ammaan ahayn iyo nuxurka ammaan ah.
Kala-soocayaasha dhaqameedku waxay yeelan karaan waxqabad sare, oo leh dib u dhac yar iyo kharash hawlgal. Laakiin ururinta tiro ku filan oo tusaalooyin tababar ah waxay qaadan kartaa waqti badan oo kharash badan leh, sidoo kale cusboonaysiinta ama beddelidda siyaasadda waxay u baahan tahay in dib loo tababaro kala-soocaha.
gpt-oss-safeguard way wuu ka duwan yahay sababtoo ah awoodihiisa caqliyeynta waxay u oggolaanayaan horumariyeyaasha inay dabaqaan siyaasad kasta , oo ay ku jiraan kuwa ay iyagu iskood u qoraan ama ay ka soo qaataan ilo kale, caqliyeyntuna waxay ka caawisaa noocyada inay guud ahaan u dabaqaan siyaasadaha cusub ee la qoray. Marka laga soo tago siyaasadaha badbaadada, gpt-oss-safeguard waxaa loo isticmaali karaa in lagu summadeeyo nuxurka siyaabo kale oo muhiim u ah alaabooyin iyo madallo gaar ah.
Moodeelladayada aasaasiga ah ee sababayntu hadda waxay si toos ah u bartaan siyaasadaha badbaadadayada, waxayna isticmaalaan awooddooda sababayneed si ay uga baaraan degaan waxa ammaan ah. Habkan, oo aan ugu yeerno waafajinta ku salaysan ka baaraan degidda, wuxuu si weyn uga horumaraa hababkii hore ee tababarka badbaadada wuxuuna ka dhigaa moodeelladayada caqliyeynta kuwo ka ammaan badan dhinacyo dhowr ah marka loo eego kuwii ka horreeyay ee aan caqliyeynta lahayn, xitaa iyadoo awoodahoodu sii kordhayaan. Laakiin caqliyeyntu waxtar uma laha oo keliya tababarka moodeellada laftooda. Waxa kale oo ay abuurtaa fursado cusub oo loogu talagalay difaac heerar badan leh. Hababka ku salaysan caqliyeynta way ka dabacsan yihiin oo faahfaahinta tababarkoodii hore si ka yar ayay ugu xaddidan yihiin, faa’iidooyin mararka qaar in ka badan xaqiijiya kharashka dheeraadka ah ee xisaabinta iyo daahitaanka ay ku lug leeyihiin.
gpt-oss-safeguard waa hirgelin miisaanno-furan leh oo ku salaysan hab aan gudaha ku horumarinay, kuna jira qalab aan ugu yeerno Safety Reasoner. Waxaan ku bilownay turxaan bixinta xoojinta ee hawlaha calaamadeynta siyaasadda, annagoo ku abaalmarinayna moodelku inuu ka tarjumo go'aannada saxda ah ee khubarada bini’aadamka. Tani waxay bartay moodelka inuu ka fikiro sida xeerku u horseedo xukunkiisa. Maanta, Safety Reasoner wuxuu noo suurtageliyaa inaan si firfircoon u cusboonaysiinno siyaasadaha badbaadada ee deegaanka wax-soo-saarka, muddo ka yar waqtiga ay qaadan lahayd in dib loo tababaro kala-sooce. Tani waxay Safety Reasoner ka dhigaysaa qalab muhiim u ah hirgelinta soo noqnoqota: marka aan ku hirgelinno moodeello cusub wax-soo-saarka, waxaan badanaa ku bilownaa siyaasado ka adag oo aan isticmaalnaa xaddi xisaabin ah oo aad u badan halka loo baahdo si aan Safety Reasoner ugu suurtagelinno inuu si taxaddar leh u dabaqo siyaasadahaas. Kadib waxaan hagaajinnaa siyaasadaheena marka fahamkeenna ku saabsan khataraha ka jira jawiga wax-soo-saarka uu sii wanaagsanaado. Qaar ka mid ah daahfurkeeni dhawaa, saamiga wadarta xisaabinta ee loo qoondeeyay caqliyeynta badbaadada ayaa gaaray 16% Sare.
Safety Reasoner waxa uu noqday qayb asaasi ah oo ka mid ah xirmadayada badbaadada. Soo saarida sawirka iyo Sora 2, waxa uu u sameeyaa qiimeynno firfircoon oo tallaabo-tallaabo ah natiijooyinka si uu u aqoonsado oo u xannibo soo saarid aan ammaan ahayn waqtiga dhabta ah. Dhinacyada ay ka mid yihiin bayoolaji iyo is-dhaawac, waxaan adeegsannaa noocyo sida kuwa lagu isticmaalo Moderation API oo ah kala-saarayaal yaryar, degdeg ah, oo xasuusin sare leh si loo go'aamiyo nuxurka ku jira goob danayn leh, ka dibna waxaan u isticmaalnaa Safety Reasoner si uu u eego nuxurkaas. Safety Reasoner waxa uu u kala saaraa natiijooyinka moodel marka loo eego kala-sooc faahfaahsan si loo go'aamiyo sida ugu wanaagsan ee looga jawaabi karo, isaga oo qayb ka ah ilaalinadayada lakabyo badan leh ee nidaamyada sida GPT‑5 iyo ChatGPT Agent. Oo hadda, moodeellada gpt-oss-safeguard waxay habkan la midka ah ka dhigayaan mid qof kasta heli karo.
Waxaan ku qiimeynay moodeellada gpt-oss-safeguard labada qaybood ee qiimeynta gudaha iyo dibadda.
Qiimeynta gudaha, waxaan gpt-oss-safeguard si isku mar ah u siinnay siyaasado badan xilliga inference-ka. Gelin kasta oo tijaabo ah, waxaa la qiimeeyaa in gpt-oss-safeguard uu si sax ah u kala saaro qoraalka iyadoo la raacayo dhammaan siyaasadaha ku jira. Tani waa hawl adag—moodeelka waxaa loo tixgeliyaa inuu sax yahay oo keliya haddii uu si buuxda ugu ekaado summadaha kaydka tixraaca ee dhammaan siyaasadaha ku jira.
Moodeelladeena gpt-oss-safeguard iyo Sababeeyaha Badbaadada ee gudaha ayaa ka sarreeya gpt-5-thinking iyo open models ee gpt-oss marka la eego saxnaanta siyaasadaha badan. Moodeellada gpt-oss-safeguard oo ka sarreeya gpt-5-thinking ayaa si gaar ah layaab leh marka la eego cabbirka yar ee modeelladii hore.
Waxaan sidoo kale moodeelladan ku sii qiimeynay xog-ururinta moderation-ka(ku furmaa daaqad cusub) ee aan la sii deynay warqaddeenna cilmi-baarista ee 2022(ku furmaa daaqad cusub) iyo ToxicChat(ku furmaa daaqad cusub), oo ah halbeeg dadweyne oo ku salaysan su’aalaha isticmaalayaasha ee chatbot il-furan ah.
Xog-ururinta qiimaynta dhexdhexaadinta ee 2022, waxaan ku qiimaynay annaga oo adeegsanayna siyaasadaha badbaadada ee gudaha (annaga oo hal siyaasad la waafajinay si loo tixgeliyo isbeddelladii xigay). gpt-oss-safeguard wax yar ayuu ka fiicnaaday dhammaan moodeelladii kale ee la tijaabiyay, oo ay ku jiraan Safety Reasoner-keenna gudaha iyo gpt-5-thinking, inkastoo farqigan u dhexeeya Safety Reasoner iyo gpt-oss-safeguard aanu ahayn mid tirakoob ahaan muhiim ah.
ToxicChat, waxaan ku qiimeynay annagoo adeegsanayna weydiin gaaban oo gacanta lagu qoray oo laga waafajiyay qaar ka mid ah siyaasadaheenna gudaha. Safety Reasoner-keena gudaha ayaa mar kale ka waxqabad fiicnaaday gpt-5-thinking, halka gpt-5-thinking iyo Safety Reasoner labaduba ay wax yar kaga sarreeyaan gpt-oss-safeguard-120b iyo gpt-oss-safeguard-20b. Waxaan filaynaa in cabbirka gpt-oss-safeguard oo marka la eego yar uu weli ka dhigayo mid ku habboon in laga doorbido hawshan oo kale.
Waxaa jira laba xaddidaad oo gaar ah oo ku saabsan gpt-oss-safeguard. Marka hore, waxaan ogaanay in kala-soocayaasha lagu tababaray tobannaan kun oo muunado summadaysan oo tayo sare leh ay weli ka waxqabad fiicnaan karaan kala soocidda nuxurka marka loo eego gpt-oss-safeguard marka uu si toos ah uga sameynayo caqliyeynta siyaasadda. In waqti la geliyo tababarka kala-soocaha gaar ah ayaa laga yaabaa in la doorbido si loo helo waxqabad sare leh oo ku saabsan khataraha sii adag.
Marka labaad, gpt-oss-safeguard wuxuu u baahan karaa waqti iyo awood xisaabineed badan, taas oo ka dhigaysa mid adag in lagu ballaariyo dhammaan nuxurka madasha. Gudaha, waxaan tan ugu maareynaa dhowr siyaabood annagoo adeegsanayna Safety Reasoner: (1) waxaan isticmaalnaa kala-soocayaal yaryar oo dhakhso badan si aan u go’aamino nuxurka la qiimeynayo, iyo (2) xaaladaha qaarkood, waxaan Safety Reasoner u isticmaalnaa si aan isku-waqti ahayn si aan u bixino waayo-aragnimo isticmaale oo leh daahitaan hoose, annagoo weli ilaalinayna awoodda aan ku faragelin karno haddii aan ogaanno nuxur aan ammaan ahayn.
gpt-oss-safeguard waa moodeelladii ugu horreeyay ee badbaadada furan ee OpenAI oo lala dhisay bulshada. Waxaan dhowr wareeg oo horumarin ah ku samaynay gpt-oss-safeguard annaga oo la shaqaynayna khubaro ku takhasusay kalsoonida iyo badbaadada oo ka kala socda SafetyKit, ROOST, Tomoro, iyo Discord, iyada oo qayb ka ah tijaabada hordhaca ah. Madaxa Teknolojiyadda ee ROOST, Vinay Rao, ayaa yidhi, “gpt-oss-safeguard waa moodeelka caqliyeynta il furan ee ugu horreeya ee leh naqshad ‘la imow xeerarkaaga iyo qeexitaannada waxyeellada’. Hay’aduhu waxay mudan yihiin inay si xor ah u daraaseeyaan, wax uga beddelaan, una isticmaalaan teknoolojiyada badbaadada ee muhiimka ah, isla markaana ay awood u yeeshaan inay hal-abuuraan. Tijaabooyinkayaga, waxay xirfad u lahayd fahamka siyaasado kala duwan, sharraxidda caqliyeynteeda, iyo muujinta taxaddarka ku jira dabaqidda siyaasadaha, taas oo aan aaminsanahay inay faa’iido u yeelan doonto dhiseyaasha iyo kooxaha badbaadada.”
Waxaan sii wadi doonnaa inaan la kaashanno bulshada si aan u horumarino qalabka badbaadada ee furan, oo ay ku jirto ROOST Model Community (RMC). RMC-gu wuxuu isu keenaa xirfadlayaasha badbaadada iyo cilmi-baarayaasha si ay u wadaagaan habraacyada ugu wanaagsan ee ku saabsan hirgelinta moodeellada AI ee il-furan ee habsocodyada badbaadada, oo ay ku jiraan natiijooyinka qiimeynta iyo jawaab-celinta moodelka. Booqo kaydka GitHub ee RMC(ku furmaa daaqad cusub) si aad wax badan uga ogaato iskaashigan iyo sida aad uga qayb qaadan karto.
Si aad u bilowdo dhisidda moodeelladan, ka soo degso Hugging Face(ku furmaa daaqad cusub).

