Léim go dtí an príomhábhar
OpenAI

3 Meán Fómhair 2026

Sábháilteacht

Forléargas sábháilteachta: GPT‑6 Astra

Ag lódáil…

Inniu, táimid ag seoladh GPT‑6 Astra, an tsamhail is cumasaí dár chuireamar in úsáid go forleathan riamh. Is é Astra an chéad samhail dár gcuid a shroich leibhéal Criticiúil cumais chibearshlándála faoinár gCreat Ullmhachta.

Seo a leanas na rudaí is tábhachtaí atá le tuiscint faoi shábháilteacht an tseolta seo:

  1. Is céim mhór chun cinn é GPT‑6 Astra ó thaobh cumais chibearshlándála de agus sásaíonn sé ár dtairseach Chriticiúil. Ciallaíonn sé sin gur féidir le GPT‑6 Astra, ach na huirlisí agus an rochtain cheart a bheith aige, lochtanna slándála nárbh eol dúinn roimhe seo a aimsiú agus bealaí nua a fhorbairt chun teacht i dtír orthu ar fud go leor córas dea-chosanta, gan duine a bheith á threorú ag gach céim. Dá réir sin, chuireamar go mór lenár gcosaintí ar an tsamhail bearta cibearshlándála díobhálacha a dhéanamh, bíodh sé sin mar gheall ar mhí-úsáid nó ar mhí-ailíniú. Rinneamar bearta freisin chun forbairt agus cur in úsáid inmheánach Astra agus samhlacha comhchosúla a dhaingniú, lena n-áirítear leithlisiú níos déine, criptiú pointí seiceála, monatóireacht uileghabhálach ar chonairí iomlána lena n-áirítear slabhraí smaointeoireachta (CoT), agus próiseas meastóireachta ailínithe a chuireann bac ar úsáid inmheánach roimh ré.
  2. Tá GPT‑6 Astra i bhfad níos stóinsithe ná na samhlacha a tháinig roimhe. A bhuí le teicnící nua oiliúna sábháilteachta a neartaíonn stóinseacht, tá GPT‑6 Astra i bhfad níos stóinsithe in aghaidh jailbreakanna ná GPT‑5.6 Sol, fiú thar chonairí níos faide. Tá sé seo ar eolas againn ó thástálacha as líne agus ónár gclár dian tástála agus ceartúcháin jailbreakanna, go hinmheánach agus go seachtrach. I gcás úsáideoirí a mharcáiltear mar dhaoine a bhféadfadh ardriosca a bheith ag baint leo, chuireamar oiliúint bhreise ar an tsamhail chun a teorainn diúltaithe a choigeartú ar bhealach níos coimeádaí agus raon níos leithne rioscaí dé-úsáide a chumhdach. Bainimid úsáid as tástáil aischéimnithe lena chinntiú go seasann Astra in aghaidh jailbreakanna a aimsíodh i dtréimhsí tástála roimhe seo, agus rinneamar babhtaí nua de thástáil ionsaitheach uathoibrithe leis na hionsaitheoirí tástála ionsaithí inmheánacha is déanaí atá againn chun ár bhfeabhsuithe a dheimhniú.
  3. Tá GPT‑6 Astra ailínithe níos fearr ná GPT‑5.6 Sol. Is céim mhór chun cinn é Astra maidir le hailíniú samhla, agus cuimsíonn sé feabhsuithe ailínithe ó chomhdhéanamh ár sonraí réamhoiliúna go dtí an grádú a dhéanaimid le linn foghlaim atreisiúcháin. Tuairiscímid ar shraith nua meastóireachtaí ailínithe(osclaíonn i bhfuinneog nua), agus feicimid gur fearr a urramaíonn GPT‑6 Astra teorainneacha sábháilteachta agus slándála agus gur fearr a fhanann sé laistigh dá raon údaraithe. In ionsamhlúchán a d’úsáid níos mó ná 54,000 tasc inmheánach Codex(osclaíonn i bhfuinneog nua), fuair Astra thart ar leath an oiread marcálacha agus a fuair Sol as iompar mí-ailínithe níos tromchúisí.
  4. Tá monatóireacht ar mhí-ailíniú á cur i bhfeidhm againn go forleathan. Measaimid gurb é ailíniú samhla an príomhbhealach chun iompar mí-ailínithe féideartha ár samhlacha a chosc. Mar sin féin, tugann monatóireacht léargas leathan dúinn ar iompar samhlacha ceannródaíocha agus nochtann sí deiseanna chun an t-ailíniú agus an tsábháilteacht a fheabhsú tuilleadh. Ina theannta sin, is sraith bhreise cosanta í an mhonatóireacht ar iompar mí-ailínithe a bhraitear. Ar na cúiseanna sin, chuireamar monatóireacht ar mhí-ailíniú freisin le gach próiseas tátail a úsáideann uirlisí agus a bhaineann le cur in úsáid seachtrach Astra, rud a bhfuil costas suntasach ríomhaireachta ag baint leis. Tá an córas seo ar aon dul lenár leagan amach inmheánach.
  5. Tá inmhonatóireacht GPT‑6 Astra laghdaithe i gcomparáid le GPT‑5.6 Sol. Tá imscrúduithe suntasacha déanta againn ar inmhonatóireacht(osclaíonn i bhfuinneog nua) agus inrialaitheacht(osclaíonn i bhfuinneog nua) GPT‑6 Astra. Fuaireamar amach gur fearr is féidir le GPT‑6 Astra a CoT féin a rialú ná GPT‑5.6 Sol agus gur lú seans go gcuirfidh sé faisnéis ionchoiritheach ina CoT. I gcásanna sáraíochta, ina mbrúimid ar an tsamhail ár monatóirí a sheachaint, feicimid gur féidir leis an tsamhail fanacht gan bhrath agus í ag ligean síos go straitéiseach i meastóireachtaí (ag ligean síos), agus gur féidir léi ár monatóirí inmheánacha a sheachaint uaireanta nuair a iarrtar uirthi tascanna sabaitéireachta áirithe(osclaíonn i bhfuinneog nua) a dhéanamh. Ní fhacamar fianaise ar réasúnaíocht steaganagrafach CoT, mar shampla réasúnaíocht fholaithe a cheilt i ngnáth-théacs nach cosúil baint ar bith a bheith aige léi. Tugann sé sin le fios go bhféadfadh an riosca seachanta a bheith teoranta den chuid is mó do thascanna réasúnaíochta ar leibhéal níos ísle.
    • Tugann na torthaí seo le fios go bhféadfadh samhlacha d’aicme Astra ár monatóirí CoT a sheachaint faoi dhálaí sáraíochta. Faoi láthair, tá na torthaí seo bunaithe den chuid is mó ar mheastóireachtaí sáraíochta, is é sin nuair a threoraímid an tsamhail chun an mhonatóireacht a sheachaint. Tríd is tríd, áfach, léiríonn ár meastóireachtaí ailínithe gur lú seans go sáróidh Astra srianta slándála agus sábháilteachta ná GPT‑5.6 Sol.
    • Mar sin féin, tugaimid aird dáiríre ar an treocht, agus leanaimid orainn ag fiosrú na dtorthaí seo agus a n-impleachtaí don inmhonatóireacht de réir mar a éiríonn ár samhlacha níos cumasaí. Tá OpenAI tar éis oibriú chun monatóireacht ar shlabhra smaointeoireachta a chaomhnú agus a úsáid, agus tá caomhnú inmhonatóireacht CoT ina phríomhsprioc ag an gclár taighde. Mar sin féin, leagann na torthaí seo béim freisin ar a thábhachtaí atá sé teicnící iniúchta ailínithe a fhorbairt nach bhfuil teoranta do scrúdú a dhéanamh ar shlabhra smaointeoireachta na samhla.
  6. Déileálann GPT‑6 Astra ar bhealach níos freagraí le brabhsáil agus le timpeallachtaí oibre: Tá GPT‑6 Astra i bhfad níos stóinsithe in aghaidh instealltaí leideanna ná GPT‑5.6 Sol. Rinneamar tástáil freisin ar iompar na samhla i dtimpeallachtaí réalaíocha brabhsála agus ríomhaireachta gairmiúla. I gcomparáid le GPT‑5.6 Sol, is lú i bhfad an seans go ndéanfaidh an tsamhail bearta mí-ailínithe a d’fhéadfadh a bheith scriosach, amhail idirbhearta neamhúdaraithe, cailleadh sonraí, rochtain iomarcach nó dul timpeall ar rialuithe. Gníomhaíonn sé ar bhealach níos sábháilte freisin agus é ag láimhseáil iarrataí díobhálacha i gcásanna gníomhaireacha, amhail iarrataí ar chúnamh chun ionsaí foréigneach a phleanáil nó calaois a dhéanamh.
  7. Tá GPT‑6 Astra i bhfad níos sábháilte i gcásanna lena mbaineann riosca níos airde. Freagraíonn GPT‑6 Astra ar bhealach níos sábháilte ná GPT‑5.6 Sol d’iarrataí dúshlánacha ón táirgeadh agus ó thástáil ionsaitheach sáraíochta a rinne daoine. Baineann Astra feabhsú Pareto amach maidir le hiarrataí neamhshábháilte a chomhlíonadh go sábháilte agus diúltuithe neamhriachtanacha d’iarrataí neamhdhíobhálacha a sheachaint. Baineann na feabhsuithe seo freisin le cásanna ard-déine ina n-eascraíonn an riosca díobhála as an gcomhthéacs níos leithne seachas as iarraidh shainráite. Cuireann Astra teorainneacha sábháilteachta atá oiriúnach don aois i bhfeidhm ar bhealach níos comhsheasmhaí freisin d’úsáideoirí faoi bhun 18 mbliana d’aois.

Le haghaidh tuilleadh faisnéise, féach ar an gcárta córais iomlán(osclaíonn i bhfuinneog nua).