Forléargas sábháilteachta: GPT‑6 Astra
Inniu, táimid ag seoladh GPT‑6 Astra, an tsamhail is cumasaí dár chuireamar in úsáid go forleathan riamh. Is é Astra an chéad samhail dár gcuid a shroich leibhéal Criticiúil cumais chibearshlándála faoinár gCreat Ullmhachta.
Seo a leanas na rudaí is tábhachtaí atá le tuiscint faoi shábháilteacht an tseolta seo:
Is céim mhór chun cinn é GPT‑6 Astra ó thaobh cumais chibearshlándála de agus sásaíonn sé ár dtairseach Chriticiúil. Ciallaíonn sé sin gur féidir le GPT‑6 Astra, ach na huirlisí agus an rochtain cheart a bheith aige, lochtanna slándála nárbh eol dúinn roimhe seo a aimsiú agus bealaí nua a fhorbairt chun teacht i dtír orthu ar fud go leor córas dea-chosanta, gan duine a bheith á threorú ag gach céim. Dá réir sin, chuireamar go mór lenár gcosaintí ar an tsamhail bearta cibearshlándála díobhálacha a dhéanamh, bíodh sé sin mar gheall ar mhí-úsáid nó ar mhí-ailíniú. Rinneamar bearta freisin chun forbairt agus cur in úsáid inmheánach Astra agus samhlacha comhchosúla a dhaingniú, lena n-áirítear leithlisiú níos déine, criptiú pointí seiceála, monatóireacht uileghabhálach ar chonairí iomlána lena n-áirítear slabhraí smaointeoireachta (CoT), agus próiseas meastóireachta ailínithe a chuireann bac ar úsáid inmheánach roimh ré.
Tá GPT‑6 Astra i bhfad níos stóinsithe ná na samhlacha a tháinig roimhe. A bhuí le teicnící nua oiliúna sábháilteachta a neartaíonn stóinseacht, tá GPT‑6 Astra i bhfad níos stóinsithe in aghaidh jailbreakanna ná GPT‑5.6 Sol, fiú thar chonairí níos faide. Tá sé seo ar eolas againn ó thástálacha as líne agus ónár gclár dian tástála agus ceartúcháin jailbreakanna, go hinmheánach agus go seachtrach. I gcás úsáideoirí a mharcáiltear mar dhaoine a bhféadfadh ardriosca a bheith ag baint leo, chuireamar oiliúint bhreise ar an tsamhail chun a teorainn diúltaithe a choigeartú ar bhealach níos coimeádaí agus raon níos leithne rioscaí dé-úsáide a chumhdach. Bainimid úsáid as tástáil aischéimnithe lena chinntiú go seasann Astra in aghaidh jailbreakanna a aimsíodh i dtréimhsí tástála roimhe seo, agus rinneamar babhtaí nua de thástáil ionsaitheach uathoibrithe leis na hionsaitheoirí tástála ionsaithí inmheánacha is déanaí atá againn chun ár bhfeabhsuithe a dheimhniú.
Tá GPT‑6 Astra ailínithe níos fearr ná GPT‑5.6 Sol. Is céim mhór chun cinn é Astra maidir le hailíniú samhla, agus cuimsíonn sé feabhsuithe ailínithe ó chomhdhéanamh ár sonraí réamhoiliúna go dtí an grádú a dhéanaimid le linn foghlaim atreisiúcháin. Tuairiscímid ar shraith nua meastóireachtaí ailínithe(osclaíonn i bhfuinneog nua), agus feicimid gur fearr a urramaíonn GPT‑6 Astra teorainneacha sábháilteachta agus slándála agus gur fearr a fhanann sé laistigh dá raon údaraithe. In ionsamhlúchán a d’úsáid níos mó ná 54,000 tasc inmheánach Codex(osclaíonn i bhfuinneog nua), fuair Astra thart ar leath an oiread marcálacha agus a fuair Sol as iompar mí-ailínithe níos tromchúisí.
Tá monatóireacht ar mhí-ailíniú á cur i bhfeidhm againn go forleathan. Measaimid gurb é ailíniú samhla an príomhbhealach chun iompar mí-ailínithe féideartha ár samhlacha a chosc. Mar sin féin, tugann monatóireacht léargas leathan dúinn ar iompar samhlacha ceannródaíocha agus nochtann sí deiseanna chun an t-ailíniú agus an tsábháilteacht a fheabhsú tuilleadh. Ina theannta sin, is sraith bhreise cosanta í an mhonatóireacht ar iompar mí-ailínithe a bhraitear. Ar na cúiseanna sin, chuireamar monatóireacht ar mhí-ailíniú freisin le gach próiseas tátail a úsáideann uirlisí agus a bhaineann le cur in úsáid seachtrach Astra, rud a bhfuil costas suntasach ríomhaireachta ag baint leis. Tá an córas seo ar aon dul lenár leagan amach inmheánach.
Tá inmhonatóireacht GPT‑6 Astra laghdaithe i gcomparáid le GPT‑5.6 Sol. Tá imscrúduithe suntasacha déanta againn ar inmhonatóireacht(osclaíonn i bhfuinneog nua) agus inrialaitheacht(osclaíonn i bhfuinneog nua) GPT‑6 Astra. Fuaireamar amach gur fearr is féidir le GPT‑6 Astra a CoT féin a rialú ná GPT‑5.6 Sol agus gur lú seans go gcuirfidh sé faisnéis ionchoiritheach ina CoT. I gcásanna sáraíochta, ina mbrúimid ar an tsamhail ár monatóirí a sheachaint, feicimid gur féidir leis an tsamhail fanacht gan bhrath agus í ag ligean síos go straitéiseach i meastóireachtaí (ag ligean síos), agus gur féidir léi ár monatóirí inmheánacha a sheachaint uaireanta nuair a iarrtar uirthi tascanna sabaitéireachta áirithe(osclaíonn i bhfuinneog nua) a dhéanamh. Ní fhacamar fianaise ar réasúnaíocht steaganagrafach CoT, mar shampla réasúnaíocht fholaithe a cheilt i ngnáth-théacs nach cosúil baint ar bith a bheith aige léi. Tugann sé sin le fios go bhféadfadh an riosca seachanta a bheith teoranta den chuid is mó do thascanna réasúnaíochta ar leibhéal níos ísle.
Tugann na torthaí seo le fios go bhféadfadh samhlacha d’aicme Astra ár monatóirí CoT a sheachaint faoi dhálaí sáraíochta. Faoi láthair, tá na torthaí seo bunaithe den chuid is mó ar mheastóireachtaí sáraíochta, is é sin nuair a threoraímid an tsamhail chun an mhonatóireacht a sheachaint. Tríd is tríd, áfach, léiríonn ár meastóireachtaí ailínithe gur lú seans go sáróidh Astra srianta slándála agus sábháilteachta ná GPT‑5.6 Sol.
Mar sin féin, tugaimid aird dáiríre ar an treocht, agus leanaimid orainn ag fiosrú na dtorthaí seo agus a n-impleachtaí don inmhonatóireacht de réir mar a éiríonn ár samhlacha níos cumasaí. Tá OpenAI tar éis oibriú chun monatóireacht ar shlabhra smaointeoireachta a chaomhnú agus a úsáid, agus tá caomhnú inmhonatóireacht CoT ina phríomhsprioc ag an gclár taighde. Mar sin féin, leagann na torthaí seo béim freisin ar a thábhachtaí atá sé teicnící iniúchta ailínithe a fhorbairt nach bhfuil teoranta do scrúdú a dhéanamh ar shlabhra smaointeoireachta na samhla.
Déileálann GPT‑6 Astra ar bhealach níos freagraí le brabhsáil agus le timpeallachtaí oibre: Tá GPT‑6 Astra i bhfad níos stóinsithe in aghaidh instealltaí leideanna ná GPT‑5.6 Sol. Rinneamar tástáil freisin ar iompar na samhla i dtimpeallachtaí réalaíocha brabhsála agus ríomhaireachta gairmiúla. I gcomparáid le GPT‑5.6 Sol, is lú i bhfad an seans go ndéanfaidh an tsamhail bearta mí-ailínithe a d’fhéadfadh a bheith scriosach, amhail idirbhearta neamhúdaraithe, cailleadh sonraí, rochtain iomarcach nó dul timpeall ar rialuithe. Gníomhaíonn sé ar bhealach níos sábháilte freisin agus é ag láimhseáil iarrataí díobhálacha i gcásanna gníomhaireacha, amhail iarrataí ar chúnamh chun ionsaí foréigneach a phleanáil nó calaois a dhéanamh.
Tá GPT‑6 Astra i bhfad níos sábháilte i gcásanna lena mbaineann riosca níos airde. Freagraíonn GPT‑6 Astra ar bhealach níos sábháilte ná GPT‑5.6 Sol d’iarrataí dúshlánacha ón táirgeadh agus ó thástáil ionsaitheach sáraíochta a rinne daoine. Baineann Astra feabhsú Pareto amach maidir le hiarrataí neamhshábháilte a chomhlíonadh go sábháilte agus diúltuithe neamhriachtanacha d’iarrataí neamhdhíobhálacha a sheachaint. Baineann na feabhsuithe seo freisin le cásanna ard-déine ina n-eascraíonn an riosca díobhála as an gcomhthéacs níos leithne seachas as iarraidh shainráite. Cuireann Astra teorainneacha sábháilteachta atá oiriúnach don aois i bhfeidhm ar bhealach níos comhsheasmhaí freisin d’úsáideoirí faoi bhun 18 mbliana d’aois.
Le haghaidh tuilleadh faisnéise, féach ar an gcárta córais iomlán(osclaíonn i bhfuinneog nua).


