Lumaktaw sa pangunahing content
OpenAI

Agosto 7, 2026

Seguridad

Pagtugon sa susunod na frontier ng kritikal na kakayahang cyber

Naglo-load…

Mabilis na nagbabago ang cybersecurity habang lalong humuhusay ang mga modelo sa mga paraang maaaring magpatibay sa mga depensang pansiber at magbigay-daan sa mga pag-atake sa bilis at lawak na hindi pa nararanasan noon.

Ipinapakita ng aming pinakabagong mga panloob na pagsusuri nitong nakaraang ilang araw sa Astra, isa sa aming mga paparating na modelo, ang malalaking pagsulong sa agentic coding at cybersecurity. Dahil sa mga resultang ito at sa mga pagtatasa ng mga eksperto, napagpasyahan namin kagabi na hindi namin maaaring isantabi ang posibilidad ng kritikal na kakayahang pansiber sa ilalim ng aming Preparedness Framework(magbubukas sa bagong window).

Ibinabahagi namin ito dahil naniniwala kaming mahalagang maging bukas sa publiko at sa mga komunidad ng kaligtasan at seguridad tungkol sa posibleng pagbabagong ito sa mga kakayahan.

Una naming inilathala ang Preparedness Framework noong Disyembre 2023, bago pa man nalapit ang mga modelo sa ganitong antas ng kakayahan sa biology, chemistry, cybersecurity, at sariling pagpapahusay ng AI. Binuo namin ito bilang gabay sa pagtukoy ng pag-unlad sa kakayahan at sa pagpaplano ng gagawin ng aming kumpanya habang lumilitaw ang mga kakayahang iyon. Sinuri ang mga naunang modelo, kabilang ang GPT‑5.6‑Sol, para sa mga frontier na kakayahang pansiber at tinaya ang mga ito sa threshold na Mataas (sa halip na Kritikal).

Pagsukat sa mga kritikal na kakayahan sa cybersecurity 

Sa ilalim ng aming Preparedness Framework, naaabot ng isang modelo ang Kritikal na threshold sa cybersecurity kung kaya nitong tukuyin at bumuo ng gumaganang mga zero-day exploit sa lahat ng antas ng kalubhaan para sa maraming pinatibay na kritikal na sistema sa totoong mundo nang walang tulong ng tao, o kaya nitong magplano at magsagawa ng mga bago at kumpletong estratehiya para sa mga cyberattack laban sa mga pinatibay na target batay lamang sa isang pangkalahatang layunin. 

Habang patuloy naming sinusukat at tinataya ang modelong ito, ipinapakita ng aming mga paunang pagsusuri na sapat ang husay nito upang hindi namin maisantabi sa ngayon ang antas ng Kritikal na kakayahan. Paparating pa lamang na modelo ang Astra, at hindi ito sangkot sa pag-exploit sa Hugging Face. 

Mga hakbang na ginagawa namin

Dahil dito, pinalawak namin ang pagsusuri sa tibay ng aming mga pananggalang at kontrol sa seguridad upang maging angkop ang mga ito sa pag-deploy ng ganitong mga kakayahan. Sa loob ng kumpanya, ginawa rin namin ang mga sumusunod na hakbang upang matiyak na ligtas at secure ang patuloy na pagbuo sa modelong ito: 

  • Nagpapatupad kami ng mas mahihigpit na kontrol sa seguridad para sa mga modelong may mas mataas na kakayahan at mga kaugnay na aktibidad, kabilang ang mga nakahiwalay na testing environment, limitadong access sa network at mga tool, pinahusay na proteksiyon at encryption para sa mga weight ng modelo, karagdagang kakayahan sa pagsubaybay at pagtukoy, at pagpapatakbo sa sandbox.
  • Pansamantala naming itinitigil ang mga panloob na aktibidad na may kinalaman sa Astra na hindi pa nakatutugon sa mas mahihigpit na kinakailangang kontrol sa seguridad.
  • Nagpatupad kami ng pangkalahatang pagsubaybay sa mga mapanganib na pagkilos at misalignment sa lahat ng agentic na paggamit ng Astra, kabilang ang pagsasanay at pagsusuri. Sinusuri ng mga monitoring system ang Chain of Thought ng modelo at nagti-trigger ng pagtugon sa seguridad upang repasuhin at ihinto ang mga aktibidad na may mataas na panganib.
  • Makikipagtulungan kami sa mga kaugnay na ahensiya ng pamahalaan at piling organisasyon para sa kaligtasan ng AI upang subukan ang mga kakayahan ng modelong ito.
  • Magbibigay kami sa mga third-party testing partner ng mga inirerekomendang kontrol sa seguridad upang ligtas nilang maisagawa ang mga pagsusuri at workload na may mas mataas na panganib. 

Naging gabay na namin ang framework sa iba pang mga pagbabago sa antas ng kakayahan. Noong Hunyo 2025, habang papalapit ang aming mga modelo sa mataas na threshold ng kakayahan sa biology sa ilalim ng Preparedness Framework, inilahad namin ang mga hakbang na ginagawa namin upang patibayin ang mga pananggalang, palawakin ang pagsusuri, makipagtulungan sa mga panlabas na eksperto, at magpatupad ng mga karagdagang kontrol sa seguridad. Inilalapat namin dito ang parehong prinsipyo.

Naniniwala kami na dapat tulungan ng mga advanced na modelong may kakayahang pansiber ang mga tagapagtanggol na matukoy at matugunan ang mga kahinaan bago pa ito magawa ng mga umaatake. Nakatuon kaming makipagtulungan sa mga pamahalaan, institusyon para sa kaligtasan, at civil society upang matiyak na responsable at malawakang ide-deploy ang mga frontier na kakayahan ng mga modelo tulad ng Astra at ng mga susunod dito, para sa kapakinabangan ng buong sangkatauhan.

May-akda

OpenAI