Përballja me avangardën e re të aftësive kritike kibernetike
Siguria kibernetike po ndryshon me shpejtësi, ndërsa modelet po bëhen më të afta në mënyra që mund të forcojnë mbrojtjen kibernetike, por edhe të mundësojnë sulme me shpejtësi dhe përmasa të paprecedenta.
Vlerësimet tona më të fundit të brendshme, të kryera gjatë ditëve të fundit për Astra-n, një nga modelet tona të ardhshme, tregojnë përparime të rëndësishme në kodimin agjentik dhe sigurinë kibernetike. Këto rezultate, së bashku me vlerësimet e ekspertëve, na çuan mbrëmë në përfundimin se, sipas Preparedness Framework(hapet në një dritare të re), nuk mund ta përjashtojmë mundësinë e aftësive kritike kibernetike.
Po e bëjmë publike këtë sepse besojmë se është e rëndësishme të jemi transparentë me publikun dhe komunitetet e sigurisë për këtë ndryshim të mundshëm të aftësive.
Preparedness Framework u publikua për herë të parë në dhjetor 2023, shumë përpara se modelet t’i afroheshin këtij niveli aftësish në biologji, kimi, siguri kibernetike dhe vetëpërmirësim të IA-së. E krijuam si udhëzues për të dalluar përparimin e aftësive dhe për të planifikuar më pas se çfarë do të bënte kompania jonë me shfaqjen e tyre. Modelet e mëparshme, përfshirë GPT‑5.6‑Sol, janë vlerësuar për aftësi kibernetike avangardë dhe janë klasifikuar në pragun High (jo Kritik).
Sipas Preparedness Framework, një model arrin pragun Kritik të sigurisë kibernetike nëse, pa ndërhyrje njerëzore, mund të identifikojë dhe zhvillojë shfrytëzime funksionale zero-day të çdo niveli rrezikshmërie në shumë sisteme kritike reale të përforcuara, ose nëse mund të hartojë dhe zbatojë nga fillimi në fund strategji të reja për sulme kibernetike ndaj objektivave të përforcuar, duke pasur vetëm një synim të përgjithshëm.
Ndërsa vazhdojmë testimin krahasues dhe vlerësimin e këtij modeli, rezultatet paraprake tregojnë një performancë aq të lartë sa, në këtë fazë, nuk mund ta përjashtojmë nivelin Kritik të aftësive. Astra është një model i ardhshëm dhe nuk u përfshi në shfrytëzimin e Hugging Face.
Për këtë arsye, kemi zgjeruar testimin e qëndrueshmërisë së masave tona mbrojtëse dhe kontrolleve të sigurisë, në mënyrë që të jenë të përshtatshme për vënien në përdorim të këtyre aftësive. Brenda kompanisë kemi marrë edhe masat e mëposhtme, në mënyrë që zhvillimi i mëtejshëm i këtij modeli të kryhet në mënyrë të sigurt:
- Po zbatojmë kontrolle më të rrepta sigurie për modelet me aftësi më të larta dhe veprimtaritë përkatëse, duke përfshirë mjedise të izoluara testimi, qasje të kufizuar në rrjet dhe mjete, mbrojtje dhe enkriptim më të fortë të peshave të modelit, aftësi shtesë monitorimi e zbulimi, si dhe ekzekutim në mjedise të izoluara.
- Po ndërpresim përkohësisht veprimtaritë e brendshme që përfshijnë Astra-n dhe që ende nuk i plotësojnë këto kërkesa të përforcuara të kontrollit të sigurisë.
- Kemi vendosur monitorim të përgjithshëm për veprimet e rrezikshme dhe mospërputhjen e objektivave në të gjitha zbatimet agjentike të Astra-s, përfshirë trajnimin dhe vlerësimin. Sistemet e monitorimit vlerësojnë zinxhirin e mendimit të modelit dhe aktivizojnë një reagim sigurie për të shqyrtuar dhe ndërprerë veprimtaritë me rrezik të lartë.
- Do të bashkëpunojmë me agjencitë përkatëse qeveritare dhe me organizata të përzgjedhura për sigurinë e IA-së, për të testuar aftësitë e këtij modeli.
- Partnerëve të jashtëm të testimit do t’u ofrojmë kontrolle sigurie të rekomanduara, në mënyrë që vlerësimet dhe ngarkesat e punës me rrezik më të lartë të kryhen në mënyrë të sigurt.
Preparedness Framework na ka udhëhequr tashmë gjatë kalimeve të tjera në nivele të reja aftësish. Në qershor 2025, ndërsa modelet tona po i afroheshin pragut High të aftësive biologjike sipas Preparedness Framework, ne paraqitëm masat që po merrnim për të forcuar masat mbrojtëse, zgjeruar testimin, bashkëpunuar me ekspertë të jashtëm dhe zbatuar kontrolle shtesë sigurie. Të njëjtin parim po zbatojmë edhe këtu.
Besojmë se modelet e përparuara me aftësi kibernetike duhet t’i ndihmojnë mbrojtësit t’i identifikojnë dhe korrigjojnë cenueshmëritë përpara se ta bëjnë sulmuesit. Jemi të angazhuar të punojmë përkrah qeverive, instituteve të sigurisë dhe shoqërisë civile, për të siguruar që aftësitë avangardë të modeleve si Astra dhe atyre që do të pasojnë të vihen në përdorim me përgjegjësi dhe në shkallë të gjerë, në dobi të mbarë njerëzimit.


