Viðbrögð við næsta stigi mikilvægrar netgetu
Netöryggi breytist hratt eftir því sem líkön verða öflugri, með getu sem getur bæði eflt netvarnir og gert árásir mögulegar á áður óþekktum hraða og í áður óþekktum mæli.
Nýjasta innra mat okkar undanfarna daga á Astra, einu væntanlegra líkana okkar, bendir til verulegra framfara í fulltrúakóðun og netöryggi. Þessar niðurstöður og mat sérfræðinga urðu til þess að við komumst að þeirri niðurstöðu í gærkvöldi að við getum ekki útilokað mikilvæga netgetu samkvæmt Undirbúningsramma(opnast í nýjum glugga) okkar.
Við greinum frá þessu vegna þess að við teljum mikilvægt að sýna almenningi og samfélögum á sviði öryggis og netvarna gagnsæi um þessa mögulegu breytingu á getu.
Við birtum Undirbúningsramma okkar fyrst í desember 2023, löngu áður en líkön nálguðust þetta getustig í líffræði, efnafræði, netöryggi og sjálfsbetrun gervigreindar. Við útbjuggum rammann til að leiðbeina okkur við að greina framfarir í getu og skipuleggja síðan viðbrögð fyrirtækisins þegar þessi geta kæmi fram. Fyrri líkön, þar á meðal GPT‑5.6‑Sol, hafa verið metin með tilliti til netgetu sem er framarlega í þróun og talin ná viðmiðinu Hátt (en ekki Krítískt).
Samkvæmt Undirbúningsramma okkar nær líkan viðmiðinu Krítískt í netöryggi ef það getur án mannlegrar íhlutunar fundið og þróað virkar nýtingaraðferðir fyrir núlldagsveikleika af öllum alvarleikastigum í mörgum vel vörðum, mikilvægum raunverulegum kerfum, eða mótað og framkvæmt frá upphafi til enda nýstárlegar netárásaráætlanir gegn vel vörðum skotmörkum út frá einungis almennu markmiði.
Þótt við höldum áfram að viðmiða og meta þetta líkan sýnir bráðabirgðamat okkar nægilega öfluga frammistöðu til að við getum ekki útilokað getustigið Krítískt að svo stöddu. Astra er væntanlegt líkan og kom ekki að árásinni á Hugging Face.
Í samræmi við það höfum við aukið álagsprófanir á varúðarráðstöfunum og öryggisstýringum okkar svo þær hæfi innleiðingu þessarar getu. Við höfum einnig gripið til eftirfarandi innri ráðstafana svo frekari þróun líkansins fari fram með öruggum hætti:
- Við innleiðum strangari öryggisstýringar fyrir öflugri líkön og tengda starfsemi, þar á meðal einangrað prófunarumhverfi, takmarkaðan aðgang að neti og verkfærum, aukna vernd og dulkóðun líkanavoga, frekari eftirlits- og greiningargetu og keyrslu í sandkassa.
- Við gerum hlé á innri starfsemi sem tengist Astra og uppfyllir ekki enn þessar hertu kröfur um öryggisstýringar.
- Við höfum innleitt allsherjareftirlit með áhættusömum aðgerðum og misræmi í allri sjálfstýrðri notkun Astra, þar á meðal við þjálfun og mat. Eftirlitskerfi meta rökleiðsluferli líkansins og kalla fram öryggisviðbrögð til að yfirfara og stöðva áhættusama starfsemi.
- Við munum vinna með viðeigandi opinberum stofnunum og völdum samtökum á sviði öryggis gervigreindar að prófun á getu líkansins.
- Við munum láta utanaðkomandi prófunaraðilum í té ráðlagðar öryggisstýringar svo þeir geti framkvæmt áhættumeira mat og vinnsluálag með öruggum hætti.
Ramminn hefur þegar leiðbeint okkur í gegnum aðrar breytingar á getu. Í júní 2025, þegar líkön okkar nálguðust viðmiðið Hátt fyrir líffræðilega getu samkvæmt Undirbúningsrammanum, lýstum við ráðstöfunum okkar til að efla varnir, auka prófanir, vinna með utanaðkomandi sérfræðingum og innleiða frekari öryggisstýringar. Við beitum sömu meginreglu hér.
Við teljum að háþróuð líkön með netgetu eigi að hjálpa varnaraðilum að finna og lagfæra veikleika áður en árásaraðilar nýta þá. Við einsetjum okkur að vinna með stjórnvöldum, öryggisstofnunum og borgarasamfélaginu að því að tryggja að geta líkana á borð við Astra, sem eru framarlega í þróun, og þeirra sem á eftir koma verði innleidd á ábyrgan og víðtækan hátt öllu mannkyni til hagsbóta.


