Inspelen op de volgende generatie kritieke cybercapaciteiten
Cyberbeveiliging verandert snel nu modellen steeds meer kunnen en daarmee zowel de cyberverdediging kunnen versterken als aanvallen op ongekende snelheid en schaal mogelijk kunnen maken.
Uit onze meest recente interne evaluaties van Astra, een van onze toekomstige modellen, van de afgelopen dagen blijkt aanzienlijke vooruitgang in agentic programmeren en cyberbeveiliging. Deze resultaten en beoordelingen van experts hebben ons er gisteravond toe gebracht te concluderen dat we kritieke cybercapaciteiten volgens ons Preparedness Framework niet kunnen uitsluiten(opent in een nieuw venster).
We delen dit omdat we het belangrijk vinden om tegenover het publiek en de veiligheids- en beveiligingsgemeenschappen transparant te zijn over deze mogelijke verschuiving in capaciteiten.
We publiceerden ons Preparedness Framework voor het eerst in december 2023, ruim voordat modellen dit niveau van biologische, chemische en cybercapaciteiten en zelfverbetering van AI naderden. We ontwikkelden het als leidraad om vooruitgang in capaciteiten te herkennen en vervolgens te bepalen wat ons bedrijf zou doen zodra die capaciteiten beschikbaar kwamen. Eerdere modellen, waaronder GPT‑5.6‑Sol, zijn geëvalueerd op grensverleggende cybercapaciteiten en ingeschaald op de drempel Hoog, in plaats van Kritiek.
Volgens ons Preparedness Framework bereikt een model de cyberbeveiligingsdrempel Kritiek als het zonder menselijke tussenkomst werkende zero-day-exploits van elk ernstniveau kan vinden en ontwikkelen voor veel goed beveiligde, kritieke praktijksystemen, of als het met alleen een globaal gewenst doel volledig nieuwe, integrale strategieën voor cyberaanvallen op goed beveiligde doelen kan bedenken en uitvoeren.
Terwijl we dit model blijven benchmarken en beoordelen, wijzen onze voorlopige evaluaties op zulke sterke prestaties dat we het capaciteitsniveau Kritiek momenteel niet kunnen uitsluiten. Astra is een toekomstig model en is niet gebruikt om Hugging Face te compromitteren.
Daarom hebben we de robuustheidstests van onze beveiligingsmaatregelen en -controles opgeschaald, zodat die geschikt zijn voor de implementatie van deze capaciteiten. Intern hebben we ook de volgende maatregelen genomen om de verdere ontwikkeling van dit model veilig en goed beveiligd te laten verlopen:
- We voeren strengere beveiligingscontroles in voor modellen met meer capaciteiten en de bijbehorende activiteiten. Daartoe behoren geïsoleerde testomgevingen, beperkte toegang tot netwerken en tools, betere bescherming en versleuteling van modelgewichten, aanvullende monitoring- en detectiemogelijkheden en uitvoering in een sandbox.
- We onderbreken interne activiteiten met Astra die nog niet aan deze aangescherpte beveiligingseisen voldoen.
- We hebben voor alle agentische toepassingen van Astra, waaronder training en evaluatie, integrale monitoring ingevoerd voor riskante handelingen en gebrekkige afstemming. Monitoringsystemen beoordelen de gedachtegang van het model en activeren een beveiligingsprocedure om activiteiten met een hoog risico te onderzoeken en te onderbreken.
- We gaan met relevante overheidsinstanties en geselecteerde organisaties voor AI-veiligheid samenwerken om de capaciteiten van dit model te testen.
- We zullen externe testpartners aanbevolen beveiligingscontroles bieden om evaluaties en workloads met een hoger risico veilig uit te voeren.
Het framework heeft ons al door andere overgangen in capaciteiten geleid. Toen onze modellen in juni 2025 volgens het Preparedness Framework de capaciteitsdrempel Hoog voor biologie naderden, hebben we de maatregelen beschreven die we namen om waarborgen te versterken, tests uit te breiden, met externe experts samen te werken en aanvullende beveiligingscontroles in te voeren. Hier passen we hetzelfde principe toe.
Wij vinden dat geavanceerde modellen met cybercapaciteiten verdedigers moeten helpen kwetsbaarheden te vinden en verhelpen voordat aanvallers dat doen. We blijven ons inzetten voor samenwerking met overheden, veiligheidsinstituten en het maatschappelijk middenveld om ervoor te zorgen dat de grensverleggende capaciteiten van modellen zoals Astra en hun opvolgers verantwoord en breed worden ingezet ten behoeve van de hele mensheid.


