Gå direkt till huvudinnehåll
OpenAI

7 augusti 2026

Säkerhet

Vårt svar på nästa generations kritiska cyberförmågor

Laddar …

Cybersäkerheten förändras snabbt i takt med att modeller blir mer kapabla på sätt som både kan stärka cyberförsvaret och möjliggöra attacker med en hastighet och i en skala utan motstycke.

Interna utvärderingar som vi gjort de senaste dagarna av Astra, en av våra kommande modeller, visar betydande framsteg inom agentbaserad kodning och cybersäkerhet. Dessa resultat och expertutlåtanden gjorde att vi i går kväll drog slutsatsen att vi inte kan utesluta kritiska cyberförmågor enligt vårt Preparedness Framework(öppnas i ett nytt fönster).

Vi berättar detta eftersom vi anser att det är viktigt att vara öppna mot allmänheten och säkerhetsbranschen om denna möjliga förändring av förmågan.

Vi publicerade vårt Preparedness Framework för första gången i december 2023, långt innan modeller närmade sig förmågor på den här nivån inom biologi, kemi, cybersäkerhet och självförbättring av AI. Vi tog fram ramverket som vägledning för att identifiera framsteg i förmåga och planera vad företaget skulle göra när dessa förmågor växer fram. Tidigare modeller, däribland GPT‑5.6‑Sol, har utvärderats för banbrytande cyberförmågor och bedömts ligga på tröskelvärdet Hög (snarare än Kritisk).

Att mäta kritiska cybersäkerhetsförmågor 

Enligt vårt Preparedness Framework når en modell tröskelvärdet Kritisk inom cybersäkerhet om den utan mänsklig inblandning kan identifiera och utveckla fungerande nolldagsexploateringar av alla allvarlighetsgrader i många särskilt skyddade kritiska system i verklig drift, eller kan utforma och genomföra helt nya, heltäckande strategier för cyberattacker mot särskilt skyddade mål utifrån enbart ett övergripande önskat mål. 

Medan vi fortsätter att jämföra och bedöma modellen visar våra preliminära utvärderingar så goda resultat att vi för närvarande inte kan utesluta förmåga på nivån Kritisk. Astra är en kommande modell och var inte inblandad i exploateringen av Hugging Face. 

Åtgärder vi vidtar

Därför har vi utökat robusthetstestningen av våra skyddsåtgärder och säkerhetskontroller så att de lämpar sig för driftsättning av dessa förmågor. Internt har vi också vidtagit följande åtgärder för att vidareutvecklingen av modellen ska ske tryggt och säkert: 

  • Vi inför striktare säkerhetskontroller för modeller med större förmåga och tillhörande verksamhet, bland annat isolerade testmiljöer, begränsad åtkomst till nätverk och verktyg, starkare skydd och kryptering av modellvikter, utökade funktioner för övervakning och detektering samt körning i sandlådemiljö.
  • Vi pausar interna aktiviteter som rör Astra och ännu inte uppfyller dessa skärpta krav på säkerhetskontroller.
  • Vi har infört heltäckande övervakning av riskfyllda åtgärder och bristande målanpassning i alla agentbaserade tillämpningar av Astra, inklusive träning och utvärdering. Övervakningssystem granskar modellens tankegång och utlöser en säkerhetsrespons där högriskaktivitet granskas och avbryts.
  • Vi kommer att samarbeta med berörda myndigheter och utvalda organisationer för AI-säkerhet för att testa modellens förmågor.
  • Vi kommer att ge externa testpartner rekommendationer om säkerhetskontroller för att de ska kunna genomföra utvärderingar och arbetsbelastningar med högre risk på ett säkert sätt. 

Ramverket har redan väglett oss genom andra förändringar av förmågan. När våra modeller i juni 2025 närmade sig tröskelvärdet Hög för biologisk förmåga enligt Preparedness Framework beskrev vi de åtgärder vi vidtog för att stärka skyddsåtgärderna, utöka testningen, samarbeta med externa experter och införa ytterligare säkerhetskontroller. Vi tillämpar samma princip här.

Vi anser att avancerade modeller med cyberförmåga bör hjälpa försvarare att identifiera och åtgärda sårbarheter innan angripare hinner utnyttja dem. Vi är fast beslutna att samarbeta med regeringar, säkerhetsinstitut och civilsamhället för att säkerställa att de banbrytande förmågorna hos modeller som Astra och dess efterföljare tas i bruk ansvarsfullt och brett, till nytta för hela mänskligheten.

Författare

OpenAI