Siirry pääsisältöön
OpenAI

7. elokuuta 2026

Turvallisuus

Varautuminen kriittisten kybervalmiuksien seuraavaan vaiheeseen

Ladataan...

Kyberturvallisuus muuttuu nopeasti mallien kehittyessä yhä kyvykkäämmiksi tavoilla, jotka voivat sekä vahvistaa kyberpuolustusta että mahdollistaa ennennäkemättömän nopeat ja laajamittaiset hyökkäykset.

Viime päivinä tekemämme Astran, yhden tulevista malleistamme, uusimmat sisäiset arvioinnit osoittavat agenttipohjaisen koodauksen ja kyberturvallisuuden kehittyneen merkittävästi. Näiden tulosten ja asiantuntija-arvioiden perusteella päädyimme viime yönä siihen, ettemme voi sulkea pois kriittisiä kybervalmiuksia Valmiuskehyksemme(avautuu uudessa ikkunassa) mukaisesti.

Kerromme tästä, koska pidämme tärkeänä avoimuutta yleisölle sekä turvallisuusyhteisöille tästä mahdollisesta valmiuksien muutoksesta.

Julkaisimme Valmiuskehyksemme ensimmäisen kerran joulukuussa 2023, hyvissä ajoin ennen kuin mallit lähestyivät tämän tason biologisia, kemiallisia ja kyberturvallisuuteen liittyviä valmiuksia sekä kykyä kehittää tekoälyä itsenäisesti. Loimme kehyksen auttamaan valmiuksien kehittymisen tunnistamisessa ja suunnittelemaan, miten yrityksemme toimii uusien valmiuksien ilmaantuessa. Aiempien mallien, kuten GPT‑5.6‑Solin, edistyneet kybervalmiudet on arvioitu Korkea-tasolle Kriittinen-tason sijaan.

Kriittisten kyberturvallisuusvalmiuksien mittaaminen 

Valmiuskehyksemme mukaan malli saavuttaa kyberturvallisuuden kriittisen kynnystason, jos se pystyy ilman ihmisen apua tunnistamaan ja kehittämään toimivia, kaikentasoisia nollapäivähyväksikäyttömenetelmiä moniin suojattuihin, todellisiin kriittisiin järjestelmiin tai laatimaan ja toteuttamaan kokonaan uusia, kattavia kyberhyökkäysstrategioita suojattuja kohteita vastaan pelkän yleisluonteisen tavoitteen pohjalta. 

Jatkamme mallin vertailutestausta ja arviointia, mutta alustavissa arvioinneissamme sen suorituskyky on ollut niin vahva, ettemme voi tällä hetkellä sulkea pois kriittistä valmiustasoa. Astra on tuleva malli, eikä se osallistunut Hugging Facen hyväksikäyttöön. 

Toteuttamamme toimet

Olemme siksi laajentaneet suojatoimiemme ja turvallisuusjärjestelyjemme kestävyystestausta varmistaaksemme, että ne soveltuvat näiden valmiuksien käyttöönottoon. Olemme myös toteuttaneet sisäisesti seuraavat toimet, jotta mallin jatkokehitys tapahtuu turvallisesti: 

  • Otamme käyttöön tiukemmat turvallisuusjärjestelyt kyvykkäämmille malleille ja niihin liittyvälle toiminnalle. Niihin kuuluvat eristetyt testiympäristöt, rajoitettu verkko- ja työkalupääsy, mallin painojen tehostettu suojaus ja salaus, täydentävät valvonta- ja tunnistusominaisuudet sekä suorittaminen hiekkalaatikossa.
  • Keskeytämme Astraan liittyvät sisäiset toimet, jotka eivät vielä täytä näitä tiukennettuja turvallisuusvaatimuksia.
  • Olemme ottaneet käyttöön kaikkien Astran agenttipohjaisten käyttötapojen, myös koulutuksen ja arvioinnin, kattavan valvonnan riskialttiiden toimien ja tavoitteiden vastaisen käyttäytymisen varalta. Valvontajärjestelmät arvioivat mallin Chain of Thought -päättelyä ja käynnistävät turvallisuustoimet riskialttiin toiminnan tarkistamiseksi ja keskeyttämiseksi.
  • Teemme yhteistyötä asianomaisten viranomaisten ja valittujen tekoälyturvallisuusorganisaatioiden kanssa mallin valmiuksien testaamiseksi.
  • Annamme ulkopuolisille testauskumppaneille suositukset turvallisuusjärjestelyistä, joiden avulla suuremman riskin arvioinnit ja työkuormat voidaan suorittaa turvallisesti. 

Kehys on jo ohjannut meitä muissa valmiuksien siirtymävaiheissa. Kun mallimme lähestyivät kesäkuussa 2025 Valmiuskehyksen biologisten valmiuksien korkeaa kynnystasoa, esittelimme toteuttamamme toimet suojatoimien vahvistamiseksi, testauksen laajentamiseksi, ulkopuolisten asiantuntijoiden kanssa työskentelemiseksi ja täydentävien turvallisuusjärjestelyjen käyttöönottamiseksi. Sovellamme tässä samaa periaatetta.

Uskomme, että edistyneitä kybervalmiuksia sisältävien mallien pitäisi auttaa puolustajia tunnistamaan ja korjaamaan haavoittuvuudet ennen hyökkääjiä. Olemme sitoutuneet työskentelemään hallitusten, turvallisuusinstituuttien ja kansalaisyhteiskunnan kanssa varmistaaksemme, että Astran kaltaisten mallien ja niiden seuraajien edistyneet valmiudet otetaan käyttöön vastuullisesti ja laajasti koko ihmiskunnan hyödyksi.

Tekijä

OpenAI