Fara beint í aðalefni
OpenAI

26. júní 2026

VaraSlepping

Forskoðun á GPT‑5.6 Sol: næstu kynslóðar líkan

Hleður inn...

Við hefjum takmarkaða forskoðun á GPT‑5.6‑röðinni: Sol, flaggskipslíkani okkar; Terra, jafnvægnu líkani fyrir dagleg störf; og Luna, hröðu og hagkvæmu líkani. Terra nær samkeppnishæfri frammistöðu á við GPT‑5.5 en er 2x ódýrara, og Luna skilar sterkri getu á lægsta kostnaði okkar.

GPT‑5.6 Sol kemur út með traustasta öryggisstafla okkar til þessa. Við styrktum varnir fyrir áhættumeiri virkni, viðkvæmar netöryggisbeiðnir og endurtekna misnotkun, og vörðum nokkrum vikum í að finna veikleika, álagsprófa kerfið okkar og herða það gegn raunverulegum árásum.

Við trúum á víðtækan aðgang og ætlum að gera GPT‑5.6 Sol, Terra og Luna almennt aðgengileg á næstu vikum. Sem hluta af áframhaldandi samstarfi okkar við bandarísk stjórnvöld kynntum við áætlanir okkar og getu líkananna fyrir útgáfuna í dag. Að þeirra beiðni byrjum við á takmarkaðri forskoðun fyrir lítinn hóp traustra samstarfsaðila, þar sem þátttaka þeirra hefur verið kynnt stjórnvöldum, áður en útgáfan verður víðtækari. Á meðan á þessari forskoðun stendur höldum við áfram prófunum og nánu samráði við samstarfsaðila á leið okkar að víðtækara aðgengi. Við teljum ekki að aðgangsferli stjórnvalda af þessu tagi eigi að verða sjálfgefin langtímaleið. Það heldur bestu verkfærunum frá notendum, þróunaraðilum, fyrirtækjum, netvörnum og alþjóðlegum samstarfsaðilum sem þurfa á þeim að halda. Við tökum þetta skammtímaskref vegna þess að við teljum það sterkustu leiðina að víðtækara aðgengi á næstu vikum, á meðan við vinnum með ríkisstjórninni að því að móta ramma forsetatilskipunarinnar um netöryggi og endurtekanlegt ferli fyrir framtíðarútgáfur líkana.

Geta

GPT‑5.6 Sol er sterkasta líkanið okkar hingað til. Til að gefa forskoðun á frammistöðu líkansins deilum við safni mata sem varpa ljósi á bætta sjálfstæða verkgetu í forritun, líffræði og netöryggi, en viðbótaröryggis- og undirbúningsmöt eru aðgengileg í kerfiskorti(opnast í nýjum glugga) okkar. Við munum deila víðtækara safni matsniðurstaðna þegar við gerum líkanið víða aðgengilegt.

Með GPT‑5.6 kynnum við nýja `max` rökáreynslu til að gefa Sol mestan tíma til að rökstyðja djúpt. Auk þess kynnum við nýjan `ultra` ham sem fer út fyrir getu eins fulltrúa með því að nýta undirfulltrúa til að hraða flókinni vinnu.

Í forritunarverkflæðum setur GPT‑5.6 Sol ný viðmið á Terminal‑Bench 2.1, sem prófar skipanalínuverkflæði sem krefjast áætlanagerðar, ítrunar og samhæfingar verkfæra.

GPT‑5.6 Sol sýnir einnig víðtækar framfarir í líffræðiverkflæðum. Á GeneBench v1, sem metur erfðamengisgreiningar og megindlegar líffræðigreiningar yfir langan tíma, nær það betri árangri en GPT‑5.5 og notar færri tóka.

GPT‑5.6 Sol er öflugasta líkanið okkar hingað til fyrir netöryggi. Það færir mörk frammistöðu og skilvirkni í langvinnum öryggisverkefnum, þar á meðal rannsóknum á veikleikum og nýtingu þeirra. Á ExploitBench² er GPT‑5.6 Sol samkeppnishæft við Mythos Preview og notar aðeins um ~1/3 af úttakstókum. Á ExploitGym(opnast í nýjum glugga)3, viðmiði sem rannsakendur við UC Berkeley bjuggu til í samstarfi við OpenAI og aðrar jaðarrannsóknarstofur, sýna GPT‑5.6 Sol-, Terra- og Luna-líkönin öll miklar framfarir í netöryggisgetu eftir því sem við aukum rök.

Sterkari netöryggisgeta með sterkari öryggisráðstöfunum

Við þróuðum GPT‑5.6 Sol, Terra og Luna með traustustu öryggisráðstöfunum okkar til þessa, með stillingum sem passa við getu hvers líkans. Eftir því sem líkanið verður hæfara hönnum við öryggisráðstafanir sem standast sífellt betur raunverulegan andstæðingsþrýsting, um leið og við varðveitum aðgang að lögmætri vinnu á borð við kóðayfirferð, veikleikarannsóknir, þróun plástra, aflúsun, öryggisfræðslu og varnarprófanir. Markmið okkar er að gera bannaða sóknarvirkni erfiðari, óvissari og greinanlegri án þess að takmarka þessi gagnlegu not að óþörfu. Byggt á mati okkar á líkaninu og öryggisráðstöfunum væntum við verulegs ávinnings fyrir lögmæta varnarvinnu, um leið og við þrengjum verulega að bannaðri sóknarnotkun.

GPT‑5.6 Sol er betra í að hjálpa fólki að finna og laga veikleika en að framkvæma heildstæðar árásir með áreiðanlegum hætti. Eftir því sem þessi geta heldur áfram að þróast er forgangsverkefni okkar að tryggja að hún nái til og gagnist varnaraðilum, sem geta notað þessi verkfæri til að finna veikleika, þróa plástra og styrkja kerfi almennt.

GPT‑5.6 Sol fer ekki yfir Cyber Critical-þröskuldinn samkvæmt Preparedness Framework okkar. Í mötum sem vörðuðu Chromium og Firefox greindi það villur og nýtingarfrumeiningar—byggingareiningar árásar—en bjó ekki sjálfstætt til virka fullkeðjuárás við þær aðstæður sem prófaðar voru. Samt geta viðmiðunarþröskuldar ekki náð utan um alla þá vegu sem líkan kann að vera notað eða sameinað öðrum verkfærum. Þessi óvissa, ásamt víðtækara stökki í getu líkansins, er ástæðan fyrir því að við pöruðum aukna getu líkansins við sterkari öryggisráðstafanir og áfangaskipta útgáfu. Við deilum frekari upplýsingum um öryggisráðstafanir okkar í GPT‑5.6 Preview-kerfiskortinu(opnast í nýjum glugga).

Lagskiptur öryggisstafli

Engin ein öryggisráðstöfun dugar gegn staðráðinni eða aðlögunarhæfri misnotkun. Í allri GPT‑5.6-forskoðuninni notum við lagskiptar öryggisráðstafanir, þar sem nákvæmar stillingar eru mismunandi milli líkana, og álagsprófum þær gegn raunverulegum árásum. Þær fela meðal annars í sér varnir sem þjálfaðar eru inn í líkanið, rauntímaathuganir meðan á myndun stendur, merki á reikningsstigi, aðgreindan aðgang, vöktun, framfylgd og áframhaldandi prófanir.

GPT‑5.6 er þjálfað til að hafna bannaðri netöryggisaðstoð, einnig þegar notendur reyna að dylja ásetning sinn eða komast fram hjá öryggisvörnum líkansins. Þessar öryggisráðstafanir á líkansstigi setja fyrstu mörkin um það sem líkanið á og á ekki að aðstoða við.

Rauntímaflokkarar fyrir misnotkun í netöryggi og líffræði veita annað lag með því að meta úttak jafnóðum og það er myndað. Í áhættumeiri tilvikum, ef þeir greina mögulegt brot, kann myndun að vera stöðvuð tímabundið á meðan stærra rakalíkan fer yfir samtalið og samhengi þess. Ef úttakið er metið óheimilt er því haldið eftir áður en það nær til notandans.

Merkt virkni getur einnig kallað á yfirferð á reikningsstigi yfir viðeigandi samtöl og áhættumerki, í samræmi við skilmála okkar og stefnur um varðveislu og yfirferð efnis. Með því að horfa út fyrir eitt samtal hjálpum við kerfum okkar að greina viðvarandi illgjarna hegðun frá lögmætri tvíþættri öryggisvinnu, þar sem svipuð tæknileg hugtök geta birst í mjög ólíku samhengi.

Saman gera þessi lög heildarnálgunina traustari en nokkur ein öryggisráðstöfun út af fyrir sig. Hegðun líkansins dregur úr líkum á skaðlegum svörum, rauntímakerfi geta gripið inn í meðan á myndun stendur, yfirferð á reikningsstigi getur greint víðtækari mynstur og aðgreindur aðgangur varðveitir mikilvæga varnarvinnu án þess að gera viðkvæmustu getuna víða aðgengilega sjálfkrafa.

Sérstaklega á forskoðunartímabilinu geta notendur rekist á öryggisráðstafanir sem loka á eða hafna sumum beiðnum. Aðrar beiðnir kunna að taka lengri tíma vegna þess að myndun er stöðvuð tímabundið fyrir viðbótarúttekt. Öryggisráðstafanir kunna stundum að grípa inn í lögmæta vinnu, sérstaklega á tvíþættum sviðum þar sem varnar- og sóknarvirkni getur í fyrstu litið svipað út.

Það er hluti af því sem forskoðuninni er ætlað að prófa. Við viljum skilja ekki aðeins hvort öryggisráðstafanirnar hefti misnotkun, heldur einnig hvort lögmætir notendur geti enn lokið venjulegri vinnu með áreiðanlegum og skilvirkum hætti. Endurgjöf á forskoðunartímabilinu mun hjálpa okkur að draga úr óþarfa lokunum og töfum, bæta hvernig öryggisráðstafanir túlka samhengi og skapa sléttari upplifun fyrir víðtækari útgáfu.

Við vinnum einnig með fyrirtækjaviðskiptavinum að langtímanálgunum—þar á meðal greiningu sem verndar friðhelgi, öryggisstýringum sem viðskiptavinir reka sjálfir og aðgangi sem er stilltur eftir áhættu viðskiptavinar, notanda eða vinnuálags—til að efla öryggi samhliða því að styðja við friðhelgiskröfur fyrirtækja.

Aukinn viðnámsþróttur með sjálfvirkri red-teaming

Öryggisráðstafanir þurfa líka að haldast árangursríkar þegar árásaraðilar aðlaga aðferðir sínar. Vörn sem virkar aðeins gegn föstu safni þekktra árása er ekki nógu traust fyrir jaðarlíkan.

Þess vegna beitum við meiri greind og reikniafli en nokkru sinni fyrr til öryggis, með því að nota eigin líkön til að finna veikleika og bæta varnir hraðar. Við vörðum yfir 700.000 A100-jafngildum GPU-klukkustundum í sjálfvirka red-teaming til að finna almennar öryggissniðgöngur: árásir sem geta virkað yfir margar kvaðningar eða samhengi, ekki bara í einu afmörkuðu tilviki. Með því að einbeita okkur að þessum erfiðari og almennari árásum gátum við prófað öryggisráðstafanirnar umfram fast safn þekktra bilana. Það gerir okkur líka kleift að kanna miklu fleiri árásarmynstur en mannleg prófun ein og sér gæti náð yfir, greina bilunarmynstur fyrr og stytta leiðina frá því að finna veikleika til þess að bregðast við honum.

Auk sjálfvirkrar red-teaming unnum við með prófurum frá þriðja aðila að umfangsmikilli mannlegri sérfræðinga-red-teaming, sem heldur áfram á forskoðunartímabilinu. Mannleg red-teaming bætir sjálfvirku vinnuna upp með því að prófa öryggisráðstafanir gegn skapandi sérfræðingum sem reyna að misnota líkanið á hátt sem kerfin okkar sjá kannski ekki fyrir.

Ekkert mat getur endurspeglað allar vörustillingar, fjölþrepa árásir eða raunveruleg verkflæði. Þess vegna höldum við uppi hraðviðbragðsferli til að endurskapa, meta, forgangsraða og laga nýuppgötvaðar öryggissniðgöngur og bæta þeim síðan við áframhaldandi mat okkar svo við getum prófað gegn svipuðum bilunum í framtíðinni.

Aðgengi og verðlagning

Á forskoðunartímabilinu verða GPT‑5.6-líkönin í fyrstu aðgengileg í gegnum API og Codex fyrir valinn hóp traustra samstarfsaðila og stofnana. Við áætlum að gera þau bráðlega aðgengilegri fyrir fólk sem notar ChatGPT, Codex og API.

Í þessu nýja nafnakerfi, sem kynnt er með GPT‑5.6, auðkennir talan kynslóð líkansins, en Sol, Terra og Luna auðkenna varanleg getustig sem geta þróast á eigin hraða. Saman veitir fjölskyldan fólki og þróunaraðilum skýrari valkosti hvað varðar greind, hraða og kostnað.

GPT‑5.6 er verðlagt á hverjar 1M tóka í þremur líkansstærðum: Sol er $5 fyrir inntak / $30 fyrir úttak; Terra er $2.50 fyrir inntak / $15 fyrir úttak; og Luna er $1 fyrir inntak / $6 fyrir úttak. GPT‑5.6 kynnir einnig fyrirsjáanlegri skyndiminnisvistun kvaðninga, þar á meðal stuðning við skýr skyndiminnisrof og 30 mínútna lágmarkslíftíma skyndiminnis. Fyrir GPT‑5.6 og síðari líkön eru skyndiminnisskrifanir gjaldfærðar á 1,25x óskyndiminnt inntaksgjald líkansins, en skyndiminnislestur fær áfram 90% afslátt af skyndiminntu inntaki.

Við kynnum einnig GPT‑5.6 Sol á Cerebras með allt að 750 tóka á sekúndu í júlí og færum viðskiptavinum jaðargreind á áður óþekktum hraða. Aðgangur verður í fyrstu takmarkaður við valda viðskiptavini á meðan við aukum afkastagetu.

Við hlökkum til að læra áfram af þessu forskoðunartímabili og færa GPT‑5.6 Sol, Terra og Luna til fleiri notenda bráðlega.


1. Við metum biðtíma og API-kostnað með því að skoða framleiðsluhegðun líkana okkar og herma án nettengingar. Þessi möt taka tillit til upplýsinga um verkfæraköll, sýnatökutóka og inntakstóka. Raunverulegar niðurstöður geta verið mjög breytilegar og ráðast af mörgum þáttum sem hermunin nær ekki yfir. Við hermum biðtíma við hraðan API-hraða og kostnað miðað við hefðbundna API-verðlagningu.

2. Öll líkön eru metin með ExploitBench API-prófunarumhverfinu með 5 fræjum og rökasamfellu.

3. Við keyrðum ExploitGym á alfa-API okkar, sem skilar svörum hraðar en opinbera API-ið okkar, og endurskölum síðan til að passa við opinbera API-ið. Þegar biðtímar eru endurskalaðir að þeim hraða sem búist er við fyrir opinbera API-ið okkar veldur það því að sumir áætlaðir biðtímar fara yfir 2 klst. og 6 klst. tímamörkin, þótt þeim hafi verið rétt fylgt í matskeyrslunni. Til að fá meiri hraða í tímanæmri vinnu bjóðum við forgangsvinnslu í API og hraðham í Codex.

4. Líkön án skráðra úttakstóka, biðtíma eða kostnaðar eru sýnd sem láréttar punktalínur.

Höfundur

OpenAI