Започињемо ограничени преглед серије GPT‑5.6: Sol, наш најпознатији модел; Terra, уравнотежен модел за свакодневни рад; и Luna, брз и приступачан модел. Terra има перформансе конкурентне GPT‑5.5, уз двоструко нижу цену, док Luna доноси снажне способности по нашој најнижој цени.
GPT‑5.6 Sol се покреће са нашим до сада најробуснијим безбедносним склопом. Ојачали смо заштиту за активности вишег ризика, осетљиве сајбер захтеве и поновљену злоупотребу, и провели више недеља проналазећи слабости, тестирајући систем под притиском и ојачавајући га против напада из стварног света.
Верујемо у широк приступ и планирамо да GPT‑5.6 Sol, Terra и Luna учинимо опште доступним у наредним недељама. У оквиру наше сталне сарадње са владом САД, унапред смо представили своје планове и способности модела пре данашњег покретања. На њихов захтев, почињемо ограниченим прегледом за малу групу поузданих партнера чије је учешће подељено са владом, пре ширег објављивања. Током овог прегледа наставићемо тестирање и блиску координацију са партнерима док радимо на широј доступности. Не верујемо да овакав процес приступа владе треба да постане дугорочна подразумевана пракса. Он ускраћује најбоље алате корисницима, програмерима, предузећима, сајбер браниоцима и глобалним партнерима којима су потребни. Овај краткорочни корак предузимамо јер верујемо да је то најснажнији пут ка широј доступности у наредним недељама, док са Администрацијом радимо на развоју оквира сајбер извршне уредбе и поновљивог процеса за будућа издања модела.
GPT‑5.6 Sol је наш најснажнији модел до сада. Да бисмо дали преглед перформанси модела, делимо скуп евалуација које истичу побољшане агентске способности у кодирању, биологији и сајбер безбедности, уз додатне евалуације безбедности и спремности доступне у нашој системској картици(отвара се у новом прозору). Проширени скуп резултата евалуације поделићемо када модел учинимо широко доступним.
Са GPT‑5.6 уводимо нови напор резоновања `max`, како бисмо Sol-у дали највише времена за дубоко резоновање. Поред тога, уводимо нови режим `ultra`, који превазилази способности једног агента користећи подагенте за убрзавање сложеног рада.
За радне токове кодирања, GPT‑5.6 Sol поставља ново најбоље достигнуће на Terminal‑Bench 2.1, који тестира радне токове командне линије који захтевају планирање, итерацију и координацију алата.
GPT‑5.6 Sol показује и широка побољшања у радним токовима биологије. На GeneBench v1, који евалуира дугорочне геномске анализе и анализе квантитативне биологије, постиже јаче резултате од GPT‑5.5 уз употребу мање токена.
GPT‑5.6 Sol је наш до сада најспособнији модел за сајбер безбедност. Он помера границу перформанси и ефикасности за дугорочне безбедносне задатке, укључујући истраживање рањивости и експлоатацију. На ExploitBench², GPT‑5.6 Sol је конкурентан моделу Mythos Preview користећи само око 1/3 излазних токена. На ExploitGym(отвара се у новом прозору)3, бенчмарку који су креирали истраживачи UC Berkeley-ја у сарадњи са OpenAI и другим граничним лабораторијама, модели GPT‑5.6 Sol, Terra и Luna показују снажна побољшања сајбер способности како повећавамо резоновање.
GPT‑5.6 Sol, Terra и Luna развили смо са нашим до сада најробуснијим заштитним мерама, са конфигурацијама усклађеним са способностима сваког модела. Како модел постаје способнији, заштитне мере осмишљавамо тако да све боље издрже стварни противнички притисак, уз очување приступа легитимном раду као што су преглед кода, истраживање рањивости, развој закрпа, отклањање грешака, безбедносна едукација и одбрамбено тестирање. Наш циљ је да забрањене офанзивне активности учинимо тежим, неизвеснијим и лакше уочљивим, без непотребног ограничавања тих корисних примена. На основу наше процене модела и заштитних мера, очекујемо значајну корист за легитиман одбрамбени рад, уз суштинско ограничавање забрањене офанзивне употребе.
GPT‑5.6 Sol боље помаже људима да пронађу и поправе рањивости него што поуздано изводи нападе од почетка до краја. Како ове способности настављају да напредују, наш приоритет је да обезбедимо да стигну до бранилаца и користе им, како би ове алате могли да употребе за проналажење слабости, развој закрпа и шире јачање система.
GPT‑5.6 Sol не прелази праг Cyber Critical у складу са нашим Preparedness Framework. У евалуацијама које су укључивале Chromium и Firefox, идентификовао је грешке и примитиве експлоатације — градивне елементе експлоита — али није аутономно произвео функционалан експлоит пуног ланца под тестираним условима. Ипак, прагови бенчмаркова не могу да обухвате сваки начин на који модел може да се користи или комбинује са другим алатима. Та неизвесност, заједно са ширим скоковитим напретком способности модела, разлог је што повећане способности модела повезујемо са снажнијим заштитним мерама и фазним објављивањем. Више детаља о нашим заштитним мерама делимо у системској картици GPT‑5.6 Preview(отвара се у новом прозору).
Ниједна појединачна заштитна мера није довољна против одлучне или прилагодљиве злоупотребе. Током прегледа GPT‑5.6 користимо слојевите заштитне мере, са тачним конфигурацијама које се разликују по моделима, и тестирамо их под притиском напада из стварног света. Оне обухватају заштите обучене у модел, провере у реалном времену током генерисања, сигнале на нивоу налога, диференциран приступ, надзор, спровођење правила и континуирано тестирање.
GPT‑5.6 је обучен да одбије забрањену сајбер помоћ, укључујући случајеве када корисници покушавају да прикрију намеру или пробију заштиту модела. Ове заштитне мере на нивоу модела постављају прву границу око тога у чему модел треба, а у чему не треба да помаже.
Класификатори злоупотребе у сајбер области и биологији у реалном времену пружају још један слој тако што евалуирају излаз док се генерише. У случајевима вишег ризика, ако открију потенцијално кршење, генерисање може бити паузирано док већи модел резоновања прегледа разговор и његов контекст. Ако се процени да излаз није дозвољен, задржава се пре него што стигне до корисника.
Означена активност може да покрене и преглед на нивоу налога у релевантним разговорима и сигналима ризика, у складу са нашим условима и политикама о задржавању и прегледу садржаја. Поглед шире од једног разговора помаже нашим системима да разликују упорно злонамерно понашање од легитимног безбедносног рада двоструке намене, где се слични технички концепти могу појавити у веома различитим контекстима.
Заједно, ови слојеви чине укупан приступ робуснијим него било која појединачна заштитна мера сама за себе. Понашање модела смањује вероватноћу штетних одговора, системи у реалном времену могу да интервенишу током генерисања, преглед на нивоу налога може да идентификује шире обрасце, а диференцирани приступ чува важан одбрамбени рад без тога да најосетљивије способности подразумевано буду широко доступне.
Посебно током прегледа, корисници могу наићи на заштитне мере које блокирају или одбијају неке захтеве. Други захтеви могу трајати дуже јер се генерисање паузира ради додатног прегледа. Заштитне мере понекад могу да интервенишу у легитимном раду, нарочито у областима двоструке намене где одбрамбене и офанзивне активности у почетку могу изгледати слично.
То је део онога што је преглед осмишљен да тестира. Желимо да разумемо не само да ли заштитне мере ограничавају злоупотребу, већ и да ли легитимни корисници и даље могу поуздано и ефикасно да обављају уобичајен рад. Повратне информације током прегледа помоћи ће нам да смањимо непотребна блокирања и кашњења, побољшамо начин на који заштитне мере тумаче контекст и створимо углађеније искуство пре ширег објављивања.
Такође радимо са корпоративним корисницима на дугорочнијим приступима — укључујући детекцију која чува приватност, безбедносне контроле којима управљају корисници и приступ калибрисан према ризику клијента, корисника или радног оптерећења — како бисмо унапредили безбедност уз подршку захтевима предузећа за приватност.
Заштитне мере морају да остану ефикасне и када нападачи прилагоде тактику. Заштита која функционише само за фиксни скуп познатих напада није довољно робусна за гранични модел.
Зато на безбедност примењујемо више интелигенције и рачунарских ресурса него икада, користећи сопствене моделе да брже пронађемо слабости и побољшамо заштитне мере. Посветили смо више од 700.000 GPU сати еквивалентних A100 аутоматизованој црвеној команди, усмереној на проналажење универзалних пробијања заштите: напада који могу да делују у многим инструкцијама или контекстима, а не само у једном уском окружењу. Фокус на те теже и општије нападе омогућио нам је да тестирамо заштитне мере изван фиксног скупа познатих неуспеха. То нам такође омогућава да испитамо много више образаца напада него што би само људско тестирање могло да обухвати, раније препознамо обрасце неуспеха и скратимо пут од откривања слабости до њеног отклањања.
Поред аутоматизоване црвене команде, сарађивали смо са независним тестерима на опсежној људској експертској црвеној команди, која ће се наставити током периода прегледа. Људска црвена команда допуњује аутоматизовани рад тако што тестира заштитне мере против креативних стручњака који покушавају да злоупотребе модел на начине које наши системи можда не би предвидели.
Ниједна евалуација не може да представи сваку конфигурацију производа, вишекорачни напад или стварни радни ток. Зато одржавамо процес брзог реаговања како бисмо репродуковали, проценили, приоритизовали и отклонили новооткривена пробијања заштите, а затим их додали у текуће евалуације да бисмо убудуће могли да тестирамо сличне неуспехе.
Током прегледа, модели GPT‑5.6 ће у почетку бити доступни преко API-ја и Codex-а одабраној групи поузданих партнера и организација. Планирамо да их ускоро учинимо шире доступним људима који користе ChatGPT, Codex и API.
У новом систему именовања уведеном са GPT‑5.6, број означава генерацију модела, док Sol, Terra и Luna означавају трајне нивое способности који могу да напредују сопственим темпом. Заједно, ова породица људима и програмерима даје јаснији избор у погледу интелигенције, брзине и трошка.
Цена GPT‑5.6 обрачунава се по 1M токена у три величине модела: Sol је $5 за улаз / $30 за излаз; Terra је $2.50 за улаз / $15 за излаз; а Luna је $1 за улаз / $6 за излаз. GPT‑5.6 такође уводи предвидљивије кеширање инструкција, укључујући подршку за експлицитне тачке прекида кеша и минимално трајање кеша од 30 минута. За GPT‑5.6 и касније моделе, уписи у кеш наплаћују се 1,25 пута у односу на стопу улаза модела без кеша, док читања из кеша и даље добијају попуст од 90% за кеширани улаз.
У јулу покрећемо и GPT‑5.6 Sol на Cerebras-у, до 750 токена у секунди, доносећи корисницима граничну интелигенцију невиђеном брзином. Приступ ће у почетку бити ограничен на одабране кориснике док проширујемо капацитет.
Радујемо се што ћемо наставити да учимо из овог периода прегледа и што ћемо ускоро донети GPT‑5.6 Sol, Terra и Luna већем броју људи.
1. Латенцију и трошак API-ја процењујемо на основу продукционог понашања наших модела и офлајн симулације. Ове процене узимају у обзир детаље позива алата, узорковане токене и улазне токене. Резултати у стварном свету могу знатно да варирају и зависе од многих фактора који нису обухваћени нашом симулацијом. Латенцију симулирамо при брзинама брзог API-ја, а трошак по редовним ценама API-ја.
2. Сви модели се евалуирају помоћу ExploitBench API оквира са 5 почетних вредности и континуитетом резоновања.
3. ExploitGym смо покренули на нашем алфа API-ју, који исписује одговоре брже од нашег јавног API-ја, а затим смо резултате прерачунали да одговарају јавном API-ју. При прерачунавању латенција на брзине очекиване за јавни API, неке процењене латенције зато прелазе временска ограничења од 2h и 6h, иако су у евалуационом покретању правилно испоштована. За веће брзине у раду осетљивом на време, нудимо приоритетну обраду у API-ју и брзи режим у Codex-у.
4. Модели без пријављених излазних токена, латенције или трошка приказани су као хоризонталне испрекидане линије.

