Începem o previzualizare limitată a seriei GPT‑5.6: Sol, modelul nostru de vârf; Terra, un model echilibrat pentru munca de zi cu zi; și Luna, un model rapid și accesibil. Terra are performanță competitivă cu GPT‑5.5, fiind de 2 ori mai ieftin, iar Luna oferă capabilități puternice la cel mai mic cost al nostru.
GPT‑5.6 Sol se lansează cu cel mai robust ansamblu de siguranță al nostru de până acum. Am consolidat protecțiile pentru activități cu risc mai ridicat, solicitări cibernetice sensibile și abuz repetat și am petrecut mai multe săptămâni căutând puncte slabe, testând sistemul sub presiune și întărindu-l împotriva atacurilor din lumea reală.
Credem în accesul larg și plănuim să facem GPT‑5.6 Sol, Terra și Luna disponibile general în săptămânile următoare. Ca parte a dialogului nostru continuu cu guvernul SUA, am prezentat în avans planurile noastre și capabilitățile modelelor înainte de lansarea de astăzi. La solicitarea lor, începem cu o previzualizare limitată pentru un grup mic de parteneri de încredere, a căror participare a fost comunicată guvernului, înainte de o lansare mai largă. În timpul acestei previzualizări, vom continua testarea și coordonarea strânsă cu partenerii, în timp ce lucrăm pentru o disponibilitate mai largă. Nu credem că acest tip de proces de acces guvernamental ar trebui să devină regula implicită pe termen lung. El îi împiedică pe utilizatorii, dezvoltatorii, companiile, apărătorii cibernetici și partenerii globali care au nevoie de ele să acceseze cele mai bune instrumente. Facem acest pas pe termen scurt deoarece credem că este cea mai solidă cale către o disponibilitate mai largă în săptămânile următoare, în timp ce lucrăm cu Administrația pentru a dezvolta cadrul ordinului executiv privind domeniul cibernetic și un proces repetabil pentru lansările viitoare de modele.
GPT‑5.6 Sol este cel mai puternic model al nostru de până acum. Pentru a oferi o previzualizare a performanței modelului, împărtășim un set de evaluări care evidențiază capabilități agentive îmbunătățite în programare, biologie și securitate cibernetică, cu evaluări suplimentare de siguranță și pregătire disponibile în fișa noastră de sistem(se deschide într-o fereastră nouă). Vom publica un set extins de rezultate ale evaluărilor când vom face modelul disponibil la scară largă.
Cu GPT‑5.6, introducem un nou nivel de efort de raţionament, max”, pentru a-i oferi lui Sol cel mai mult timp să raționeze în profunzime. În plus, introducem un nou mod „ultra”, care depășește capabilitățile unui singur agent folosind subagenți pentru a accelera activitățile complexe.
Pentru fluxurile de lucru de programare, GPT‑5.6 Sol stabilește un nou vârf al performanței pe Terminal‑Bench 2.1, care testează fluxuri de lucru în linia de comandă ce necesită planificare, iterare și coordonarea instrumentelor.
GPT‑5.6 Sol arată, de asemenea, îmbunătățiri ample în fluxurile de lucru din biologie. Pe GeneBench v1, care evaluează analize de genomică pe orizont lung și biologie cantitativă, obține rezultate mai bune decât GPT‑5.5 folosind mai puține tokenuri.
GPT‑5.6 Sol este cel mai capabil model al nostru de până acum pentru securitate cibernetică. El mută frontiera performanță-eficiență pentru sarcini de securitate pe orizont lung, inclusiv cercetarea vulnerabilităților și exploatarea lor. Pe ExploitBench², GPT‑5.6 Sol este competitiv cu Mythos Preview folosind doar ~1/3 din tokenurile de ieșire. Pe ExploitGym(se deschide într-o fereastră nouă)3, un test creat de cercetători de la UC Berkeley în colaborare cu OpenAI și alte laboratoare de vârf, modelele GPT‑5.6 Sol, Terra și Luna demonstrează toate îmbunătățiri puternice ale capabilităților cibernetice pe măsură ce creștem raţionamentul.
Am dezvoltat GPT‑5.6 Sol, Terra și Luna cu cele mai robuste măsuri de siguranță ale noastre de până acum, cu configurații adaptate capabilităților fiecărui model. Pe măsură ce modelul devine mai capabil, proiectăm măsuri de siguranță care să reziste tot mai bine presiunii adversariale din lumea reală, păstrând în același timp accesul la activități legitime precum revizuirea codului, cercetarea vulnerabilităților, dezvoltarea de patchuri, depanarea, educația în securitate și testarea defensivă. Scopul nostru este să facem activitatea ofensivă interzisă mai dificilă, mai incertă și mai detectabilă, fără a limita inutil aceste utilizări benefice. Pe baza evaluării noastre a modelului și a măsurilor de siguranță, ne așteptăm la beneficii substanțiale pentru activitatea defensivă legitimă, limitând în același timp în mod semnificativ utilizarea ofensivă interzisă.
GPT‑5.6 Sol este mai bun la a ajuta oamenii să găsească și să remedieze vulnerabilități decât la a realiza în mod fiabil atacuri de la un capăt la altul. Pe măsură ce aceste capabilități continuă să avanseze, prioritatea noastră este să ne asigurăm că ajung la apărători și îi ajută, astfel încât aceștia să poată folosi aceste instrumente pentru a găsi puncte slabe, a dezvolta patchuri și a consolida sistemele la scară mai largă.
GPT‑5.6 Sol nu depășește pragul Cyber Critical conform Cadrului nostru de pregătire. În evaluări care au implicat Chromium și Firefox, a identificat buguri și primitive de exploatare — elementele de bază ale unui exploit — dar nu a produs autonom un exploit funcțional pe întregul lanț în condițiile testate. Totuși, pragurile testelor nu pot surprinde toate modurile în care un model poate fi folosit sau combinat cu alte instrumente. Această incertitudine, împreună cu saltul mai amplu al capabilităților modelului, este motivul pentru care asociem capabilitățile sporite ale modelului cu măsuri de siguranță mai puternice și o lansare în etape. Împărtășim mai multe detalii despre măsurile noastre de siguranță în fișa de sistem pentru previzualizarea GPT‑5.6(se deschide într-o fereastră nouă).
Nicio măsură de siguranță izolată nu este suficientă împotriva utilizării abuzive determinate sau adaptative. În previzualizarea GPT‑5.6, folosim măsuri de siguranță pe mai multe straturi, cu configurații exacte care diferă între modele, și le testăm sub presiune împotriva atacurilor din lumea reală. Acestea includ protecții antrenate în model, verificări în timp real în timpul generării, semnale la nivel de cont, acces diferențiat, monitorizare, aplicarea regulilor și testare continuă.
GPT‑5.6 este antrenat să refuze asistența cibernetică interzisă, inclusiv atunci când utilizatorii încearcă să își mascheze intenția sau să facă jailbreak modelului. Aceste măsuri de siguranță la nivel de model stabilesc prima limită în jurul lucrurilor la care modelul ar trebui și nu ar trebui să ajute.
Clasificatorii în timp real pentru utilizarea abuzivă în domeniile cibernetic și biologic oferă un alt strat, evaluând ieșirea pe măsură ce este generată. Pentru cazurile cu risc mai ridicat, dacă detectează o posibilă încălcare, generarea poate fi întreruptă temporar în timp ce un model de raţionament mai mare analizează conversația și contextul ei. Dacă ieșirea este evaluată ca nepermisă, ea este reținută înainte să ajungă la utilizator.
Activitatea semnalată poate declanșa și o analiză la nivel de cont a conversațiilor relevante și a semnalelor de risc, în conformitate cu termenii și politicile noastre privind păstrarea și analizarea conținutului. Privirea dincolo de o singură conversație ajută sistemele noastre să distingă comportamentul malițios persistent de activitatea legitimă de securitate cu dublă utilizare, unde concepte tehnice similare pot apărea în contexte foarte diferite.
Împreună, aceste straturi fac abordarea generală mai robustă decât oricare măsură de siguranță luată separat. Comportamentul modelului reduce probabilitatea răspunsurilor dăunătoare, sistemele în timp real pot interveni în timpul generării, analiza la nivel de cont poate identifica tipare mai largi, iar accesul diferențiat păstrează activitatea defensivă importantă fără a face implicit disponibile pe scară largă cele mai sensibile capabilități.
Mai ales în timpul previzualizării, utilizatorii pot întâlni măsuri de siguranță care blochează sau refuză unele solicitări. Alte solicitări pot dura mai mult deoarece generarea este întreruptă temporar pentru o analiză suplimentară. Măsurile de siguranță pot interveni ocazional în activități legitime, mai ales în zone cu dublă utilizare, unde activitatea defensivă și cea ofensivă pot părea inițial similare.
Aceasta face parte din ceea ce previzualizarea este concepută să testeze. Vrem să înțelegem nu doar dacă măsurile de siguranță limitează abuzul, ci și dacă utilizatorii legitimi își pot finaliza în continuare activitatea obișnuită în mod fiabil și eficient. Feedbackul din timpul previzualizării ne va ajuta să reducem blocările și întârzierile inutile, să îmbunătățim modul în care măsurile de siguranță interpretează contextul și să creăm o experiență mai fluidă înainte de lansarea mai largă.
Lucrăm, de asemenea, cu clienți enterprise la abordări pe termen mai lung — inclusiv detectare care păstrează confidențialitatea, controale de siguranță operate de client și acces calibrat la riscul unui client, utilizator sau volum de lucru — pentru a avansa siguranța, susținând totodată cerințele de confidențialitate ale companiilor.
Măsurile de siguranță trebuie să rămână eficiente și atunci când atacatorii își adaptează tacticile. O protecție care funcționează doar pentru un set fix de atacuri cunoscute nu este suficient de robustă pentru un model de vârf.
De aceea aplicăm mai multă inteligență și putere de calcul ca oricând pentru siguranță, folosind propriile noastre modele ca să găsim puncte slabe și să îmbunătățim mai rapid măsurile de siguranță. Am dedicat peste 700.000 de ore GPU echivalent A100 red teamingului automatizat, cu scopul de a găsi jailbreakuri universale: atacuri care pot funcționa în multe solicitări sau contexte, nu doar într-un cadru restrâns. Concentrându-ne pe aceste atacuri mai dificile și mai generale, am putut testa măsurile de siguranță dincolo de un set fix de eșecuri cunoscute. Această abordare ne permite și să explorăm mult mai multe tipare de atac decât ar putea acoperi doar testarea umană, să identificăm mai devreme tiparele de eșec și să scurtăm drumul de la găsirea unei slăbiciuni la remedierea ei.
Pe lângă red teamingul automatizat, am colaborat cu testeri terți pentru a desfășura un red teaming amplu realizat de experți umani, care va continua în perioada de previzualizare. Red teamingul uman completează munca automatizată, testând măsurile de siguranță împotriva unor experți creativi care încearcă să folosească abuziv modelul în moduri pe care sistemele noastre s-ar putea să nu le anticipeze.
Nicio evaluare nu poate reprezenta fiecare configurație de produs, atac în mai mulți pași sau flux de lucru din lumea reală. Prin urmare, menținem un proces de răspuns rapid pentru a reproduce, evalua, prioritiza și remedia jailbreakurile nou descoperite, apoi le adăugăm în evaluările noastre continue pentru a putea testa în viitor eșecuri similare.
În timpul previzualizării, modelele GPT‑5.6 vor fi disponibile inițial prin API și Codex pentru un grup select de parteneri și organizații de încredere. Plănuim să le facem disponibile în curând la scară mai largă pentru persoanele care folosesc ChatGPT, Codex și API-ul.
În acest nou sistem de denumire introdus odată cu GPT‑5.6, numărul identifică generația unui model, iar Sol, Terra și Luna identifică niveluri stabile de capabilitate, care pot avansa în propriul ritm. Împreună, familia oferă oamenilor și dezvoltatorilor opțiuni mai clare în ceea ce privește inteligența, viteza și costul.
GPT‑5.6 are prețuri per 1 milion de tokenuri pentru trei dimensiuni de model: Sol costă 5 $ per intrare / 30 $ per ieșire; Terra costă 2,50 $ per intrare / 15 $ per ieșire; iar Luna costă 1 $ per intrare / 6 $ per ieșire. GPT‑5.6 introduce și o stocare în cache mai predictibilă a solicitărilor, inclusiv suport pentru puncte explicite de întrerupere a cache-ului și o durată minimă de viață a cache-ului de 30 de minute. Pentru GPT‑5.6 și modelele ulterioare, scrierile în cache sunt facturate la 1,25x tariful de intrare necache-uită al modelului, iar citirile din cache continuă să primească reducerea de 90% pentru intrarea cache-uită.
Lansăm și GPT‑5.6 Sol pe Cerebras, cu până la 750 de tokenuri pe secundă în iulie, aducând clienților inteligență de vârf la o viteză fără precedent. Accesul va fi inițial limitat la clienți selectați, pe măsură ce ne extindem capacitatea.
Suntem nerăbdători să continuăm să învățăm din această perioadă de previzualizare și să aducem GPT‑5.6 Sol, Terra și Luna la mai mulți oameni în curând.
1. Estimăm latența și costul API analizând comportamentul în producție al modelelor noastre și simulând offline. Aceste estimări iau în calcul detaliile apelurilor de instrumente, tokenurile eșantionate și tokenurile de intrare. Rezultatele din lumea reală pot varia substanțial și depind de mulți factori care nu sunt surprinși în simularea noastră. Simulăm latența la viteze API rapide și costul la prețurile API obișnuite.
2. Toate modelele sunt evaluate folosind cadrul API ExploitBench cu 5 seeduri și continuitate a raţionamentului.
3. Am rulat ExploitGym pe API-ul nostru alfa, care generează răspunsuri mai rapid decât API-ul nostru public, apoi am rescalat rezultatele pentru a corespunde API-ului nostru public. La rescalarea latențelor la vitezele așteptate pentru API-ul nostru public, unele latențe estimate depășesc limitele de timp de 2 h și 6 h, deși acestea au fost respectate corect în rularea evaluării. Pentru viteze mai mari în activități sensibile la timp, oferim procesare prioritară în API și modul rapid în Codex.
4. Modelele fără tokenuri de ieșire, latență sau cost raportate sunt reprezentate ca linii punctate orizontale.

