Extinderea frontierei preț-performanță cu GPT‑5.6
Prin eficientizarea fiecărui nivel, OpenAI oferă performanțe mai bune per dolar pentru o gamă mai largă de activități ale companiilor.
Ieri am prezentat cum GPT‑5.6 a contribuit la eficientizarea propriei sale funcționări. Astăzi, transmitem aceste beneficii clienților prin prețuri mai mici pentru GPT‑5.6 Luna(se deschide într-o fereastră nouă) și Terra(se deschide într-o fereastră nouă) și prin performanțe mai rapide pentru GPT‑5.6 Sol în API. Împreună, aceste actualizări îi ajută pe clienți să obțină mai mult din fiecare dolar investit în AI și să avanseze mai rapid atunci când timpul contează.
Începând de astăzi, GPT‑5.6 Luna, modelul nostru cel mai rapid și mai accesibil, va costa cu 80% mai puțin, iar GPT‑5.6 Terra, modelul nostru echilibrat pentru activitățile cotidiene, va costa cu 20% mai puțin. Prețurile mai mici pentru Luna și Terra se reflectă și în modul în care utilizarea este dedusă din abonamentele cu plată atunci când sunt folosite Codex și ChatGPT Work. Luna le oferă companiilor o modalitate mult mai rentabilă de a gestiona volume mari de lucru la niveluri foarte ridicate de calitate. Poate folosi instrumente și finaliza fluxuri de lucru cu mai mulți pași, ceea ce face viabilă operarea la scară largă a unei game mai ample de aplicații AI.
Creșterea disponibilității și accesibilității inteligenței avansate este esențială pentru misiunea OpenAI de a asigura că AGI aduce beneficii întregii omeniri. Aceste schimbări transpun angajamentul în practică. Ele reflectă ani de îmbunătățiri ale modului în care modelele noastre sunt create, furnizate și utilizate.
De asemenea, introducem modul rapid în API, care înlocuiește oferta noastră de procesare prioritară. Pentru GPT‑5.6 Sol, modul rapid oferă acum viteze de până la 2,5 ori mai mari decât procesarea standard, la un preț dublu, fără nicio modificare a nivelului de inteligență. Modul rapid este compatibil cu versiunile anterioare: solicitările etichetate „priority” vor utiliza automat modul rapid.
Utilizarea eficientă a AI începe cu rezultatul dorit. Miza, costul erorilor, urgența și amploarea determină echilibrul potrivit între inteligență, viteză, fiabilitate și cost. Acest echilibru se poate schimba de la un pas al fluxului de lucru la altul.
GPT‑5.6 le oferă companiilor mult mai multă flexibilitate pentru optimizarea acestei ecuații. Luna oferă performanțe comparabile cu cele ale modelelor considerate de vârf acum un an, la un cost per activitate de aproximativ 6 cenți la dolar și la o viteză de aproape nouă ori mai mare. Pentru activități profesionale, conform evaluării Agents’ Last Exam, Luna depășește Fable 5 la un cost estimat per activitate cu aproape 99% mai mic.
În practică, organizațiile pot defini rezultatul și standardul de calitate necesar, apoi pot folosi evaluări pentru a stabili unde inteligența suplimentară îmbunătățește semnificativ rezultatul și unde procesarea mai rapidă și mai ieftină poate oferi aceeași calitate. De exemplu, un flux de programare poate folosi Sol pentru a elimina incertitudinile și a defini planul, apoi Luna pentru a implementa modificări bine specificate, a scrie și rula teste și a evalua rezultatele. Un alt flux de lucru poate necesita un echilibru diferit.
Familia GPT‑5.6 extinde gama acestor opțiuni. Companiile pot aplica nivelul maxim util de inteligență în fiecare etapă, plătind prețul potrivit pentru valoarea creată.
Această flexibilitate începe cu eficientizarea fiecărui nivel din spatele modelelor.
Avantajul nostru în materie de eficiență provine din îmbunătățirea modelelor, a sistemelor de inferență care le rulează și a cadrului agentiv de testare care le conectează la instrumente și context. Modelele GPT‑5.6 urmează o cale mai directă în realizarea activităților. O rutare mai bună menține hardware-ul productiv, software-ul de producție optimizat generează tokenuri mai eficient, iar gestionarea mai inteligentă a contextului ajută agenții să evite repetarea activităților deja finalizate. Împreună, aceste îmbunătățiri ne permit să realizăm mai multe activități utile cu aceeași putere de calcul, reducând timpul, numărul de tokenuri și costul necesar pentru fiecare rezultat.
GPT‑5.6 Sol ne ajută tot mai mult să identificăm și să implementăm următoarea serie de îmbunătățiri. În cadrul unui proces coordonat de oameni, Sol a rescris și optimizat autonom nuclee de producție, a conceput și desfășurat sute de experimente pentru a îmbunătăți generarea tokenurilor și a monitorizat antrenarea, intervenind când au apărut probleme. Activitatea asupra nucleelor a contribuit la reducerea cu 20% a costului integral de furnizare a modelului, iar experimentele sale au crescut eficiența generării tokenurilor cu peste 15%. Această activitate continuă și creează o buclă de feedback mai strânsă: pe măsură ce modelele noastre se îmbunătățesc și pot lucra mai autonom, se accelerează și capacitatea noastră de a spori eficiența. Află mai multe despre ingineria din spatele GPT‑5.6.
Satisfacerea cererii pentru inteligență disponibilă pe scară largă necesită atât mai multă putere de calcul, cât și o utilizare mai productivă a acesteia. Construim un portofoliu de infrastructură rezilient și alocăm fiecare volum de lucru sistemelor celor mai potrivite pentru a-l rula. Această abordare susține ambele capete ale curbei preț-performanță. La capătul cu prețuri mai mici, noile tarife Luna și Terra fac rentabile activitățile de volum mare la o scară mult mai extinsă. La capătul de vârf, modul rapid le oferă clienților API acces mai rapid la Sol atunci când timpul de răspuns este important.
Companiile pot integra AI în mai multe operațiuni cotidiene fără a sacrifica viteza în activitățile cu cele mai importante consecințe. Analiza pe scară largă a documentelor, clasificarea interacțiunilor cu clienții și implementările de rutină pot deveni suficient de rentabile pentru utilizare extinsă, iar sarcinile complexe Sol pot avansa mai rapid atunci când costul suplimentar este justificat.
Beneficiile se pot cumula. Într-un proces coordonat de oameni, modelele mai capabile ajută echipa noastră tehnică să identifice următoarea generație de îmbunătățiri, scurtând drumul către performanțe mai bune și costuri mai mici. Strategia noastră rămâne axată pe dezvoltarea simultană a capabilităților și eficienței, astfel încât fiecare generație de inteligență să poată realiza mai multe activități la un cost mai mic.
GPT‑5.6 Terra și Luna rămân disponibile în ChatGPT Work, Codex și API-ul OpenAI. În ChatGPT Work și Codex, utilizatorii Free și ChatGPT Go pot accesa Terra, iar utilizatorii ChatGPT Plus, ChatGPT Pro, Business și Enterprise pot alege Terra și Luna.
Începând cu 30 iulie, prețul API va fi de 2 $ per milion de tokenuri de intrare și 12 $ per milion de tokenuri de ieșire pentru Terra, respectiv 0,20 $ per milion de tokenuri de intrare și 1,20 $ per milion de tokenuri de ieșire pentru Luna. Prețul pentru Sol rămâne neschimbat. Prețurile abonamentelor și bugetele cotelor ChatGPT și Codex rămân neschimbate, iar utilizarea Terra și Luna consumă acum mai puține credite. Modificările de preț vor începe să fie implementate în AWS în cursul zilei de astăzi.
Modul rapid pentru GPT‑5.6 Sol înlocuiește procesarea prioritară în API și corespunde modului /fast din Codex. Solicitările API existente, etichetate „priority”, vor continua să funcționeze. Consultă detaliile complete privind tarifele API.


