A GPT‑5.6 új szintre emeli az ár-teljesítmény arányt
Az OpenAI minden réteg hatékonyabbá tételével több vállalati munkaterhelésnél nyújt jobb teljesítményt ugyanannyi pénzért.
Tegnap bemutattuk, hogyan járult hozzá a GPT‑5.6 ahhoz, hogy hatékonyabban működtethessük. Ma ügyfeleinknek is továbbadjuk ennek előnyeit: az API-ban alacsonyabb áron kínáljuk a GPT‑5.6 Luna(új ablakban nyílik meg) és Terra(új ablakban nyílik meg) modelleket, a GPT‑5.6 Sol pedig gyorsabb teljesítményt nyújt. Ezek a frissítések segítenek ügyfeleinknek, hogy többet hozzanak ki minden, MI-be fektetett dollárból, és gyorsabban haladjanak, amikor az idő kulcsfontosságú.
Mától a GPT‑5.6 Luna, leggyorsabb és legkedvezőbb árú modellünk, 80%-kal, míg a mindennapi munkára szánt, kiegyensúlyozott GPT‑5.6 Terra 20%-kal kerül kevesebbe. A Luna és a Terra alacsonyabb ára abban is megmutatkozik, hogyan számítjuk el a használatot a fizetős előfizetések keretéből a Codex és a ChatGPT Work használatakor. A Luna jóval költséghatékonyabb lehetőséget kínál a vállalkozásoknak a nagy volumenű feladatok rendkívül magas színvonalú elvégzésére. Eszközöket használhat és többlépéses munkafolyamatokat hajthat végre, így az MI-alkalmazások szélesebb köre működtethető gazdaságosan nagy léptékben.
A fejlett intelligencia szélesebb körű és megfizethetőbb hozzáférhetővé tétele központi eleme az OpenAI küldetésének, hogy az AGI az egész emberiség javát szolgálja. Ezek a változások ezt az elkötelezettséget ültetik át a gyakorlatba. Többévnyi fejlesztés eredményei, amelyek a modelljeink felépítését, kiszolgálását és gyakorlati alkalmazását egyaránt érintik.
Az API-ban bevezetjük a Gyors módot is, amely a Priority Processing szolgáltatásunk helyébe lép. A GPT‑5.6 Sol esetében a Gyors mód mostantól akár 2,5-szer gyorsabb a normál feldolgozásnál, kétszeres áron, az intelligencia változása nélkül. A Gyors mód visszafelé kompatibilis: a `priority` címkével ellátott kérések automatikusan a Gyors módot használják.
Az MI hatékony használatának kiindulópontja a kívánt eredmény. A feladat jelentősége, a hibák költsége, a sürgősség és a lépték határozza meg az intelligencia, a sebesség, a megbízhatóság és a költség megfelelő egyensúlyát. Ez az egyensúly a munkafolyamat egyes lépései között is változhat.
A GPT‑5.6 sokkal nagyobb mozgásteret ad a vállalkozásoknak ennek az egyenletnek az optimalizálására. A Luna a feladatonkénti költséget tekintve nagyjából dolláronként 6 centért nyújt az egy évvel ezelőtti élvonalbeli modellekéhez mérhető teljesítményt, közel kilencszeres sebességgel. Az Agents’ Last Exam által mért szakmai feladatokban a Luna felülmúlja a Fable 5-öt, miközben becsült feladatonkénti költsége közel 99%-kal alacsonyabb.
A gyakorlatban a vállalkozások meghatározhatják a kívánt eredményt és minőségi szintet, majd értékelésekkel állapíthatják meg, hol javít érdemben az eredményen a nagyobb intelligencia, és hol biztosítható ugyanaz a minőség gyorsabb, olcsóbb feldolgozással. Egy programozási munkafolyamat például a Sol segítségével tisztázhatja a bizonytalanságokat és dolgozhatja ki a tervet, majd a Lunával valósíthatja meg a pontosan meghatározott módosításokat, írhatja és futtathatja a teszteket, illetve értékelheti az eredményeket. Egy másik munkafolyamathoz más egyensúly lehet megfelelő.
A GPT‑5.6 modellcsalád tovább bővíti a választási lehetőségeket. A vállalkozások minden szakaszban a lehető leghasznosabb intelligenciát alkalmazhatják, miközben az általa teremtett értéknek megfelelő árat fizetik.
E rugalmasság megteremtéséhez a modellek mögötti minden réteget hatékonyabbá kell tenni.
Hatékonysági előnyünk a modellek, az őket futtató következtetési rendszerek, valamint az eszközökkel és kontextussal összekötő ügynökalapú végrehajtási környezet fejlesztéséből fakad. A GPT‑5.6 modellek közvetlenebb úton végzik el a feladatokat. A jobb útválasztás biztosítja a hardver hatékony kihasználását, az optimalizált éles szoftver hatékonyabban állítja elő a tokeneket, az intelligensebb kontextuskezelés pedig segít az ügynököknek elkerülni a már elvégzett munka megismétlését. Ezekkel a fejlesztésekkel azonos számítási kapacitással több hasznos munkát végezhetünk el, csökkentve az egyes eredményekhez szükséges időt, tokenmennyiséget és költséget.
A GPT‑5.6 Sol egyre nagyobb szerepet játszik a fejlesztések következő körének feltárásában és megvalósításában. Egy ember által irányított folyamatban a Sol önállóan írta át és optimalizálta az éles kerneleket, több száz kísérletet tervezett és futtatott a tokengenerálás javítására, továbbá figyelemmel kísérte a betanítást, és probléma esetén beavatkozott. A kerneleken végzett munka 20%-kal csökkentette a modell kiszolgálásának teljes költségét, a kísérletek pedig több mint 15%-kal növelték a tokengenerálás hatékonyságát. A munka folytatódik, és egyre szorosabb visszacsatolási ciklust hoz létre: ahogy modelljeink fejlődnek és egyre önállóbban képesek dolgozni, úgy gyorsul a hatékonyság javítása is. További információ a GPT‑5.6 mögött álló mérnöki munkáról.
A széles körben elérhető intelligencia iránti igény kielégítéséhez több és hatékonyabban kihasznált számítási kapacitásra egyaránt szükség van. Ellenálló infrastruktúra-portfóliót építünk, és minden munkaterhelést az annak futtatására legalkalmasabb rendszerekhez rendelünk. Ez a megközelítés az ár-teljesítmény görbe mindkét végét támogatja. Az alacsonyabb költségű oldalon a Luna és a Terra új árai sokkal nagyobb léptékben teszik gazdaságossá a nagy volumenű munkát. Az élvonalbeli oldalon a Gyors mód gyorsabb hozzáférést biztosít az API ügyfeleinek a Solhoz, amikor fontos a válaszidő.
A vállalatok több MI-t építhetnek be a mindennapi működésükbe anélkül, hogy a legfontosabb feladatoknál le kellene mondaniuk a sebességről. A nagyszabású dokumentumelemzés, az ügyfél-interakciók osztályozása és a rutinszerű megvalósítás széles körben is gazdaságossá válhat, míg az összetett Sol-munkaterhelések gyorsabban futhatnak, amikor indokolt a felár.
Az előnyök egymást erősíthetik. Egy ember által irányított folyamatban a fejlettebb modellek segítenek műszaki csapatunknak megtalálni a fejlesztések következő generációját, lerövidítve a jobb teljesítményhez és az alacsonyabb költségekhez vezető utat. Stratégiánk továbbra is a képességek és a hatékonyság együttes fejlesztésére összpontosít, hogy az intelligencia minden új generációja több munkát végezhessen el alacsonyabb költséggel.
A GPT‑5.6 Terra és Luna továbbra is elérhető a ChatGPT Work, a Codex és az OpenAI API felületén. A ChatGPT Work és a Codex szolgáltatásban a Free és ChatGPT Go felhasználói a Terrához férhetnek hozzá, míg a ChatGPT Plus, ChatGPT Pro, Business és Enterprise felhasználói a Terra és a Luna közül választhatnak.
Július 30-tól az API díja a Terra esetében 2 USD egymillió bemeneti tokenenként és 12 USD egymillió kimeneti tokenenként, a Luna esetében pedig 0,20, illetve 1,20 USD. A Sol árazása nem változik. A ChatGPT- és Codex-előfizetések ára és kvótakerete nem változik, a Terra és a Luna használata azonban mostantól kevesebb kreditet fogyaszt. Az árváltozások bevezetése az AWS-ben még ma megkezdődik.
A GPT‑5.6 Sol Gyors módja az API-ban a Priority Processing helyébe lép, és megfelel a Codex `/fast` módjának. A meglévő, `priority` címkével ellátott API-kérések továbbra is működni fognak. Az API-árazás teljes részleteinek megtekintése.


