GPT‑5.6 nihutab hinna ja jõudluse piire
Iga kihi tõhustamisega pakub OpenAI rohkematele ettevõtte töökoormustele iga dollari eest suuremat jõudlust.
Eile rääkisime, kuidas GPT‑5.6 aitas muuta enda käitamise tõhusamaks. Täna anname selle kasu edasi klientidele: GPT‑5.6 Luna(avaneb uues aknas) ja Terra(avaneb uues aknas) hinnad langevad ning GPT‑5.6 Sol muutub API-s kiiremaks. Need uuendused aitavad klientidel saada igast tehisintellekti investeeritud dollarist rohkem kasu ja tegutseda kiiremini, kui aeg on määrava tähtsusega.
Alates tänasest maksab meie kiireim ja soodsaim mudel GPT‑5.6 Luna 80% vähem ning igapäevatööks mõeldud tasakaalustatud mudel GPT‑5.6 Terra 20% vähem. Luna ja Terra madalamad hinnad kajastuvad ka selles, kuidas Codexi ja ChatGPT Worki kasutus arvestatakse tasuliste tellimuste limiiti. Luna võimaldab ettevõtetel töödelda suuri töömahte väga kvaliteetselt ja senisest märksa kulutõhusamalt. See oskab kasutada tööriistu ja läbida mitmeetapilisi töövooge, muutes suurema hulga tehisintellektirakenduste ulatusliku kasutamise praktiliseks.
OpenAI missiooni keskmes on muuta täiustatud tehisaru laialdasemalt kättesaadavaks ja taskukohasemaks, et AGI tooks kasu kogu inimkonnale. Need muudatused viivad selle lubaduse ellu. Need kajastavad aastatepikkusi täiustusi meie mudelite loomises, käitamises ja rakendamises.
Toome API-sse ka Kiirrežiimi, mis asendab meie prioriteettöötluse teenuse. GPT‑5.6 Soli Kiirrežiim on nüüd standardtöötlusest kuni 2,5 korda kiirem ja kaks korda kallim, ilma et nutikus muutuks. Kiirrežiim ühildub varasemate lahendustega: tähisega priority päringud kasutavad automaatselt Kiirrežiimi.
Tehisintellekti tõhus kasutamine algab soovitud tulemusest. Sobiva tasakaalu nutikuse, kiiruse, töökindluse ja hinna vahel määravad ülesande tähtsus, vea hind, kiireloomulisus ja maht. See tasakaal võib töövoo eri etappides muutuda.
GPT‑5.6 annab ettevõtetele selle võrrandi optimeerimiseks palju rohkem võimalusi. Luna pakub iga ülesande puhul umbes kuue sendi eest dollari kohta jõudlust, mis on võrreldav aasta tagasi tipptasemel mudelite omaga, ning teeb seda peaaegu üheksa korda kiiremini. Agents’ Last Exami põhjal ületab Luna erialatöös Fable 5-t, kusjuures ülesande hinnanguline maksumus on ligi 99% väiksem.
Praktikas saavad ettevõtted määrata vajaliku tulemuse ja kvaliteeditaseme ning seejärel hindamistega välja selgitada, kus täiendav nutikus tulemust märgatavalt parandab ja kus kiirem ning odavam töötlus annab sama kvaliteedi. Näiteks võib programmeerimise töövoos kasutada Soli ebakindluse kõrvaldamiseks ja plaani koostamiseks ning seejärel Lunat täpselt määratletud muudatuste tegemiseks, testide kirjutamiseks ja käitamiseks ning tulemuste hindamiseks. Mõnes teises töövoos võib sobida teistsugune tasakaal.
GPT‑5.6 mudelipere laiendab valikuvõimalusi. Ettevõtted saavad igas etapis rakendada võimalikult suurt kasulikku nutikust ja maksta loodud väärtusele vastavat hinda.
Sellise paindlikkuse saavutamine algab mudelite kõigi aluskihtide tõhustamisest.
Meie tõhususeelis tuleneb mudelite ja neid käitavate järeldussüsteemide täiustamisest ning agente tööriistade ja kontekstiga ühendava täitmiskeskkonna arendamisest. GPT‑5.6 mudelid läbivad tööprotsessi otsemat teed pidi. Parem marsruutimine hoiab riistvara töös, optimeeritud tootmistarkvara genereerib tokeneid tõhusamalt ning nutikam kontekstihaldus aitab agentidel vältida juba tehtud töö kordamist. Need täiustused võimaldavad sama arvutusvõimsusega teha rohkem kasulikku tööd, vähendades iga tulemuse saavutamiseks kuluvat aega, tokenite hulka ja raha.
GPT‑5.6 Sol aitab meil üha enam leida ja saavutada järgmisi edusamme. Inimese juhitud protsessis kirjutas Sol iseseisvalt ümber ja optimeeris tootmiskerneleid, kavandas ning tegi tokenite genereerimise parandamiseks sadu katseid ja jälgis treenimist, sekkudes probleemide tekkimisel. Kernelitega tehtud töö aitas vähendada mudeli käitamise kogukulu 20%, samas kui katsed suurendasid tokenite genereerimise tõhusust üle 15%. See töö jätkub ja loob tihedama tagasisideahela: kui meie mudelid täiustuvad ning suudavad iseseisvamalt töötada, saame tõhusust üha kiiremini parandada. Lugege lähemalt GPT‑5.6 tehnilistest lahendustest.
Laialdaselt kättesaadava tehisaru nõudluse rahuldamiseks on vaja nii rohkem arvutusvõimsust kui ka selle tõhusamat kasutamist. Loome vastupidavat taristuportfelli ja suuname iga töökoormuse selle käitamiseks kõige paremini sobivasse süsteemi. See lähenemisviis toetab hinna ja jõudluse skaala mõlemat äärmust. Soodsamas otsas muudavad Luna ja Terra uued hinnad suure töömahu käitamise märksa suuremas ulatuses majanduslikult tasuvaks. Tipptaseme otsas annab Kiirrežiim API klientidele kiirema juurdepääsu Solile, kui reageerimisaeg on oluline.
Ettevõtted saavad tuua tehisintellekti rohkematesse igapäevatoimingutesse, ohverdamata kõige olulisemate tööde kiirust. Suuremahuline dokumendianalüüs, kliendisuhtluse liigitamine ja tavapärane arendustöö võivad muutuda laialdaselt kasutades tasuvaks, samas kui keerukad Soli töökoormused saavad liikuda kiiremini, kui kõrgem hind on põhjendatud.
Edusammude mõju võib kumuleeruda. Inimese juhitud protsessis aitavad võimekamad mudelid meie tehnilisel meeskonnal leida järgmise põlvkonna täiustusi, lühendades teed parema jõudluse ja väiksemate kuludeni. Meie strateegia keskendub jätkuvalt nii võimekuse kui ka tõhususe suurendamisele, et iga järgmine tehisaru põlvkond saaks teha rohkem tööd väiksema kuluga.
GPT‑5.6 Terra ja Luna on endiselt saadaval ChatGPT Workis, Codexis ja OpenAI API-s. ChatGPT Workis ja Codexis saavad Free ja ChatGPT Go kasutajad kasutada Terrat, samas kui ChatGPT Plus, ChatGPT Pro, Businessi ja Enterprise'i kasutajad saavad valida Terra või Luna.
Alates 30. juulist on Terra API hind 2 dollarit miljoni sisendtokeni ja 12 dollarit miljoni väljundtokeni kohta ning Luna hind 0,20 dollarit miljoni sisendtokeni ja 1,20 dollarit miljoni väljundtokeni kohta. Soli hind ei muutu. ChatGPT ja Codexi tellimuste hinnad ning kvoodid ei muutu, kuid Terra ja Luna kasutus kulutab nüüd vähem krediite. Hinnamuudatused jõuavad AWS-i järk-järgult alates tänasest.
GPT‑5.6 Soli Kiirrežiim asendab API-s prioriteettöötluse ja vastab Codexi käsule /fast. Olemasolevad API päringud tähisega priority töötavad edasi. Vaadake API hinnakujunduse täielikke üksikasju.


