Përparimi i raportit çmim-performancë me GPT‑5.6
Duke e bërë çdo shtresë më efikase, OpenAI po ofron më shumë performancë për çdo dollar në një gamë më të gjerë ngarkesash pune të ndërmarrjeve.
Dje treguam se si GPT‑5.6 ndihmoi që vetë funksionimi i tij të bëhej më efikas për t'u ekzekutuar. Sot, këto përfitime po ua përcjellim klientëve përmes çmimeve më të ulëta për GPT‑5.6 Luna(hapet në një dritare të re) dhe Terra(hapet në një dritare të re), si dhe performancës më të shpejtë të GPT‑5.6 Sol në API. Së bashku, këto përditësime i ndihmojnë klientët të përfitojnë më shumë nga çdo dollar i investuar në IA dhe të ecin më shpejt kur koha ka rëndësi.
Duke filluar nga sot, GPT‑5.6 Luna, modeli ynë më i shpejtë dhe më ekonomik, do të kushtojë 80% më pak, ndërsa GPT‑5.6 Terra, modeli ynë i balancuar për punën e përditshme, do të kushtojë 20% më pak. Çmimet më të ulëta për Luna dhe Terra pasqyrohen edhe në mënyrën e llogaritjes së përdorimit kundrejt abonimeve me pagesë në Codex dhe ChatGPT Work. Luna u ofron bizneseve një mënyrë shumë më ekonomike për të përballuar volum të lartë pune me nivele shumë të larta cilësie. Ai mund të përdorë mjete dhe të përfundojë flukse pune me shumë hapa, duke e bërë praktik zbatimin në shkallë të gjerë të një game më të gjerë aplikacionesh me IA.
Bërja e inteligjencës së avancuar më të bollshme dhe më të përballueshme është në thelb të misionit të OpenAI për të siguruar që AGI t’i sjellë dobi gjithë njerëzimit. Këto ndryshime e vënë në praktikë këtë angazhim. Ato pasqyrojnë vite përmirësimesh në mënyrën se si ndërtohen, ofrohen dhe vihen në punë modelet tona.
Po prezantojmë gjithashtu modalitetin e shpejtë në API, i cili zëvendëson ofertën tonë të Përpunimit Prioritar. Për GPT‑5.6 Sol, modaliteti i shpejtë tani ofron shpejtësi deri në 2,5 herë më të lartë se përpunimi Standard, me dyfishin e çmimit dhe pa ndryshim në inteligjencë. Modaliteti i shpejtë është i pajtueshëm me versionet e mëparshme: kërkesat e etiketuara priority do ta përdorin automatikisht atë.
Përdorimi efikas i IA-së nis nga rezultati. Rëndësia, kostoja e gabimit, urgjenca dhe shkalla përcaktojnë ekuilibrin e duhur mes inteligjencës, shpejtësisë, besueshmërisë dhe kostos. Ky ekuilibër mund të ndryshojë nga njëri hap i fluksit të punës te tjetri.
GPT‑5.6 u jep bizneseve shumë më tepër hapësirë për ta optimizuar këtë raport. Luna ofron performancë të krahasueshme me modelet që një vit më parë ishin të klasit avangardë, me rreth 6 cent për çdo dollar për detyrë dhe me shpejtësi gati nëntë herë më të lartë. Në punët profesionale, sipas matjeve nga Testimi i fundit i agjentëve, Luna e tejkalon Fable 5 me një kosto të përllogaritur për detyrë gati 99% më të ulët.
Në praktikë, bizneset mund të përcaktojnë rezultatin dhe standardin e cilësisë që u nevojitet, pastaj të përdorin vlerësime për të përcaktuar se ku inteligjenca shtesë e përmirëson ndjeshëm rezultatin dhe ku përpunimi më i shpejtë e me kosto më të ulët mund të japë të njëjtën cilësi. Për shembull, një fluks pune programimi mund të përdorë Sol për të zgjidhur paqartësitë dhe për të përcaktuar planin, pastaj Luna për të zbatuar ndryshimet e specifikuara qartë, për të shkruar e ekzekutuar teste dhe për të vlerësuar rezultatet. Një fluks tjetër pune mund të kërkojë një ekuilibër ndryshe.
Familja GPT‑5.6 e zgjeron gamën e këtyre zgjedhjeve. Bizneset mund të përdorin inteligjencën maksimale të dobishme në çdo fazë, duke paguar çmimin e duhur për vlerën që ajo krijon.
Ofrimi i këtij fleksibiliteti nis duke e bërë më efikase çdo shtresë pas modeleve.
Epërsia jonë në efikasitet vjen nga përmirësimi i modeleve, sistemeve të inferencës që i vënë në punë dhe strukturës së agjentëve që i lidh me mjetet dhe kontekstin. Modelet GPT‑5.6 ndjekin një rrugë më të drejtpërdrejtë gjatë punës. Drejtimi më i mirë e mban pajisjen produktive, softueri i optimizuar i prodhimit gjeneron tokenë në mënyrë më efikase dhe menaxhimi më inteligjent i kontekstit i ndihmon agjentët të mos përsërisin punën e përfunduar. Së bashku, këto përmirësime na lejojnë të përfundojmë më shumë punë të dobishme me të njëjtën fuqi përllogaritëse, duke ulur kohën, tokenët dhe koston e nevojshme për çdo rezultat.
GPT‑5.6 Sol po na ndihmon gjithnjë e më shumë të gjejmë dhe të realizojmë valën e ardhshme të përmirësimeve. Brenda një procesi të udhëhequr nga njerëzit, Sol rishkroi dhe optimizoi në mënyrë autonome bërthamat e prodhimit, projektoi dhe kreu qindra eksperimente për të përmirësuar gjenerimin e tokenëve dhe mbikëqyri trajnimin, duke ndërhyrë kur shfaqeshin probleme. Puna me bërthamat ndihmoi në uljen me 20% të kostos së plotë të ofrimit të modelit, ndërsa eksperimentet e tij rritën me mbi 15% efikasitetin e gjenerimit të tokenëve. Kjo punë vazhdon, duke krijuar një cikël më të ngushtë reagimi: teksa modelet tona përmirësohen dhe punojnë në mënyrë më autonome, përshpejtohet edhe aftësia jonë për të rritur efikasitetin. Lexo më shumë rreth inxhinierisë pas GPT‑5.6.
Përmbushja e kërkesës për inteligjencë të bollshme kërkon më shumë fuqi përllogaritëse, por edhe shfrytëzim më produktiv të saj. Po ndërtojmë një portofol infrastrukture të qëndrueshme dhe po e përshtatim çdo ngarkesë pune me sistemet më të përshtatshme për ta ekzekutuar. Kjo qasje mbështet të dy skajet e kurbës çmim-performancë. Në skajin me kosto më të ulët, çmimet e reja të Luna dhe Terra e bëjnë ekonomik volumin e lartë të punës në një shkallë shumë më të gjerë. Në skajin avangardë, modaliteti i shpejtë u jep klientëve të API-së qasje më të shpejtë në Sol kur koha e përgjigjes ka rëndësi.
Ndërmarrjet mund ta përfshijnë më gjerësisht IA-në në operacionet e përditshme pa sakrifikuar shpejtësinë në punët e tyre më të rëndësishme. Analiza e dokumenteve në shkallë të gjerë, klasifikimi i ndërveprimeve me klientët dhe zbatimet rutinë mund të bëhen ekonomike për përdorim të gjerë, ndërsa ngarkesat komplekse të Sol mund të përparojnë më shpejt kur kostoja shtesë justifikohet.
Përfitimet mund të shumëfishohen. Brenda një procesi të udhëhequr nga njerëzit, modelet më të afta e ndihmojnë ekipin tonë teknik të gjejë brezin e ardhshëm të përmirësimeve, duke shkurtuar rrugën drejt performancës më të mirë dhe kostove më të ulëta. Strategjia jonë mbetet e përqendruar në avancimin e aftësive dhe efikasitetit, në mënyrë që çdo brez inteligjence të kryejë më shumë punë me kosto më të ulët.
GPT‑5.6 Terra dhe Luna mbeten të disponueshme në ChatGPT Work, Codex dhe API-në e OpenAI. Në ChatGPT Work dhe Codex, përdoruesit Free dhe ChatGPT Go mund të përdorin Terra, ndërsa përdoruesit e ChatGPT Plus, ChatGPT Pro, Business dhe Enterprise mund të zgjedhin Terra ose Luna.
Duke filluar më 30 korrik, çmimi i API-së për Terra është 2 USD për një milion tokenë hyrës dhe 12 USD për një milion tokenë dalës, ndërsa për Luna është 0,20 USD për një milion tokenë hyrës dhe 1,20 USD për një milion tokenë dalës. Çmimi i Sol mbetet i pandryshuar. Çmimet e abonimeve dhe kufijtë e kuotave për ChatGPT dhe Codex mbeten të pandryshuara, ndërsa përdorimi i Terra dhe Luna tani konsumon më pak kredite. Ndryshimet e çmimeve do të fillojnë të zbatohen në AWS më vonë gjatë ditës së sotme.
Modaliteti i shpejtë për GPT‑5.6 Sol zëvendëson Priority Processing në API dhe përputhet me /fast në Codex. Kërkesat ekzistuese të API-së të etiketuara "priority" do të vazhdojnë të funksionojnë. Shiko hollësitë e plota të çmimeve të API-së.


