Flytt grensen for pris og ytelse med GPT‑5.6
Ved å effektivisere hvert lag, leverer OpenAI bedre ytelse per krone på tvers av flere arbeidsbelastninger i virksomheten.
I går fortalte vi hvordan GPT‑5.6 bidro til å gjøre seg selv mer effektiv i drift. I dag lar vi kundene dra nytte av fordelene gjennom lavere priser på GPT‑5.6 Luna(åpnes i et nytt vindu) og Terra(åpnes i et nytt vindu) samt raskere ytelse med GPT‑5.6 Sol i API-et. Samlet hjelper disse oppdateringene kundene med å få mer igjen for hver krone de investerer i KI og jobbe raskere når tid er avgjørende.
Fra og med i dag blir GPT‑5.6 Luna, vår raskeste og rimeligste modell, 80 % billigere, mens GPT‑5.6 Terra, vår balanserte modell for daglig arbeid, blir 20 % billigere. De lavere prisene på Luna og Terra gjenspeiles også i hvordan bruk belastes betalte abonnementer ved bruk av Codex og ChatGPT Work. Luna gir bedrifter en langt mer kostnadseffektiv måte å håndtere store arbeidsmengder på med svært høy kvalitet. Den kan bruke verktøy og fullføre arbeidsflyter i flere trinn, slik at flere KI-løsninger blir praktiske å kjøre i stor skala.
Å gjøre avansert intelligens mer tilgjengelig og rimelig er sentralt i OpenAIs oppdrag om å sikre at AGI kommer hele menneskeheten til gode. Disse endringene omsetter oppgradet i praksis. De gjenspeiler flere års forbedringer i hvordan modellene våre bygges, driftes og tas i bruk.
Vi lanserer også Hurtigmodus i API-et, som erstatter tilbudet vårt for prioritert behandling. For GPT‑5.6 Sol gir Hurtigmodus nå opptil 2,5 ganger høyere hastighet enn standardbehandlingen til dobbel pris, uten at intelligensen endres. Hurtigmodus er bakoverkompatibel: Forespørsler merket «priority» bruker automatisk Hurtigmodus.
Effektiv bruk av KI begynner med ønsket resultat. Konsekvensene, kostnaden ved feil, hvor presserende oppgaven er og omfanget avgjør den rette balansen mellom intelligens, hastighet, pålitelighet og kostnad. Denne balansen kan endre seg fra ett trinn i en arbeidsflyt til det neste.
GPT‑5.6 gir bedrifter langt større rom til å optimalisere dette regnestykket. Luna leverer ytelse på nivå med modeller som var banebrytende for ett år siden, til omtrent 6 cent per dollar per oppgave og nesten ni ganger så raskt. På profesjonelt arbeid, målt med Agents’ Last Exam, overgår Luna Fable 5 til en anslått kostnad per oppgave som er nesten 99 % lavere.
I praksis kan bedrifter definere ønsket resultat og kvalitetsstandarden og deretter bruke evalueringer til å avgjøre hvor intelligensen gir en vesentlig forbedring, og hvor raskere og rimeligere behandling kan levere samme kvalitet. En arbeidsflyt for koding kan for eksempel bruke Sol til å avklare usikkerhet og utforme planen, og deretter Luna til å gjennomføre klart definerte endringer, skrive og kjøre tester og evaluere resultatene. En annen arbeidsflyt kan kreve en annen balanse.
GPT‑5.6-familien utvider valgmulighetene. Bedrifter kan bruke den høyeste nyttige intelligensen i hvert trinn og betale en pris som står i forhold til verdien den skaper.
Denne fleksibiliteten begynner med å effektivisere hvert lag bak modellene.
Effektivitetsfortrinnet vårt kommer av forbedringer i modellene, inferenssystemene som kjører dem, og det agentbaserte rammeverket som kobler dem til verktøy og kontekst. GPT‑5.6-modellene tar en mer direkte vei gjennom arbeidet. Bedre ruting holder maskinvaren produktiv, optimalisert produksjonsprogramvare genererer tokener mer effektivt, og smartere konteksthåndtering hjelper agenter med å unngå å gjenta fullført arbeid. Samlet gjør disse forbedringene at vi kan utføre mer nyttig arbeid med samme datakraft, slik at hvert resultat krever mindre tid, færre tokener og lavere kostnader.
GPT‑5.6 Sol hjelper oss i stadig større grad med å finne og realisere neste runde med forbedringer. Som del av en menneskeledet prosess skrev Sol på egen hånd om og optimaliserte produksjonskjerner, utformet og gjennomførte hundrevis av eksperimenter for å forbedre token-genereringen og overvåket opplæringen og grep inn når problemer oppsto. Arbeidet med kjernene bidro til å redusere totalkostnaden ved å drifte modellen med 20 %, mens eksperimentene økte effektiviteten i token-genereringen med mer enn 15 %. Arbeidet fortsetter og skaper en tettere tilbakemeldingssløyfe: Etter hvert som modellene våre blir bedre og kan arbeide mer selvstendig, øker tempoet i effektiviseringsarbeidet. Les mer om teknologien bak GPT‑5.6.
Å dekke etterspørselen etter lett tilgjengelig intelligens krever både mer datakraft og mer produktiv bruk av den. Vi bygger en robust infrastrukturportefølje og tilpasser hver arbeidsmengde til systemene som er best egnet til å kjøre den. Denne tilnærmingen støtter begge ender av pris-ytelseskurven. I den rimelige enden gjør de nye prisene på Luna og Terra det økonomisk lønnsomt å utføre store datamengder i langt større skala. I den avanserte enden gir Hurtigmodus API-kunder raskere tilgang til Sol når responstiden er viktig.
Virksomheter kan innlemme mer KI i den daglige driften uten å ofre hastigheten i det mest kritiske arbeidet. Omfattende dokumentanalyse, klassifisering av kundeinteraksjoner og rutinemessig implementering kan bli lønnsomt å bruke bredt, mens komplekse arbeidsmengder med Sol kan kjøres raskere når pristillegget kan forsvares.
Fordelene kan forsterke seg. I en menneskestyrt prosess hjelper mer avanserte modeller vårt tekniske team med å finne neste generasjon forbedringer, slik at veien til bedre ytelse og lavere kostnader blir kortere. Strategien vår er fortsatt å forbedre både kapasitet og effektivitet, slik at hver nye generasjon intelligens kan utføre mer arbeid til en lavere kostnad.
GPT‑5.6 Terra og Luna er fortsatt tilgjengelige i ChatGPT Work, Codex og OpenAI-API. I ChatGPT Work og Codex får Free- og ChatGPT Go-brukere tilgang til Terra, mens brukere av ChatGPT Plus, ChatGPT Pro, Business og Enterprise kan velge Terra og Luna.
Fra 30. juli er API-prisen 2 dollar per million inndata-tokener og 12 dollar per million utdata-tokener for Terra. For Luna er den 0,20 dollar per million inndata-tokener og 1,20 dollar per million utdata-tokener. Prisen på Sol blir uendret. Abonnementsprisene og kvotebudsjettene for ChatGPT og Codex blir uendret, mens bruk av Terra og Luna nå krever færre kreditter. Prisendringene begynner å rulles ut i AWS senere i dag.
Hurtigmodus for GPT‑5.6 Sol erstatter prioritert behandling i API-et og samsvarer med /fast i Codex. Eksisterende API-forespørsler merket «priority» vil fortsatt fungere. Se fullstendig prisinformasjon for API-et.


