Gå direkt till huvudinnehåll
OpenAI

30 juli 2026

Produkt

Bättre pris och prestanda med GPT‑5.6

Genom att effektivisera varje lager ger OpenAI mer prestanda per krona för fler arbetsbelastningar i företag.

Laddar …

I går berättade vi hur GPT‑5.6 bidrog till att göra sig själv effektivare att köra. I dag låter vi kunderna ta del av vinsterna genom lägre priser på GPT‑5.6 Luna(öppnas i ett nytt fönster) och Terra(öppnas i ett nytt fönster) samt högre prestanda med GPT‑5.6 Sol i API:et. Tillsammans hjälper uppdateringarna kunderna att få ut mer av varje krona de investerar i AI och att arbeta snabbare när tiden är avgörande.

Från och med i dag kostar GPT‑5.6 Luna, vår snabbaste och mest prisvärda modell, 80 % mindre, medan GPT‑5.6 Terra, vår balanserade modell för det dagliga arbetet, kostar 20 % mindre. De lägre priserna på Luna och Terra avspeglas också i hur användningen räknas av från betalda abonnemang i Codex och ChatGPT Work. Luna ger företag ett betydligt mer kostnadseffektivt sätt att hantera stora arbetsvolymer med mycket hög kvalitet. Den kan använda verktyg och slutföra arbetsflöden i flera steg, vilket gör det praktiskt möjligt att köra fler typer av AI-tillämpningar i stor skala.

Att göra avancerad intelligens mer tillgänglig och prisvärd är centralt för OpenAI:s uppdrag att säkerställa att AGI kommer hela mänskligheten till nytta. De här förändringarna omsätter detta åtagande i praktiken. De speglar åratal av förbättringar av hur våra modeller byggs, tillhandahålls och används.

Vi lanserar även Snabbläge i API:et, som ersätter vårt erbjudande Prioritetsbearbetning. För GPT‑5.6 Sol ger Snabbläge nu upp till 2,5 gånger högre hastighet än standardbearbetning till dubbla priset, utan någon förändring av intelligensen. Snabbläge är bakåtkompatibelt: förfrågningar märkta priority använder automatiskt Snabbläge.

1 av 6
GPT‑5.6 Luna är det närmaste vi har kommit intelligens som är för billig för att mätas. Jag har aldrig sett en så här prisvärd modell vara så kraftfull – den öppnar användningsområden för Replit som vi inte trodde att vi skulle kunna bygga för på länge.
Michele Catasta, vd och AI-chef, Replit

Anpassa intelligensen efter resultatet

Effektiv användning av AI börjar med det önskade resultatet. Vad som står på spel, kostnaden för fel, tidskraven och skalan avgör rätt balans mellan intelligens, hastighet, tillförlitlighet och kostnad. Den balansen kan ändras från ett steg i arbetsflödet till nästa.

GPT‑5.6 ger företag betydligt större utrymme att optimera den ekvationen. Luna ger prestanda i nivå med modeller som var banbrytande för ett år sedan, till en kostnad per uppgift på cirka 6 cent per dollar och upp till nästan nio gånger snabbare. För kvalificerat arbete, mätt med Agents’ Last Exam, överträffar Luna Fable 5 till en uppskattad kostnad per uppgift som är nästan 99 % lägre.

I praktiken kan företag definiera vilket resultat och vilken kvalitetsnivå de behöver och sedan använda utvärderingar för att avgöra var ytterligare intelligens förbättrar resultatet väsentligt och var snabbare bearbetning till lägre kostnad kan ge samma kvalitet. Ett arbetsflöde för programmering kan till exempel använda Sol för att reda ut osäkerheter och ta fram planen, och sedan Luna för att genomföra tydligt definierade ändringar, skriva och köra tester samt utvärdera resultaten. Ett annat arbetsflöde kan kräva en annan balans.

GPT‑5.6-familjen ger fler valmöjligheter. Företag kan använda så mycket intelligens som är meningsfullt i varje steg och samtidigt betala ett pris som motsvarar värdet som skapas.

För att skapa den flexibiliteten måste varje lager bakom modellerna bli effektivare.

Så flyttar vi fram gränsen för effektivitet

Vårt effektivitetsförsprång kommer från förbättringar av modellerna, inferenssystemen som kör dem och den agentbaserade körmiljön som kopplar dem till verktyg och kontext. GPT‑5.6-modeller tar en rakare väg genom arbetet. Bättre dirigering håller maskinvaran produktiv, optimerad produktionsprogramvara genererar token effektivare och smartare kontexthantering hjälper agenter att undvika att upprepa redan slutfört arbete. Tillsammans gör förbättringarna att vi kan utföra mer värdefullt arbete med samma beräkningskapacitet och minska tiden, antalet token och kostnaden för varje resultat.

GPT‑5.6 Sol hjälper oss i allt högre grad att hitta och genomföra nästa omgång förbättringar. Inom en människostyrd process skrev Sol självständigt om och optimerade produktionskärnor, utformade och genomförde hundratals experiment för att förbättra tokengenereringen samt övervakade träningen och ingrep när problem uppstod. Arbetet med kärnorna bidrog till att sänka den totala kostnaden för att tillhandahålla modellen med 20 %, medan experimenten ökade effektiviteten i tokengenereringen med över 15 %. Arbetet fortsätter och skapar en tätare återkopplingscykel: när våra modeller förbättras och kan arbeta mer självständigt går det allt snabbare för oss att effektivisera verksamheten. Läs mer om tekniken bakom GPT‑5.6.

En beräkningsstrategi byggd för storskalighet

För att möta efterfrågan på lättillgänglig intelligens krävs både större och mer produktiv beräkningskapacitet. Vi bygger en robust infrastrukturportfölj och matchar varje arbetsbelastning med de system som lämpar sig bäst för att köra den. Det tillvägagångssättet stöder båda ändarna av pris- och prestandakurvan. I den billigare änden gör de nya priserna på Luna och Terra det ekonomiskt möjligt att hantera stora arbetsvolymer i betydligt större skala. I den banbrytande änden ger Snabbläge API-kunder snabbare tillgång till Sol när svarstiden är viktig.

Företag kan införa mer AI i den dagliga verksamheten utan att offra hastigheten i sitt mest betydelsefulla arbete. Storskalig dokumentanalys, klassificering av kundinteraktioner och rutinmässig implementering kan bli ekonomiskt möjliga att köra brett, medan komplexa arbetsbelastningar med Sol kan gå snabbare när merkostnaden är motiverad.

Vinsterna kan förstärka varandra. Inom en människostyrd process hjälper mer kapabla modeller vårt tekniska team att hitta nästa generations förbättringar, vilket kortar vägen till bättre prestanda och lägre kostnader. Vår strategi är fortsatt inriktad på att förbättra både kapacitet och effektivitet, så att varje ny generation av intelligens kan utföra mer arbete till en lägre kostnad.

Tillgänglighet och priser

GPT‑5.6 Terra och Luna är fortsatt tillgängliga i ChatGPT Work, Codex och OpenAI API. I ChatGPT Work och Codex har användare med Free och ChatGPT Go tillgång till Terra, medan användare med ChatGPT Plus, ChatGPT Pro, Business och Enterprise kan välja Terra och Luna.

Från och med den 30 juli är API-priset för Terra 2 USD per miljon inkommande token och 12 USD per miljon utgående token, och för Luna 0,20 USD per miljon inkommande token och 1,20 USD per miljon utgående token. Priset för Sol är oförändrat. Priserna och kvotbudgetarna för abonnemang på ChatGPT och Codex är oförändrade, medan användning av Terra och Luna nu förbrukar färre krediter. Prisändringarna börjar införas i AWS senare i dag.

Snabbläge för GPT‑5.6 Sol ersätter Prioritetsbearbetning i API:et och motsvarar "/fast" i Codex. Befintliga API-förfrågningar märkta "priority" fortsätter att fungera. Se fullständig information om API-priser.

Författare

OpenAI