Flytter grænsen for pris og ydeevne med GPT‑5.6
Ved at effektivisere alle lag leverer OpenAI mere ydeevne for pengene på tværs af flere arbejdsbelastninger i virksomheder.
I går fortalte vi, hvordan GPT‑5.6 var med til at gøre sig selv mere effektiv i drift. I dag giver vi kunderne del i disse gevinster med lavere priser på GPT‑5.6 Luna(åbner i et nyt vindue) og Terra(åbner i et nyt vindue) samt hurtigere ydeevne med GPT‑5.6 Sol i API'en. Tilsammen hjælper opdateringerne kunderne med at få mere ud af hver dollar, de investerer i AI, og arbejde hurtigere, når tiden er afgørende.
Fra i dag bliver GPT‑5.6 Luna, vores hurtigste og billigste model, 80 % billigere, mens GPT‑5.6 Terra, vores alsidige model til det daglige arbejde, bliver 20 % billigere. De lavere priser på Luna og Terra afspejles også i, hvordan forbruget modregnes i betalte abonnementer ved brug af Codex og ChatGPT Work. Luna giver virksomheder en langt mere omkostningseffektiv måde at håndtere store arbejdsmængder på med et meget højt kvalitetsniveau. Den kan bruge værktøjer og gennemføre arbejdsgange i flere trin, så flere typer AI-applikationer bliver praktiske at køre i stor skala.
Det er centralt for OpenAI's mission om at sikre, at AGI gavner hele menneskeheden, at gøre avanceret intelligens mere tilgængelig og prisvenlig. Disse ændringer omsætter den forpligtelse til praksis. De afspejler mange års forbedringer af, hvordan vores modeller bygges, leveres og sættes i arbejde.
Vi introducerer også Hurtig tilstand i API'en som erstatning for vores Priority Processing-tilbud. For GPT‑5.6 Sol leverer Hurtig tilstand nu op til 2,5 gange højere hastighed end standardbehandling til den dobbelte pris uden ændringer i intelligensen. Hurtig tilstand er bagudkompatibel: Anmodninger mærket med priority bruger automatisk Hurtig tilstand.
Effektiv brug af AI begynder med det ønskede resultat. Betydningen, prisen for fejl, tidskravet og omfanget afgør den rette balance mellem intelligens, hastighed, pålidelighed og omkostninger. Denne balance kan ændre sig fra ét trin i en arbejdsgang til det næste.
GPT‑5.6 giver virksomheder langt bedre mulighed for at optimere dette regnestykke. Luna leverer ydeevne på niveau med modeller, der var banebrydende for et år siden, til cirka 6 cent pr. dollar pr. opgave og med næsten ni gange så høj hastighed. På professionelle opgaver, målt med Agents’ Last Exam, overgår Luna Fable 5 til en anslået pris pr. opgave, der er næsten 99 % lavere.
I praksis kan virksomheder definere det ønskede resultat og kvalitetsniveau og derefter bruge evalueringer til at afgøre, hvor ekstra intelligens forbedrer resultatet væsentligt, og hvor hurtigere og billigere behandling kan levere samme kvalitet. En arbejdsgang til kodning kan eksempelvis bruge Sol til at afklare usikkerhed og fastlægge planen og derefter bruge Luna til at implementere veldefinerede ændringer, skrive og køre test samt evaluere resultaterne. En anden arbejdsgang kan kræve en anden balance.
GPT‑5.6-familien udvider udvalget af disse muligheder. Virksomheder kan bruge mest mulig relevant intelligens i hvert trin og samtidig betale en pris, der svarer til den skabte værdi.
Denne fleksibilitet begynder med at gøre alle lag bag modellerne mere effektive.
Vores effektivitetsfordel kommer af at forbedre modellerne, inferenssystemerne, der kører dem, og det agentbaserede harness, som forbinder dem med værktøjer og kontekst. GPT‑5.6-modellerne løser opgaver mere direkte. Bedre routing udnytter hardwaren effektivt, optimeret produktionssoftware genererer tokens mere effektivt, og bedre kontekststyring hjælper agenter med at undgå at gentage udført arbejde. Tilsammen gør forbedringerne det muligt at udføre mere nyttigt arbejde med samme computerkapacitet og dermed reducere den tid, de tokens og de omkostninger, som hvert resultat kræver.
GPT‑5.6 Sol hjælper os i stigende grad med at finde og realisere den næste bølge af forbedringer. Som led i en menneskestyret proces omskrev og optimerede Sol selvstændigt produktionskerner, designede og gennemførte hundredvis af eksperimenter for at forbedre tokengenereringen og overvågede træningen med indgreb, når der opstod problemer. Arbejdet med kernerne reducerede de samlede omkostninger ved at levere modellen med 20 %, mens eksperimenterne øgede effektiviteten af tokengenereringen med mere end 15 %. Arbejdet fortsætter og skaber en tættere feedbackcyklus: Når vores modeller forbedres og kan arbejde mere selvstændigt, kan vi hurtigere øge effektiviteten. Læs mere om teknologien bag GPT‑5.6.
At imødekomme efterspørgslen efter rigelig intelligens kræver både mere computerkapacitet og en mere effektiv udnyttelse af den. Vi opbygger en robust portefølje af infrastruktur og matcher hver arbejdsbelastning med de systemer, der er bedst egnede til at køre den. Denne tilgang understøtter begge ender af pris-ydelseskurven. I den billige ende gør de nye priser på Luna og Terra store arbejdsmængder økonomisk rentable i langt større skala. I den banebrydende ende giver Hurtig tilstand API-kunder hurtigere adgang til Sol, når svartiden er vigtig.
Virksomheder kan integrere mere AI i den daglige drift uden at gå på kompromis med hastigheden i deres vigtigste arbejde. Omfattende dokumentanalyse, klassificering af kundeinteraktioner og rutineimplementering kan blive økonomisk rentable i bred anvendelse, mens komplekse Sol-arbejdsbelastninger kan afvikles hurtigere, når merprisen kan retfærdiggøres.
Gevinsterne kan forstærke hinanden. Som led i en menneskestyret proces hjælper mere effektive modeller vores tekniske team med at finde næste generation af forbedringer og forkorter vejen til bedre ydeevne og lavere omkostninger. Vores strategi er fortsat at forbedre både kapacitet og effektivitet, så hver ny generation af intelligens kan udføre mere arbejde til en lavere pris.
GPT‑5.6 Terra og Luna er fortsat tilgængelige i ChatGPT Work, Codex og OpenAI API. I ChatGPT Work og Codex har Free- og Go-brugere adgang til Terra, mens Plus-, Pro-, Business- og Enterprise-brugere kan vælge Terra og Luna.
Fra den 30. juli er API-prisen 2 USD pr. million inputtokens og 12 USD pr. million outputtokens for Terra samt 0,20 USD pr. million inputtokens og 1,20 USD pr. million outputtokens for Luna. Prisen på Sol er uændret. Priserne på ChatGPT- og Codex-abonnementer og deres kvotebudgetter er uændrede, mens brug af Terra og Luna nu forbruger færre kreditter. Prisændringerne begynder at blive udrullet i AWS senere i dag.
Hurtig tilstand til GPT‑5.6 Sol erstatter Priority Processing i API'en og svarer til /fast i Codex. Eksisterende API-anmodninger mærket med priority vil fortsat fungere. Se alle oplysninger om API-priser.


