Overslaan naar hoofdinhoud
OpenAI

30 juli 2026

Product

De prijs-prestatiegrens verleggen met GPT‑5.6

Door elke laag efficiënter te maken, levert OpenAI bij meer zakelijke workloads betere prestaties per dollar.

Bezig met laden...

Gisteren deelden we hoe GPT‑5.6 hielp om zichzelf efficiënter te laten draaien. Vandaag geven we die winst door aan klanten met lagere prijzen voor GPT‑5.6 Luna(opent in een nieuw venster) en Terra(opent in een nieuw venster), en snellere prestaties met GPT‑5.6 Sol in de API. Samen helpen deze updates klanten meer te halen uit elke dollar die ze in AI investeren en sneller te handelen wanneer tijd cruciaal is.

Vanaf vandaag wordt GPT‑5.6 Luna, ons snelste en betaalbaarste model, 80% goedkoper, terwijl GPT‑5.6 Terra, ons uitgebalanceerde model voor dagelijks werk, 20% goedkoper wordt. De lagere prijzen voor Luna en Terra werken ook door in de manier waarop gebruik meetelt voor betaalde abonnementen bij gebruik van Codex en ChatGPT Work. Luna biedt bedrijven een veel kosteneffectievere manier om grote hoeveelheden werk van zeer hoge kwaliteit te verwerken. Het kan tools gebruiken en meerstapsworkflows voltooien, waardoor een breder scala aan AI-toepassingen praktisch op grote schaal kan worden ingezet.

Geavanceerde intelligentie ruimer beschikbaar en betaalbaarder maken staat centraal in de missie van OpenAI om ervoor te zorgen dat AGI de hele mensheid ten goede komt. Deze veranderingen brengen die belofte in de praktijk. Ze weerspiegelen jarenlange verbeteringen in de manier waarop onze modellen worden gebouwd, aangeboden en ingezet.

We introduceren ook de Fast-modus in de API, die ons aanbod Priority Processing vervangt. Voor GPT‑5.6 Sol biedt de Fast-modus nu tot 2,5 keer hogere snelheden dan standaardverwerking, voor twee keer de prijs en zonder verandering in intelligentie. De Fast-modus is achterwaarts compatibel: verzoeken met de tag priority gebruiken automatisch de Fast-modus.

1 van 6
GPT‑5.6 Luna komt het dichtst bij intelligentie die zo goedkoop is dat meten niet meer nodig is. Ik heb nog nooit een model gezien dat zo betaalbaar en tegelijkertijd zo krachtig is. Het maakt toepassingen voor Replit mogelijk waarvan we dachten dat we ze pas veel later zouden kunnen bouwen.
Michele Catasta, President & Head of AI, Replit

De intelligentie afstemmen op het gewenste resultaat

Efficiënt gebruik van AI begint bij het gewenste resultaat. Het belang, de kosten van fouten, de urgentie en de schaal bepalen de juiste balans tussen intelligentie, snelheid, betrouwbaarheid en kosten. Die balans kan per stap van een workflow veranderen.

GPT‑5.6 geeft bedrijven veel meer ruimte om die afweging te optimaliseren. Luna levert prestaties die vergelijkbaar zijn met modellen die een jaar geleden nog grensverleggend waren, tegen ongeveer 6 cent per taak voor elke dollar die vergelijkbare modellen kosten, en met bijna negen keer de snelheid. Bij professioneel werk, gemeten met Agents’ Last Exam, presteert Luna beter dan Fable 5 tegen naar schatting bijna 99% lagere kosten per taak.

In de praktijk kunnen bedrijven het gewenste resultaat en kwaliteitsniveau bepalen en vervolgens met evaluaties vaststellen waar extra intelligentie het resultaat wezenlijk verbetert en waar snellere, goedkopere verwerking dezelfde kwaliteit kan leveren. Een programmeerworkflow kan Sol bijvoorbeeld gebruiken om onzekerheid weg te nemen en het plan te bepalen, en vervolgens Luna inzetten om duidelijk omschreven wijzigingen door te voeren, tests te schrijven en uit te voeren en de resultaten te beoordelen. Een andere workflow kan om een andere balans vragen.

De GPT‑5.6-familie vergroot het scala aan keuzemogelijkheden. Bedrijven kunnen in elke fase de maximaal bruikbare intelligentie inzetten en daarbij een passende prijs betalen voor de waarde die deze creëert.

Om die flexibiliteit te bieden, moet elke laag achter de modellen efficiënter worden.

Hoe we de efficiëntiegrens verleggen

Onze voorsprong in efficiëntie komt voort uit verbeteringen aan de modellen, de inferentiesystemen waarop ze draaien en de agentische harness die ze met tools en context verbindt. GPT‑5.6-modellen volgen een directere route door het werk. Betere routering houdt hardware productief, geoptimaliseerde productiesoftware genereert tokens efficiënter en slimmer contextbeheer helpt agents voorkomen dat ze voltooid werk herhalen. Samen stellen deze verbeteringen ons in staat om met dezelfde rekenkracht meer nuttig werk te voltooien, waardoor per resultaat minder tijd, tokens en kosten nodig zijn.

GPT‑5.6 Sol helpt ons steeds vaker om de volgende reeks verbeteringen te vinden en door te voeren. Binnen een door mensen geleid proces herschreef en optimaliseerde Sol zelfstandig productiekernels, ontwierp en voerde zelfstandig honderden experimenten uit om de tokengeneratie te verbeteren en bewaakte het trainingen, waarbij het ingreep wanneer zich problemen voordeden. Het werk aan de kernels hielp de totale kosten voor het aanbieden van het model met 20% te verlagen, terwijl de experimenten de efficiëntie van tokengeneratie met meer dan 15% verhoogden. Dit werk gaat door en creëert een steeds directere feedbacklus: naarmate onze modellen verbeteren en zelfstandiger kunnen werken, kunnen we ook sneller verdere efficiëntiewinst boeken. Lees meer over de techniek achter GPT‑5.6.

Een rekenstrategie die is ontworpen voor schaalbaarheid

Om aan de vraag naar ruimschoots beschikbare intelligentie te voldoen, is zowel meer als productievere rekenkracht nodig. We bouwen een robuust infrastructuurportfolio en koppelen elke workload aan de systemen die het meest geschikt zijn om deze uit te voeren. Die aanpak ondersteunt beide uiteinden van de prijs-prestatiecurve. Aan de voordelige kant maken de nieuwe prijzen van Luna en Terra grootschalig werk op een veel grotere schaal rendabel. Aan de grensverleggende kant biedt de Fast-modus API-klanten sneller toegang tot Sol wanneer de responstijd belangrijk is.

Ondernemingen kunnen meer AI in hun dagelijkse bedrijfsvoering opnemen zonder bij hun belangrijkste werk aan snelheid in te boeten. Grootschalige documentanalyse, classificatie van klantinteracties en routinematige implementaties kunnen breed en rendabel worden ingezet, terwijl complexe Sol-workloads sneller kunnen worden uitgevoerd wanneer de meerprijs gerechtvaardigd is.

De voordelen kunnen elkaar versterken. Binnen een door mensen geleid proces helpen krachtigere modellen ons technische team de volgende generatie verbeteringen te vinden, waardoor betere prestaties en lagere kosten sneller binnen bereik komen. Onze strategie blijft gericht op het verbeteren van zowel de mogelijkheden als de efficiëntie, zodat elke generatie intelligentie meer werk kan verrichten tegen lagere kosten.

Beschikbaarheid en prijzen

GPT‑5.6 Terra en Luna blijven beschikbaar in ChatGPT Work, Codex en de OpenAI API. In ChatGPT Work en Codex hebben gebruikers met Free en ChatGPT Go toegang tot Terra, terwijl gebruikers met ChatGPT Plus, ChatGPT Pro, Business en Enterprise kunnen kiezen tussen Terra en Luna.

Vanaf 30 juli bedragen de API-prijzen voor Terra $ 2 per miljoen inputtokens en $ 12 per miljoen outputtokens, en voor Luna $ 0,20 per miljoen inputtokens en $ 1,20 per miljoen outputtokens. De prijs van Sol blijft ongewijzigd. De abonnementsprijzen en quotumbudgetten van ChatGPT en Codex blijven ongewijzigd, terwijl het gebruik van Terra en Luna nu minder credits verbruikt. De prijswijzigingen worden later vandaag geleidelijk doorgevoerd in AWS.

De Fast-modus voor GPT‑5.6 Sol vervangt Priority Processing in de API en sluit aan op /fast in Codex. Bestaande API-verzoeken met de tag priority blijven werken. Bekijk alle details over API-prijzen.

Auteur

OpenAI