Zum Hauptinhalt springen
OpenAI

30. Juli 2026

Produkt

Mit GPT‑5.6 neue Maßstäbe bei Preis und Leistung setzen

OpenAI macht jede Ebene effizienter und bietet so bei mehr Arbeitslasten in Unternehmen eine höhere Leistung pro investiertem Dollar.

Laden …

Gestern haben wir erläutert, wie GPT‑5.6 dazu beigetragen hat, dass sich das Modell effizienter betreiben lässt. Heute geben wir diese Vorteile an unsere Kundschaft weiter: mit niedrigeren Preisen für GPT‑5.6 Luna(wird in einem neuen Fenster geöffnet) und Terra(wird in einem neuen Fenster geöffnet) sowie höherer Geschwindigkeit für GPT‑5.6 Sol in der API. Mit diesen Neuerungen holen Unternehmen mehr aus jedem in KI investierten Dollar heraus und kommen schneller voran, wenn Zeit entscheidend ist.

Ab heute kostet GPT‑5.6 Luna, unser schnellstes und günstigstes Modell, 80 % weniger. GPT‑5.6 Terra, unser ausgewogenes Modell für alltägliche Aufgaben, kostet 20 % weniger. Die niedrigeren Preise für Luna und Terra wirken sich auch darauf aus, wie die Nutzung von Codex und ChatGPT Work auf kostenpflichtige Abonnements angerechnet wird. Mit Luna können Unternehmen große Arbeitsvolumen wesentlich kostengünstiger und in sehr hoher Qualität bearbeiten. Das Modell kann Tools nutzen und mehrstufige Workflows abschließen. So lässt sich ein größeres Spektrum an KI-Anwendungen wirtschaftlich im großen Maßstab betreiben.

Fortschrittliche Intelligenz breiter verfügbar und erschwinglicher zu machen, ist ein zentraler Bestandteil der Mission von OpenAI: AGI soll der gesamten Menschheit zugutekommen. Mit diesen Änderungen setzen wir dieses Ziel in die Praxis um. Sie sind das Ergebnis jahrelanger Verbesserungen bei der Entwicklung, Bereitstellung und praktischen Nutzung unserer Modelle.

Außerdem führen wir in der API den Schnellmodus ein. Er ersetzt unser bisheriges Angebot Priority Processing. Für GPT‑5.6 Sol bietet der Schnellmodus jetzt eine bis zu 2,5-mal höhere Geschwindigkeit als die Standardverarbeitung, zum doppelten Preis und bei unveränderter Intelligenz. Der Schnellmodus ist abwärtskompatibel: Mit „priority“ gekennzeichnete Anfragen verwenden automatisch den Schnellmodus.

1 von 6
Mit GPT‑5.6 Luna kommen wir einer Intelligenz, deren Nutzungskosten kaum noch ins Gewicht fallen, so nahe wie nie zuvor. Ich habe noch nie ein so günstiges Modell mit einer solchen Leistung gesehen. Es ermöglicht Replit Anwendungsfälle, mit denen wir erst viel später gerechnet hatten.
Michele Catasta, President & Head of AI, Replit

Die passende Intelligenz für das gewünschte Ergebnis

Der effiziente Einsatz von KI beginnt beim gewünschten Ergebnis. Tragweite, Fehlerkosten, Dringlichkeit und Umfang bestimmen das richtige Verhältnis von Intelligenz, Geschwindigkeit, Zuverlässigkeit und Kosten. Dieses Verhältnis kann sich von einem Schritt des Workflows zum nächsten ändern.

GPT‑5.6 gibt Unternehmen deutlich mehr Spielraum, dieses Verhältnis zu optimieren. Luna erreicht eine Leistung, die mit den führenden Modellen von vor einem Jahr vergleichbar ist. Dabei kostet eine Aufgabe nur etwa 6 Cent pro Dollar und wird fast neunmal so schnell erledigt. Bei professionellen Aufgaben, gemessen mit Agents’ Last Exam, übertrifft Luna Fable 5 bei geschätzten Kosten pro Aufgabe, die fast 99 % niedriger sind.

In der Praxis können Unternehmen das gewünschte Ergebnis und Qualitätsniveau festlegen. Anschließend zeigen Evaluationen, wo zusätzliche Intelligenz das Ergebnis wesentlich verbessert und wo eine schnellere, kostengünstigere Verarbeitung dieselbe Qualität erzielt. Ein Coding-Workflow könnte beispielsweise Sol nutzen, um Unklarheiten zu beseitigen und einen Plan zu erstellen. Luna setzt anschließend klar definierte Änderungen um, schreibt und führt Tests aus und bewertet die Ergebnisse. Ein anderer Workflow kann ein anderes Verhältnis erfordern.

Die GPT‑5.6-Familie erweitert diese Auswahlmöglichkeiten. Unternehmen können in jeder Phase so viel Intelligenz wie sinnvoll einsetzen und einen Preis zahlen, der dem geschaffenen Wert entspricht.

Diese Flexibilität setzt voraus, dass jede Ebene hinter den Modellen effizienter wird.

Wie wir die Effizienz weiter steigern

Unser Effizienzvorsprung beruht auf Verbesserungen an den Modellen, den Inferenzsystemen, die sie ausführen, und dem agentenbasierten Harness, der sie mit Tools und Kontext verbindet. GPT‑5.6-Modelle erledigen Aufgaben auf direkterem Weg. Besseres Routing sorgt für eine produktive Hardwareauslastung, optimierte Produktionssoftware erzeugt Tokens effizienter und intelligenteres Kontextmanagement verhindert, dass Agenten bereits erledigte Arbeit wiederholen. Zusammen ermöglichen diese Verbesserungen mehr nützliche Arbeit mit derselben Rechenleistung. Dadurch sinken Zeitaufwand, Token-Nutzung und Kosten pro Ergebnis.

GPT‑5.6 Sol hilft uns zunehmend dabei, weitere Verbesserungen zu finden und umzusetzen. In einem von Menschen geleiteten Prozess überarbeitete und optimierte Sol selbstständig produktive Kernel, konzipierte und führte Hunderte Experimente zur Verbesserung der Token-Generierung durch und überwachte das Training, um bei Problemen einzugreifen. Die Arbeit an den Kerneln trug dazu bei, die Gesamtkosten für die Bereitstellung des Modells um 20 % zu senken. Die Experimente steigerten zugleich die Effizienz der Token-Generierung um mehr als 15 %. Diese Arbeit geht weiter und verkürzt den Feedbackzyklus: Je besser unsere Modelle werden und je selbstständiger sie arbeiten können, desto schneller können wir die Effizienz steigern. Mehr über die technische Entwicklung hinter GPT‑5.6 erfahren.

Eine skalierbare Rechenstrategie

Um die Nachfrage nach umfassend verfügbarer Intelligenz zu decken, brauchen wir sowohl mehr als auch produktiver genutzte Rechenleistung. Wir bauen ein robustes Infrastrukturportfolio auf und führen jede Arbeitslast auf den dafür am besten geeigneten Systemen aus. Dieser Ansatz deckt beide Enden der Preis-Leistungs-Kurve ab. Am kostengünstigen Ende machen die neuen Preise für Luna und Terra große Arbeitsvolumen in deutlich größerem Maßstab wirtschaftlich. Am Frontier-Ende ermöglicht der Schnellmodus API-Kundschaft einen schnelleren Zugriff auf Sol, wenn kurze Antwortzeiten wichtig sind.

Unternehmen können mehr KI in ihre täglichen Abläufe integrieren, ohne bei besonders wichtigen Aufgaben auf Geschwindigkeit zu verzichten. Umfangreiche Dokumentanalysen, die Klassifizierung von Kundeninteraktionen und routinemäßige Implementierungen lassen sich wirtschaftlich in großem Maßstab betreiben. Komplexe Sol-Arbeitslasten können schneller ausgeführt werden, wenn der Aufpreis gerechtfertigt ist.

Die Vorteile können sich gegenseitig verstärken. In einem von Menschen geleiteten Prozess helfen leistungsfähigere Modelle unserem technischen Team, die nächste Generation von Verbesserungen zu finden. So gelangen wir schneller zu höherer Leistung und niedrigeren Kosten. Unsere Strategie zielt weiterhin darauf, Leistungsfähigkeit und Effizienz zugleich zu steigern, damit jede neue Generation von Intelligenz mehr Arbeit zu geringeren Kosten erledigen kann.

Verfügbarkeit und Preise

GPT‑5.6 Terra und Luna sind weiterhin in ChatGPT Work, Codex und der OpenAI API verfügbar. In ChatGPT Work und Codex können Personen mit Free und ChatGPT Go auf Terra zugreifen. Mit ChatGPT Plus, ChatGPT Pro, Business und Enterprise stehen Terra und Luna zur Auswahl.

Ab dem 30. Juli beträgt der API-Preis für Terra 2 USD pro Million Eingabe-Tokens und 12 USD pro Million Ausgabe-Tokens. Für Luna sind es 0,20 USD pro Million Eingabe-Tokens und 1,20 USD pro Million Ausgabe-Tokens. Der Preis für Sol bleibt unverändert. Die Abonnementpreise und Kontingente für ChatGPT und Codex bleiben unverändert. Die Nutzung von Terra und Luna verbraucht jetzt jedoch weniger Credits. Die neuen Preise werden im Laufe des heutigen Tages schrittweise in AWS eingeführt.

Der Schnellmodus für GPT‑5.6 Sol ersetzt Priority Processing in der API und entspricht /fast in Codex. Bestehende API-Anfragen mit der Kennzeichnung „priority“ funktionieren weiterhin. Alle Details zu den API-Preisen ansehen.

Autor

OpenAI