API-Preisgestaltung
Flagship-Modelle
Unsere Frontier-Modelle sind darauf ausgelegt, mehr Zeit zum Nachdenken zu investieren, bevor eine Antwort gegeben wird. Dies macht sie ideal zum Lösen komplexer und mehrstufiger Probleme.
GPT-5.6 Sol
Flagship-Modell für anspruchsvolles agentisches Arbeiten
Preis
Eingabe:$5.00 / 1 Mio. TokensZwischengespeicherte Eingabe:$0.50 / 1 Mio. TokensAusgabe:$30.00 / 1 Mio. Tokens
GPT-5.6 Terra
Ausgewogenes Modell für effizientes Arbeiten mit hohem Volumen
Preis
Eingabe:$2.50 / 1 Mio. TokensZwischengespeicherte Eingabe:$0.25 / 1 Mio. TokensAusgabe:$15.00 / 1 Mio. Tokens
GPT-5.6 Luna
Schnelles, kostengünstiges Modell für alltägliche Arbeit
Preis
Eingabe:$1.00 / 1 Mio. TokensZwischengespeicherte Eingabe:$0.10 / 1 Mio. TokensAusgabe:$6.00 / 1 Mio. Tokens
Die oben genannten Preise entsprechen den Standardverarbeitungssätzen für Kontextlängen unter 270.000 Tokens.
Erfahre mehr über Stapelverarbeitung(wird in einem neuen Fenster geöffnet) sowie Datenresidenz und regionale Verarbeitung(wird in einem neuen Fenster geöffnet)
Multimodale Modelle
Ermögliche Anwendungen in den Bereichen Text, Bilder und Audio mit Modellen, die für Echtzeitinteraktionen und die Erstellung von Rich-Media-Inhalten entwickelt wurden.
GPT-Realtime-2.1
Unser leistungsfähigstes Modell für Echtzeit-Sprachinteraktionen mit integriertem fortschrittlichem Reasoning.
Preis
Audio:$32.00 / 1 Mio. Tokens für Eingaben$0.40 / 1 Mio. Tokens für zwischengespeicherte Eingaben$64.00 / 1 Mio. Tokens für AusgabenText:$4.00 / 1 Mio. Tokens für Eingaben$0.40 / 1 Mio. Tokens für zwischengespeicherte Eingaben$24.00 / 1 Mio. Tokens für AusgabenBild:$5.00 / 1 Mio. Tokens für Eingaben$0.50 / 1 Mio. Tokens für zwischengespeicherte Eingaben
GPT-Realtime-2.1 mini
Unser bislang leistungsstärkstes Mini-Modell für Sprachinteraktionen in Echtzeit – mit integriertem fortschrittlichem Reasoning (Schlussfolgern).
Preis
Audio:$10.00 / 1 Mio. Tokens für Eingaben$0.30 / 1 Mio. Tokens für zwischengespeicherte Eingaben$20.00 / 1 Mio. Tokens für AusgabenText:$0.60 / 1 Mio. Tokens für Eingaben$0.06 / 1 Mio. Tokens für zwischengespeicherte Eingaben$2.40 / 1 Mio. Tokens für AusgabenBild:$0.80 / 1 Mio. Tokens für Eingaben$0.08 / 1 Mio. Tokens für zwischengespeicherte Eingaben
GPT-Realtime-Translate
Ein Modell, das Sprache in Echtzeit übersetzt und mit der sprechenden Person Schritt hält.
Preis
$0.034 pro Minute / $0.00057 pro Sekunde
GPT-Realtime-Whisper
Ein Streaming-Speech-to-Text-Modell, das Sprache live transkribiert, während jemand spricht.
Preis
$0.017 pro Minute / $0.00028 pro Sekunde
GPT-Image-2
Hochmodernes Bildgenerierungsmodell.
Preis
Bild:$8.00 / 1 Mio. Tokens für Eingaben$2.00 / 1 Mio. Tokens für zwischengespeicherte Eingaben$30.00 / 1 Mio. Tokens für AusgabenText:$5.00 / 1 Mio. Tokens für Eingaben$1.25 / 1 Mio. Tokens für zwischengespeicherte Eingaben
Tools
Erweitere die Modellfunktionen mit integrierten Tools für Abruf, Ausführung und externen Datenzugriff.
Internetsuche
Abrufen aktueller Informationen aus dem Web, um Modellantworten zu untermauern.
Preis
$10.00 /1 000 AufrufeSuchinhalts-Tokens sind kostenlos.
Container
Führe Code und Tools in sicheren, skalierbaren Umgebungen neben deinen Modellen aus.
Preis
Jetzt:1 GB für $0.03 / 64 GB für $1.92 pro ContainerAb dem 31. März 2026:1 GB für $0.03 / 64 GB für $1.92 pro 20-minütige Sitzung pro Container
Servicestufen
Bringe Leistung, vorhersehbare Kosten und Verfügbarkeit entsprechend deinen Anforderungen in Einklang.
Batch API
Spare mit der Batch-API 50 % an Ein- und Ausgaben und führe Aufgaben asynchron über 24 Stunden aus.
Vorrangige Barbeitung
Bietet zuverlässige Hochgeschwindigkeitsleistung mit der Flexibilität von „Pay as you go“.
Flex-Bearbeitung
Bietet niedrigere Kosten für Anfragen bei langsameren Antwortzeiten und gelegentlicher Nichtverfügbarkeit von Ressourcen. Ideal für Aufgaben, die nicht produktionsrelevant sind oder eine geringere Priorität haben.
Angebote für Unternehmen
Wende dich an unser Vertriebsteam, um mehr über Datenresidenz(wird in einem neuen Fenster geöffnet), Scale Tier und reservierte Kapazität zu erfahren, die für anspruchsvolle Kund:innen mit größeren Workloads entwickelt wurden.