Zum Hauptinhalt springen
OpenAI

13. August 2026

Produkt

Ultraschnellmodus-Vorschau: GPT‑5.6 Sol bis zu 14x schneller

Eine neue Geschwindigkeitsklasse für Frontier-Intelligenz, die Tempo zum Wettbewerbsvorteil macht.

Laden …

Heute geben wir einen ersten Einblick in Ultraschnell, eine neue Servicestufe, in der GPT‑5.6 Sol bis zu 14-mal schneller als bei der Standardverarbeitung läuft und die zunächst in der OpenAI API eingeführt wird. Ultraschnell basiert auf Cerebras und generiert bis zu 750 Ausgabe-Tokens pro Sekunde. So kommt unser intelligentestes Modell in Produkten und Arbeitsabläufen zum Einsatz, bei denen jede Sekunde zählt.

Mit GPT‑5.6 erweitern wir die Grenzen dessen, was unsere Modelle leisten können, und steigern ihre Effizienz auf jeder Ebene unseres Technologie-Stacks. Durch diese Verbesserungen ist fortschrittliche Intelligenz erschwinglicher und für mehr Menschen nützlicher geworden. Bisher erforderte Geschwindigkeit in Echtzeit meist ein kleineres oder stärker spezialisiertes Modell. Ultraschnell weist in eine neue Richtung: mehr nützliche Arbeit pro Sekunde.

Wenn Geschwindigkeit keine Abstriche bei der Intelligenz mehr erfordert, kann KI in den zeitkritischsten Bereichen eines Unternehmens zum Einsatz kommen, und neue Arten von Arbeit werden möglich. Wir haben bereits einige vielversprechende Einsatzszenarien für Ultraschnell beobachtet:

  • Störungsbehebung und Zuverlässigkeit: Wenn ein kritisches System ausfällt, lassen sich Anwendungsprotokolle, jüngste Codeänderungen und Berichte des Entwicklungsteams analysieren, um noch während der Störung die wahrscheinliche Ursache zu ermitteln und eine Fehlerbehebung vorzubereiten.
  • Finanzanalyse und Sicherheit: Marktsignale analysieren, Transaktionen bewerten und verdächtige Aktivitäten erkennen, während sich die Bedingungen noch verändern.
  • Kundensupport und Sprachfunktionen: Komplexe Anliegen in Echtzeit lösen, ohne das Gespräch zu unterbrechen, selbst wenn für die Suche nach der Antwort mehrere Schritte oder Systeme erforderlich sind.
  • E-Commerce: Produktfragen beantworten, Bestände prüfen, Empfehlungen personalisieren und Probleme beim Bezahlvorgang lösen, während die Kund:innen noch überlegen – bevor das Zögern zum Kaufabbruch führt.
  • Interaktive Forschung und Experimente: Forschung, die zuvor über Nacht laufen musste, wird zu einer interaktiven Arbeitssitzung. Teams können eine Idee testen, Ergebnisse untersuchen, ihren Ansatz anpassen und ein weiteres Experiment durchführen, ohne ihren Arbeitsfluss zu unterbrechen.

Während der Vorschau arbeiten wir mit einer ersten Gruppe von Kund:innen zusammen, um zu verstehen, wo diese Geschwindigkeit den größten Unterschied macht und wie diese Erkenntnisse unsere Produkte im Laufe der Zeit prägen können. Wenn dein Unternehmen Frontier-Intelligenz mit höchster Geschwindigkeit benötigt, kannst du dich registrieren, um benachrichtigt zu werden, sobald der Zugang ausgeweitet wird.

GPT‑5.6 Sol Ultraschnell und Standard erstellen nebeneinander aus demselben Text-Prompt einen funktionsfähigen 3D-Lagersimulator.

Erfahrungen der ersten Kund:innen

Wir haben GPT‑5.6 Sol im Ultraschnellmodus mit einer ersten Gruppe von Unternehmen aus den Bereichen Coding, Handel, Finanzanalyse, Support und weiteren interaktiven Anwendungsfällen getestet. Indem wir mit Unternehmens-Workflows beginnen, können wir diese Bedingungen in realen Produktivumgebungen untersuchen. Die ersten Erfahrungen dieser Unternehmen helfen uns zu verstehen, wo eine um eine Größenordnung höhere Geschwindigkeit den größten Nutzen schafft und wie sich Produkte verändern, wenn das Modell mit den Nutzer:innen Schritt halten kann. Diese Erkenntnisse werden uns bei der weiteren Bereitstellung mit wachsender Kapazität als Orientierung dienen.

1 von 4
Die von Cerebras erzielte Geschwindigkeitssteigerung ist beeindruckend. Sie ermöglicht neue Einsatzweisen für die Modelle und macht es für Entwicklungsteams praktikabel, fokussierter und produktiver mit ihnen zu arbeiten.
John Crepezzi, AI Assistants, Jane Street

Wie OpenAI Ultraschnell einsetzt

Bei OpenAI testet eine Gruppe aus dem Entwicklungsteam GPT‑5.6 Sol im Ultraschnellmodus, um herauszufinden, welche Arbeitsabläufe von Frontier-Intelligenz mit Antworten in Echtzeit profitieren.

Unser Team setzt Ultraschnell beispielsweise bei der Störungsbehebung ein. Wenn eine Warnmeldung ausgelöst wird, müssen sich Entwickler:innen ein präzises Bild der Lage machen, während sich das System und die Beweislage noch verändern. Teams nutzen Ultraschnell, um schnell Logs zu lesen, Traces zu analysieren, Gespräche zusammenzufassen, die nächsten Prüfungen zu ermitteln und einen Fix vorzubereiten oder zu validieren – all das dank der Intelligenz von Sol in einem Bruchteil der Zeit. Dadurch verkürzt sich die Zeit zwischen dem Erkennen eines Signals, dem Prüfen einer Hypothese und der Entscheidung über den nächsten Schritt, während die Verantwortung für die Beurteilung und das Deployment bei den Entwickler:innen bleibt.

In der Forschung nutzt unser Team Ultraschnell, um Wissensquellen rasch zu durchsuchen, Daten abzufragen sowie Informationen über verbundene Tools hinweg schnell zu erfassen, zu ordnen und zusammenzufassen. Ein typischer Forschungsablauf besteht darin, dass Teammitglieder über Nacht eine Reihe von Experimenten ausführen und die Ergebnisse am Morgen prüfen. Mit Ultraschnell verkürzt sich dieser Zyklus so weit, dass stattdessen mehrere Durchläufe während des Arbeitstags möglich werden.

Unterstützt von Cerebras

Ultraschnell ist der nächste Schritt in unserer Partnerschaft mit Cerebras, um Inferenz mit extrem niedriger Latenz auf die Plattform von OpenAI zu bringen. Mit GPT‑5.6 Sol im Ultraschnellmodus unterstützt Cerebras nun das intelligenteste Modell von OpenAI und liefert bis zu 750 Ausgabe-Tokens pro Sekunde. So können Unternehmen reaktionsschnellere Produkte entwickeln, schneller entscheiden und leistungsfähige KI direkt in ihre anspruchsvollsten Arbeitsabläufe integrieren.

Verfügbarkeit

GPT‑5.6 Sol ist im Ultraschnellmodus ab heute im Rahmen einer begrenzten Vorschau für eine ausgewählte Gruppe von Kund:innen verfügbar. Mit wachsender Kapazität werden wir den Zugang erweitern. Für Neuigkeiten registrieren.