今天,我們率先預覽全新服務層級「超快」。「超快」模式運行 GPT‑5.6 Sol 時的速度最高可達標準處理模式的 14 倍,並將率先在 OpenAI API 推出。「超快」模式由 Cerebras 驅動,每秒最多可輸出 750 個 Token,讓我們最智能的模型能夠應用於分秒必爭的產品和工作流程。
透過 GPT‑5.6,我們不但拓展模型能力的前沿,亦在技術架構的每一層提升模型效率。這些改進令先進智能變得更相宜,亦對更多人更實用。以往,要達到實時速度,通常需要選用較小型或較專門的模型。「超快」展示了一個新的進步方向:每秒完成更多有用工作。
當速度不再需要以犧牲智能為代價,AI 便能融入企業對時間最敏感的環節,開拓各種全新的工作方式。我們已看到一些令人鼓舞的「超快」模式應用情境:
- 事故應變與可靠性:當關鍵系統發生故障時,在事故仍在持續之際分析應用程式記錄、近期程式碼變更及工程師報告,找出可能原因並協助準備修正方案。
- 金融研究與安全監察:在市況仍然變化時分析市場訊號、評估交易並識別可疑活動。
- 客戶支援與語音服務:即使尋找答案需要經過多個步驟或使用多個系統,亦可在不中斷對話的情況下即時解決複雜的客戶問題。
- 商貿:趁顧客仍在考慮時回答產品問題、查核庫存、提供個人化建議並解決結帳問題,避免他們因猶豫而放棄購買。
- 實時研究與實驗:將以往需要通宵運行的研究變成互動工作階段,讓團隊可以測試構思、檢視結果、調整方法,再進行另一項實驗,而不會打斷工作節奏。
預覽期間,我們正與首批客戶合作,了解這種速度在哪些方面帶來最大效益,以及如何運用這些經驗持續改進產品。如果你的企業需要以最高速度運用前沿智能,可登記接收擴大開放使用的通知。
在「超快」和標準模式下,GPT‑5.6 Sol 並排使用相同的文字提示詞,建立可運作的 3D 倉庫模擬器。
我們一直與首批企業測試「超快」模式下的 GPT‑5.6 Sol,涵蓋程式編寫、商貿、金融研究、客戶支援及其他互動應用。從企業工作流程着手,讓我們能夠在實際生產環境中研究這些情況。這些客戶的初期使用情況有助我們了解,速度提升一個數量級能在哪些方面創造最大價值,以及當模型能夠跟上用戶的步伐時,產品會如何改變。隨着容量增加,我們會以這些發現為日後部署策略提供依據。
在 OpenAI 內部,一組開發人員一直測試「超快」模式下的 GPT‑5.6 Sol,以了解哪些工作流程能受惠於可實時回應的前沿智能。
事故應變是我們團隊使用「超快」模式的其中一個例子。警報觸發時,工程師需要在系統和證據仍然變化之際,迅速掌握準確的全貌。團隊利用它快速讀取記錄、分析追蹤資料、綜合對話內容、確定下一步檢查,並協助準備或驗證修正方案;憑藉 Sol 的智能,所需時間大幅縮短。它縮短從觀察訊號、測試假設到決定下一步行動所需的時間,而工程師仍須負責判斷和部署。
在研究方面,我們的團隊利用「超快」模式快速搜尋知識來源、查詢數據,並透過互相連接的工具迅速收集、整理和總結資料。以往,團隊通常會在晚上啟動一批實驗,翌日早上再檢視結果。有了「超快」模式,這個循環得以縮短,團隊可在同一個工作天內完成多次迭代。
「超快」模式標誌着我們與 Cerebras 合作的下一步,將超低延遲推理帶到 OpenAI 平台。現在,Cerebras 透過「超快」模式支援 OpenAI 最智能的模型 GPT‑5.6 Sol,每秒最多輸出 750 個 Token,讓企業能夠建立反應更迅速的產品、加快決策,並將強大的 AI 直接融入要求最嚴苛的工作流程。
「超快」模式下的 GPT‑5.6 Sol 現正以有限度預覽形式向指定客戶開放使用。我們會隨着容量增加而開放更多使用名額。登記接收最新消息。


