跳至主要內容
OpenAI

2026年8月13日

產品

Ultrafast 模式搶先看:GPT‑5.6 Sol 速度最高可達標準模式的 14 倍

為前沿智慧開創全新速度等級,讓速度成為競爭優勢。

載入中…

今天,我們要搶先介紹 Ultrafast。Ultrafast 是全新的服務層級,執行 GPT‑5.6 Sol 的速度最高可達標準處理模式的 14 倍,並將率先在 OpenAI API 推出。Ultrafast 採用 Cerebras 技術,每秒最多可生成 750 個輸出 Token,讓我們最具智慧的模型能應用於分秒必爭的產品與工作流程。

透過 GPT‑5.6,我們不僅持續拓展模型能力的前沿,也在整個技術堆疊的每一層提升模型效率。這些改進讓進階智慧變得更實惠,也能為更多人帶來更大助益。過去,若要達到即時速度,通常必須選擇較小或用途更專一的模型。Ultrafast 展現了另一個方向的進展:每秒完成更多實用工作。

當速度不再以犧牲智慧為代價,AI 就能深入企業中對時間最敏感的環節,開創全新的工作方式。我們已經看到 Ultrafast 在一些情境中展現令人振奮的成果:

  • 事件回應與可靠性:關鍵系統故障時,即時分析應用程式記錄、近期程式碼變更和工程師報告,在事故仍持續發展之際找出可能原因,並協助準備修正方案。
  • 金融研究與安全:在情勢持續變化時分析市場訊號、評估交易並辨識可疑活動。
  • 客戶支援與語音:即使尋找答案需要經過多個步驟或系統,也能在不中斷對話的情況下,即時解決複雜的客戶問題。
  • 商務:在顧客仍在考慮時回答產品問題、查詢庫存、提供個人化推薦並解決結帳問題,避免猶豫最終導致棄單。
  • 即時研究與實驗:將過去需整夜執行的研究轉為互動式工作階段,讓團隊能一氣呵成地測試想法、檢視結果、調整方法,再進行下一項實驗。

預覽期間,我們正與首批客戶合作,瞭解 Ultrafast 的速度在哪些領域最能發揮效益,以及相關經驗日後如何協助我們改善產品。如果你的業務需要速度最快的前沿智慧,可以登記接收擴大開放使用的通知

GPT‑5.6 Sol 分別採用 Ultrafast 模式與標準模式,根據同一段文字提示並排建構可運作的 3D 倉庫模擬器。

早期客戶的使用體驗

我們一直與首批企業客戶合作,測試以 Ultrafast 模式運行的 GPT‑5.6 Sol,應用範圍涵蓋程式設計、商務、金融研究、支援及其他互動式應用。從企業工作流程著手,能讓我們在實際正式環境中研究相關條件。客戶的初期測試正幫助我們瞭解速度提升一個數量級時,哪些領域能創造最大價值,以及模型能跟上使用者步調時,產品會如何改變。隨著量能增加,我們將運用相關發現來規劃部署。

1 之 4
Cerebras 帶來的速度提升令人印象深刻,不僅開創了模型的不同使用方式,也讓開發人員能實際與模型協作,工作時更加專注、更有效率。
—John Crepezzi,Jane Street AI 助理團隊

OpenAI 如何運用 Ultrafast

OpenAI 內部有一群開發人員一直在測試以 Ultrafast 模式運行的 GPT‑5.6 Sol,藉此瞭解哪些工作流程能受益於可即時回應的前沿智慧。

事件回應是我們團隊使用 Ultrafast 的其中一個例子。警示觸發時,系統與證據仍在不斷變化,工程師必須迅速掌握準確全貌。團隊使用 Ultrafast 快速讀取日誌、分析追蹤資料、統整對話、找出接下來要檢查的項目,並協助準備或驗證修正方案。憑藉 Sol 的智慧,上述工作只需原本一小部分的時間即可完成。Ultrafast 能縮短觀察訊號、檢驗假設與決定下一步行動之間的延遲,而判斷與部署仍由工程師負責。

在研究方面,我們的團隊使用 Ultrafast 快速搜尋知識來源、查詢資料,並透過已連接的工具快速收集、整理及摘要資訊。團隊成員通常會在夜間批次啟動一系列實驗,隔天早上再檢視結果。有了 Ultrafast,整個循環大幅縮短,團隊可在同一個工作日內進行多輪測試與調整。

由 Cerebras 提供支援

Ultrafast 代表我們與 Cerebras 合作的下一步,將超低延遲推論帶到 OpenAI 平台。Cerebras 現在透過 Ultrafast 模式支援 OpenAI 最具智慧的模型 GPT‑5.6 Sol,每秒最多可生成 750 個輸出 Token,讓企業能打造回應更快的產品、加速決策,並將強大的 AI 直接導入需求最嚴苛的工作流程。

供應情況

GPT‑5.6 Sol 目前可透過 Ultrafast 模式使用,但仍處於有限預覽階段,僅開放給特定客戶。隨著量能增加,我們將擴大開放使用。登記接收最新消息

作者

OpenAI