API 收費模式
由我們最先進的模型提供技術支援
我們業界領先的模型具備先進智能和多模態能力。
GPT-5.6 Sol
適合高要求智能代理工作的旗艦模型
收費
輸入:$5.00/ 百萬個 Token快取輸入:$0.50/ 百萬個 Token輸出:$30.00/ 百萬個 Token
GPT-5.6 Terra
適合高效處理大量工作的均衡模型
收費
輸入:$2.00/ 百萬個 Token快取輸入:$0.20/ 百萬個 Token輸出:$12.00/ 百萬個 Token
GPT-5.6 Luna
快速且價格相宜,適合日常工作的模型
收費
輸入:$0.20/ 百萬個 Token快取輸入:$0.02/ 百萬個 Token輸出:$1.20/ 百萬個 Token
以上收費模式反映上下文長度在 270K 以下的標準處理費用。了解有關批次處理(在新視窗中開啟)和資料駐留和區域處理(在新視窗中開啟)的詳情
多模態模型
透過支援文字、圖像和音訊的模型,為應用程式提供即時互動和富媒體生成能力。
GPT-Image-2
先進的圖像生成模型。
收費
圖像:$8.00/ 百萬個輸入 Token$2.00/ 百萬個快取輸入 Token$30.00/ 百萬個輸出 Token文字:$5.00/ 百萬個輸入 Token$1.25/ 百萬個快取輸入 Token
GPT-Realtime-2.1
我們最強大的即時語音互動模型,內置先進推理能力。
收費
音訊:$32.00/ 百萬個輸入 Token$0.40/ 百萬個快取輸入 Token$64.00/ 百萬個輸出 Token文字:$4.00/ 百萬個輸入 Token$0.40/ 百萬個快取輸入 Token$24.00/ 百萬個輸出 Token圖像:$5.00/ 百萬個輸入 Token$0.50/ 百萬個快取輸入 Token
GPT-Realtime-2.1 mini
我們迄今最強大的 mini 模型,專為即時語音互動而設,並內置進階推理。
收費
音訊:$10.00/ 百萬個輸入 Token$0.30/ 百萬個快取輸入 Token$20.00/ 百萬個輸出 Token文字:$0.60/ 百萬個輸入 Token$0.06/ 百萬個快取輸入 Token$2.40/ 百萬個輸出 Token圖像:$0.80/ 百萬個輸入 Token$0.08/ 百萬個快取輸入 Token
GPT-Live-Transcribe
串流語音轉文字模型,可在說話者發言時即時轉錄語音。
收費
每分鐘 $0.017/每秒 $0.00028
GPT-Transcribe
適用於非同步和批次工作負載的語音轉文字模型。
收費
每分鐘 $0.0045 /每秒 $0.00008
GPT-Realtime-Translate
可即時翻譯語音並跟上說話者節奏的模型。
收費
每分鐘 $0.034/ 每秒 $0.00057
工具
透過內建工具(包括資料檢索、執行及外部數據存取)擴展模型能力。
網頁搜尋
從網絡擷取最新資訊,為模型回覆提供依據。
收費
$10.00/ 1,000 次調用搜尋內容所使用的 Token 免費。
容器
在安全且可擴展的環境中,與模型一同執行程式碼及工具。
收費
現時:每個容器 1 GB 收費 $0.03 ;64 GB 則為 $1.92由 2026 年 3 月 31 日起:每個容器每 20 分鐘工作階段 1 GB 收費 $0.03;64 GB 則為 $1.92
服務層級
根據你的需要,在效能、可預測成本和可用性之間取得平衡。
Batch API
使用 Batch API 可節省 50% 的輸入和輸出費用,並可在 24 小時內以非同步方式執行任務。
快速模式
提供高速可靠的效能,並提供按需付費選項,靈活又方便。
彈性處理
以較低成本處理請求,但回覆時間較慢,而且資源偶然可能無法使用。適合用於非生產環境或優先級別較低的任務。