跳至主要內容
OpenAI

API 客戶適用的預留層級

此方案適用於 Enterprise 客戶。若要進一步瞭解,請聯絡我們的銷售團隊。若要為 GPT‑5.6 之前發布的模型購買規模層級,請參閱規模層級

概覽

預留層級專為需要預先購買額外容量的客戶而設計。額外容量會加在原有速率限制之上,即使在需求高峰期也能使用。

預留層級可讓你為特定模型購買已布建的吞吐量。為方便估算所需容量,預留層級以美元/分鐘為計價單位。預留金額可彈性用於標準處理和快速模式,也適用於不同的上下文長度與區域。預留層級不適用於批次處理或彈性處理。超出預留金額的用量會採按實際用量收費方式,並依一般費率計費。

選擇預留層級,即可為需求量最高的模型保留運算容量,並取得額外的擴充能力。購買的預留容量會自動提高總速率限制,讓你在需求較高的期間仍有足夠容量。

運作方式

使用預留層級時,你會針對特定模型購買以美元/分鐘計算的預留金額。只要用量未超過預留金額,則針對該模型的標準處理和快速處理要求均會由預留容量涵蓋。

如果用量超過預留金額,額外用量會根據所選服務層級,按實際用量收費,並以一般費率計費。

例如:

  • 如果你為 GPT‑5.6 預留每分鐘 $2,該模型符合資格的用量會按牌價從你的預留金額中扣除。
  • 在符合資格用量為 $2 或以下的任何一分鐘內,你的用量都由預留層級涵蓋,不會產生額外用量費用。
  • 如果你在一分鐘內符合資格的用量超過 $2,超出預留金額的部分會按實際用量收費。例如,如果你在一分鐘內使用 $2.75,其中 $2.00 由預留層級涵蓋,$0.75 的超額用量則按實際用量收費 (PAYG)。

用量會依模型按實際用量收費的牌價計算。請參閱下方常見問題,瞭解折扣如何套用至預留層級。

定價 + 服務水準協議 (SLA)

Token 單位與速率限制

政策