GPT‑6 是我們迄今最先進的模型系列,提供多種模型供你選擇,以因應不同類型的工作。
無論你是將構想化為可運作的原型、開發及測試功能,還是協調橫跨程式碼庫、資料庫與外部 API 的多步驟工作流程,本指南都會說明如何選擇 GPT‑6 模型、提供有效指示、管理長時間執行的工作,以及為正式上線做好準備。

在正式環境中高效運作。使用快取(在新視窗中開啟)與壓縮(在新視窗中開啟)來管理上下文與成本。衡量任務成功率與延遲,並規劃監控及資料控管措施。
依工作負載選擇模型。選擇適合任務的模型、推理強度(在新視窗中開啟)與速度,在能力、成本與延遲之間取得平衡。
調整提示詞與技能。確保提示詞、技能與程式碼庫指示對於模型應交付的成果、可自行執行的事項,以及完成標準,都有一致的說明。
確保長時間執行的工作不偏離方向。使用引導(在新視窗中開啟)、非同步工具(在新視窗中開啟)與委派(在新視窗中開啟)功能,處理更新與可獨立執行的工作。明確訂定模型應在何時徵詢意見。
部署前,請先落實幾項檢查與最佳做法。
別忘了考量效率。 (在新視窗中開啟)刪減任務不需要的上下文(在新視窗中開啟),同時保留所需的佐證資料。如果應用程式支援,請同時執行互不相依的任務(在新視窗中開啟),避免某個緩慢的步驟拖延無關的工作。
對於重複執行的工作,可透過提示詞快取(在新視窗中開啟)重複利用共用的上下文。視模型而定,已快取的輸入 Token 成本比未快取的輸入 Token 最多低 95%(在新視窗中開啟)。將固定的指示與參考資料放在會變動的任務細節之前,並保持工具定義一致。快取儀表板(在新視窗中開啟)與診斷指南(在新視窗中開啟)可協助你找出無法重複利用快取的環節。估算完整工作流程的成本時,請納入快取寫入費用,以及任何適用的長上下文費率。
對於較長的對話,壓縮(在新視窗中開啟)可縮減上下文大小,同時保留繼續執行所需的狀態。
決定如何監控行為(在新視窗中開啟),並檢視應用程式的資料控管措施(在新視窗中開啟)。
部署前先測試:執行具代表性的任務,衡量任務成功率、延遲,以及每項成功任務的成本。請參閱我們的 API 部署檢查清單(在新視窗中開啟)。
選擇模型與推理等級時,可視為在智慧能力與價格之間取捨。
模型:
GPT‑6 Astra(在新視窗中開啟) 適合需要最強智慧能力、難度最高的推理工作。
GPT‑6.1 Sol(在新視窗中開啟) 適合複雜的程式設計、研究與電腦操作。
GPT‑6 Luna(在新視窗中開啟) 適合大規模執行範圍明確的任務,以及目標清楚、日常重複的工作,例如擷取發票欄位、將請求分類或產生結構化摘要。
評估最適合任務的模型時,請比較各模型的價格(在新視窗中開啟)。
推理等級:在 API 中,選擇模型為任務投入的推理強度。
低:例行任務,例如擷取事實或進行小幅編輯。
中:需要判斷的工作,例如規劃功能或比較選項。
高:困難的除錯、深入分析或仔細審查。
極高 / Max:若「高」仍不足以應付任務,可在支援的情況下測試這些等級;只有當改善幅度值得投入額外時間與成本時,才繼續使用。
在 API 中,你可以在對話中途變更推理強度(在新視窗中開啟),而不影響快取。
在 Codex 中,先使用該模型的預設推理等級,再針對較簡單的任務調低,或為深入分析而調高。
速度:
在 API 中,若回應時間很重要,例如聊天應用程式或程式開發工具,請使用快速模式(在新視窗中開啟)。相較於標準處理模式,它的回應時間更短、更穩定,但每個 Token 的成本也較高。
在 Codex 與 API 中,若更快的回應值得額外付費,例如快速反覆修改程式碼時,請使用超快速模式(在新視窗中開啟)。它能加快 Token 生成速度,且不受推理強度影響。適用於 GPT‑6 Astra(在新視窗中開啟)。

—Eric Provencher,OpenAI 開發者體驗團隊
首先明確說明任務:你想要的成果、成果的使用對象、相關脈絡與限制,以及完成標準。接著檢視以下四個面向,深入瞭解如何更新指示。這些重點摘自〈重新思考 GPT‑6 Astra 的技能與提示詞〉(在新視窗中開啟):
打造更好的技能:以簡短描述明確說明每項技能應在何時執行,只在需要時載入輔助細節,並以適合團隊所用模型的指引,取代僵化的操作步驟。
更新 AGENTS.md:說明特定文件與測試適用的情境,並明確授權安全的例行工作流程,例如使用拋棄式資料、且不存取正式環境的本機測試。
設定決策界線:說明哪些動作可自行執行、哪些需要核准,以明確的界線取代一律「先詢問」的規則。
明確要求持續執行直到完成:定義「完成」涵蓋的內容,包括實作變更、執行、檢查結果及修正失敗項目,並指出哪些決策需要你審查。
如需更多指引,請參閱推理最佳做法(在新視窗中開啟)。
無論你是在 Codex 中工作,還是使用 API 開發,都應明確說明模型可以做哪些決策、何時應徵詢意見,以及怎樣的回應才有用。
給模型足夠的指引,讓工作持續推進,而不必在重要決策上靠猜測行事。 (在新視窗中開啟)告訴它哪些選擇可以自行決定,以及何時需要徵詢你的意見(在新視窗中開啟)。例如,它可以自行決定如何組織摘要,但在變更專案範圍前應先向你確認。 (在新視窗中開啟)描述怎樣的回應才有用(在新視窗中開啟),例如使用淺白文字、提供適合讀者的技術細節,以及簡短的交接說明,涵蓋變更內容、已檢查項目與仍需留意之處。
有了 GPT‑6 系列模型,你現在可以處理耗時數小時甚至數天的任務。使用下列功能,更有效地管理執行長時間任務的智慧體。
在 API 中,使用引導、非同步工具與平行作業,讓長時間執行的任務持續推進。
在執行期間更新指示:回合中途引導(在新視窗中開啟)可讓你在模型工作時,透過 Responses WebSocket API(在新視窗中開啟) 傳送修正指示。更新會排入佇列,不會取消正在執行的工具,也不會復原已完成的動作。
在工具執行時繼續工作:非同步工具呼叫(在新視窗中開啟)可讓模型在應用程式執行較慢的任務(例如測試)時,繼續處理互不相依的工作。結果準備好後,應用程式就會回傳。請等候該結果,再開始需要依據此結果執行的工作。
委派互不相依的子任務:GPT‑6.1 Sol 支援在 Responses API 中使用多智慧體工作流程(在新視窗中開啟)。它可以將互不相依的工作指派給子智慧體(例如調查程式碼的不同部分),再將各自的發現整合為最終回應。多智慧體功能目前處於 Beta 測試階段。
長時間執行的任務可能會遇到需要決策的事項,而這些不一定能在撰寫最初的提示詞時預見。透過釐清與引導,確保工作不偏離方向。
隨工作進展回答問題:使用 GPT‑6 Astra 時,Codex 可以在工作過程中請你釐清問題(在新視窗中開啟)。解決會影響下一步的問題,並指定在你做決定時,哪些互不相依的工作可以繼續進行。如果你將暫時離開,請告訴 Codex 哪些任務可以繼續,以及何時應暫停並等候你的答覆。
需求變更時調整工作方向:提供新資訊來引導正在執行的任務(在新視窗中開啟),說明哪些部分應改變、哪些應維持不變。這有助於避免繼續在已不符需求的做法上耗費時間。

電腦操作(在新視窗中開啟)功能可讓 GPT‑6 Astra、GPT‑6.1 Sol 與 GPT‑6 Luna 直接與網站及桌面應用程式互動,即使應用程式沒有 API 也能使用。例如,你可以要求模型調查錯誤、修正程式碼,並在瀏覽器中開啟你的產品,確認修正是否有效。
為每個步驟選擇最簡單可靠的做法:
若 API 或已連接的工具能直接完成工作,就使用它。
當模型需要替你讀取畫面、點選按鈕或填寫表單時,請使用電腦操作功能。
如果你要將電腦操作功能整合到自己的應用程式中,請提供模型可執行程式碼以控制瀏覽器或桌面的工具。Playwright 可操作瀏覽器(在新視窗中開啟);PyAutoGUI 則可操作桌面應用程式。



