概覽
API 用量受到速率限制。這些限制會規範指定期間內的請求數、Token 數或其他用量。
429 回應可能表示暫時觸及速率限制、預付餘額已用盡,或已達支出或用量限制。請先查看錯誤詳細資料,再重試或變更帳務設定。
找出原因
請查看錯誤訊息,以及系統提供的 error.code。帳務相關錯誤仍可能使用較廣泛的 error.type 值 insufficient_quota。
| 錯誤或代碼 | 代表意義 | 處理方式 |
| 請求數或 Token 數已達速率限制 | 請求超出適用的速率限制。 | 調整請求頻率,並遵循下方的重試指引。 |
| credit_balance_exhausted | 組織已沒有剩餘的預付點數。 | 請在 API 帳務設定中新增點數。 |
| organization_usage_limit_exceeded | 組織已達 OpenAI 指派的用量限制。 | 申請提高核准的用量限制。 |
| organization_spend_limit_exceeded | 組織已達強制支出限制。 | 提高或移除限制,或等待每月重設。 |
| project_spend_limit_exceeded | 專案已達強制支出限制。 | 提高或移除專案限制,或等待每月重設。 |
重試帳務、支出或配額錯誤並不會恢復存取權。請先處理所回報的餘額或限制問題。強制支出限制的變更可能需要一段時間才會生效。
變更支出限制需要具備管理相關組織或專案設定的權限。如果您沒有存取權,請洽詢管理這些設定的人員。
如需購買預付點數,請參閱:設定及管理預付 API 帳務。
如需瞭解不同的支出控制方式,請參閱 API 支出限制指南。
查看適用的速率限制
前往您組織的限制頁面,查看目前的用量級別和限制。
速率限制可套用於組織和專案層級。這些限制並非個別使用者的配額。限制也會因模型而異,部分模型系列會共用同一限制。
查看錯誤指出的是哪一項限制。例如,每分鐘請求數和每分鐘 Token 數是兩項不同的限制。您可能已達其中一項限制,但仍低於另一項限制。
減少暫時性的速率限制錯誤
調整請求頻率並避免突發請求
請將請求分散在一段時間內傳送,而不要一次傳送大量請求。
速率限制的實際計算週期可能短於畫面所顯示的區間。例如,每分鐘 60 個請求的限制,也可能按 1 秒的週期執行。因此,即使平均用量看似低於每分鐘限制,短時間的突發請求仍可能觸發錯誤。
過長的提示詞和不必要地設定過高的輸出 Token 上限,也可能導致 Token 速率錯誤。
延遲後重試
如果是暫時性的速率限制錯誤:
檢查回應中是否有 Retry-After 標頭。
如果標頭包含有效的延遲時間,請至少等待指定時間後再重試。
如果標頭缺失或無效,請使用帶隨機擾動的指數退避:每次嘗試失敗後增加延遲時間,並加入短暫的隨機延遲。
請同時限制重試次數與重試所花費的總時間。
OpenAI 官方 SDK 已會重試符合條件的速率限制錯誤,並在 Retry-After 存在時依其指示執行。新增另一個重試迴圈前,請先將這些重試納入考量。
失敗的請求也會計入每分鐘限制。持續重送相同請求可能會延長問題。
如需實作指引和範例,請參閱 API 速率限制指南。在應用程式中使用任何第三方重試程式庫前,請先加以審查。
檢查提示詞和輸出大小
從提示詞中移除不必要的指示、重複的脈絡和範例。測試修改後的提示詞,確認它仍能產生您需要的結果。
請使用您的端點和模型支援的輸出 Token 參數:
Chat Completions 使用 max_completion_tokens。
Responses 使用 max_output_tokens。
避免將上限設得遠高於請求所需。這些參數包含推理 Token 和可見輸出,因此使用推理模型時,請為兩者都預留額度。
查看用量級別
如果減少突發請求並查看 Token 用量後仍持續發生錯誤,請查看您的限制頁面,瞭解可提高限制的方式。
隨著 API 支出增加,OpenAI 可自動將組織升至更高的用量級別。這通常會提高大多數模型的速率限制。
核准的每月用量限制與請求及 Token 速率限制彼此獨立。提高其中一項,不代表另一項也已變更。
如果問題持續發生
升級處理前
請備妥完整的錯誤訊息、任何錯誤代碼、相關請求 ID、錯誤發生時間與所在時區,以及帳戶中顯示的相關限制。記下您已嘗試過的步驟。
聯絡 OpenAI 支援團隊
如果查看所回報的限制後仍無法解決問題,請透過說明中心聯絡 OpenAI 支援團隊。請勿提供 API 金鑰或其他驗證機密資訊。
