概覽
API 用量受速率限制。這些限制會約束指定時段內的請求、Token 或其他用量。
429 回應可能表示暫時觸及速率限制、預付結餘已用盡,或已達支出或用量限制。重試或更改帳單設定前,請先查看錯誤詳情。
找出成因
請閱讀錯誤訊息,以及所提供的 error.code。帳單相關錯誤仍可能採用涵蓋範圍較廣的 error.type 值 insufficient_quota。
| 錯誤或代碼 | 含義 | 處理方法 |
| 請求或 Token 已達速率限制 | 請求超出適用的速率限制。 | 調整請求發送速度,並遵循下方的重試指引。 |
| credit_balance_exhausted | 組織已沒有剩餘的預付積分。 | 在 API 帳單設定中加入積分。 |
| organization_usage_limit_exceeded | 組織已達 OpenAI 指定的用量限制。 | 申請提高已核准的用量限制。 |
| organization_spend_limit_exceeded | 組織已達強制支出限制。 | 提高或移除限制,或等待每月重設。 |
| project_spend_limit_exceeded | 專案已達強制支出限制。 | 提高或移除專案限制,或等待每月重設。 |
重試帳單、支出或配額錯誤並不會恢復存取權。請先處理所報告的結餘或限制問題。強制支出限制的變更可能需要一段時間才會生效。
更改支出限制需要具備管理相關組織或專案設定的權限。如果您沒有存取權,請聯絡管理這些設定的人員。
有關購買預付積分的資訊,請參閱:設定及管理 API 預付帳單。
有關不同的支出控制,請參閱 API 支出限制指南。
查看適用的速率限制
前往組織的限制頁面,查看目前的用量級別和限制。
速率限制可套用於組織和專案層級。這些限制並非個別用戶的配額。不同模型的限制亦有差異,而部分模型系列會共用限制。
查看錯誤所指出的限制。例如,每分鐘請求數和每分鐘 Token 數是兩項獨立限制。您可能已達其中一項限制,但仍低於另一項限制。
減少暫時性速率限制錯誤
調整請求發送速度並避免突發流量
將請求分散在不同時間傳送,而非一次傳送大量請求。
速率限制的執行週期可以比顯示的時間間隔更短。例如,每分鐘 60 個請求的限制也可能按 1 秒週期執行。因此,即使平均用量看似低於每分鐘限制,短暫的突發流量仍可能觸發錯誤。
過長的提示詞及不必要地過高的輸出 Token 上限,也可能導致 Token 速率錯誤。
延遲後重試
如遇暫時性速率限制錯誤:
檢查回應中是否有 Retry-After 標頭。
如果標頭包含有效的延遲時間,請至少等待該段時間後再重試。
如果標頭缺漏或無效,請採用帶隨機抖動的指數退避:每次嘗試失敗後延長等候時間,並加入短暫的隨機延遲。
同時限制重試次數及重試所花的總時間。
OpenAI 官方 SDK 已會重試符合條件的速率限制錯誤,並在 Retry-After 存在時遵從其指示。加入另一個重試迴圈前,請先計入這些重試。
失敗的請求也會計入每分鐘限制。持續重新傳送同一請求可能會令問題延續。
如需實作指引和範例,請參閱 API 速率限制指南。在應用程式中使用任何第三方重試程式庫前,請先加以審查。
查看提示詞及輸出大小
從提示詞中移除不必要的指示、重複的背景資料和範例。測試修訂後的提示詞,確認仍能產生您所需的結果。
使用您的端點和模型所支援的輸出 Token 參數:
Chat Completions 使用 max_completion_tokens。
Responses 使用 max_output_tokens。
避免設定遠高於請求所需的上限。這些參數同時涵蓋推理 Token 和可見輸出,因此使用推理模型時,請為兩者預留空間。
查看用量級別
如果減少突發請求並查看 Token 用量後仍出現錯誤,請前往您的限制頁面,查看可用的提高限制方式。
隨着 API 支出增加,OpenAI 可能會自動將組織提升至較高的用量級別。這通常會提高大多數模型的速率限制。
獲批的每月用量限制與請求及 Token 速率限制互相獨立。其中一項限制提高,不應視為另一項限制亦已更改的確認。
如果問題持續
上報問題前
請備妥確切的錯誤訊息、任何錯誤代碼、相關請求 ID、錯誤發生時間及所屬時區,以及帳戶中顯示的相關限制。記下您已嘗試的步驟。
聯絡 OpenAI 支援團隊
如果查看所報告的限制後仍無法解決問題,請透過說明中心聯絡 OpenAI 支援團隊。請勿提供 API 金鑰或其他驗證機密資料。
