Ringkasan
Penggunaan API tunduk pada batas laju. Batas ini membatasi permintaan, token, atau penggunaan lainnya selama periode tertentu.
Respons 429 dapat menunjukkan batas laju sementara, saldo prabayar yang habis, atau batas pengeluaran maupun penggunaan. Periksa detail error sebelum mencoba lagi atau mengubah pengaturan penagihan.
Identifikasi penyebabnya
Baca pesan error dan error.code jika tersedia. Error terkait penagihan masih dapat menggunakan nilai error.type yang lebih umum, yaitu insufficient_quota.
| Error atau kode | Artinya | Tindakan yang perlu dilakukan |
| Batas laju permintaan atau token tercapai | Permintaan melampaui batas laju yang berlaku. | Atur laju permintaan dan ikuti panduan percobaan ulang di bawah ini. |
| credit_balance_exhausted | Organisasi tidak memiliki sisa kredit prabayar. | Tambahkan kredit di pengaturan penagihan API Anda. |
| organization_usage_limit_exceeded | Organisasi telah mencapai batas penggunaan yang ditetapkan OpenAI. | Ajukan permintaan untuk menaikkan batas penggunaan yang disetujui. |
| organization_spend_limit_exceeded | Organisasi telah mencapai batas pengeluaran yang diberlakukan. | Naikkan atau hapus batas tersebut, atau tunggu hingga batas direset setiap bulan. |
| project_spend_limit_exceeded | Proyek telah mencapai batas pengeluaran yang diberlakukan. | Naikkan atau hapus batas proyek, atau tunggu hingga batas direset setiap bulan. |
Mencoba kembali setelah terjadi error penagihan, pengeluaran, atau kuota tidak akan memulihkan akses. Atasi dahulu masalah saldo atau batas yang dilaporkan. Perubahan pada batas pengeluaran yang diberlakukan mungkin memerlukan waktu untuk diterapkan.
Untuk mengubah batas pengeluaran, Anda memerlukan izin untuk mengelola pengaturan organisasi atau proyek terkait. Jika tidak memiliki akses, mintalah bantuan orang yang mengelola pengaturan tersebut.
Untuk pembelian kredit prabayar, lihat: Menyiapkan dan mengelola penagihan API prabayar.
Untuk berbagai kontrol pengeluaran, lihat panduan batas pengeluaran API.
Periksa batas laju yang berlaku
Buka halaman Batas organisasi Anda untuk meninjau tingkat penggunaan dan batasnya saat ini.
Batas laju dapat berlaku di tingkat organisasi dan proyek. Batas tersebut bukan alokasi untuk pengguna individual. Batas juga berbeda menurut model, dan beberapa keluarga model menggunakan batas bersama.
Periksa batas yang disebutkan dalam error. Misalnya, permintaan per menit dan token per menit merupakan batas yang terpisah. Anda dapat mencapai salah satunya meskipun masih berada di bawah batas lainnya.
Konfirmasikan organisasi yang digunakan oleh permintaan Anda
Jika Anda tergabung dalam beberapa organisasi, pastikan permintaan Anda menggunakan organisasi dan proyek yang dimaksud.
Jika kunci API Anda menggunakan organisasi default, periksa pengaturan organisasi default Anda. Setiap organisasi dapat memiliki skema penagihan dan tingkat penggunaan yang berbeda.
Kurangi error batas laju sementara
Atur laju permintaan dan hindari lonjakan
Sebarkan permintaan dari waktu ke waktu, bukan mengirim banyak permintaan sekaligus.
Batas laju dapat diberlakukan dalam periode yang lebih singkat daripada interval yang ditampilkan. Misalnya, batas 60 permintaan per menit juga dapat diberlakukan dalam periode 1 detik. Karena itu, lonjakan singkat dapat memicu error meskipun rata-rata penggunaan Anda tampak di bawah batas per menit.
Prompt yang panjang dan alokasi token output yang terlalu besar juga dapat menyebabkan error laju token.
Coba lagi setelah menunggu
Untuk error batas laju sementara:
Periksa apakah ada header respons Retry-After.
Jika header berisi waktu tunggu yang valid, tunggu setidaknya selama itu sebelum mencoba lagi.
Jika header tidak ada atau tidak valid, gunakan backoff eksponensial dengan jitter: tambah waktu tunggu setelah setiap percobaan yang gagal dan tambahkan sedikit waktu tunggu acak.
Batasi jumlah percobaan ulang dan total waktu yang digunakan untuk mencoba lagi.
SDK resmi OpenAI sudah mencoba kembali error batas laju yang memenuhi syarat dan mematuhi Retry-After jika tersedia. Perhitungkan percobaan ulang tersebut sebelum menambahkan loop percobaan ulang lainnya.
Permintaan yang gagal tetap diperhitungkan dalam batas per menit. Mengirim ulang permintaan yang sama secara terus-menerus dapat memperpanjang masalah.
Untuk panduan dan contoh implementasi, lihat panduan batas laju API. Tinjau setiap pustaka percobaan ulang pihak ketiga sebelum menggunakannya dalam aplikasi Anda.
Tinjau ukuran prompt dan output
Hapus instruksi yang tidak perlu, konteks berulang, dan contoh dari prompt Anda. Uji prompt yang telah direvisi untuk memastikan hasilnya masih sesuai kebutuhan Anda.
Gunakan parameter token output yang didukung oleh endpoint dan model Anda:
Chat Completions menggunakan max_completion_tokens.
Responses menggunakan max_output_tokens.
Jangan menetapkan alokasi yang jauh lebih besar daripada yang dibutuhkan permintaan. Parameter ini mencakup token penalaran serta output yang terlihat, jadi alokasikan ruang untuk keduanya saat menggunakan model penalaran.
Tinjau tingkat penggunaan Anda
Jika error berlanjut setelah Anda mengurangi lonjakan dan meninjau penggunaan token, periksa halaman Batas untuk melihat opsi yang tersedia guna menaikkan batas Anda.
Seiring meningkatnya pengeluaran API, OpenAI dapat secara otomatis menaikkan organisasi ke tingkat penggunaan yang lebih tinggi. Hal ini biasanya meningkatkan batas laju di sebagian besar model.
Batas penggunaan bulanan yang disetujui terpisah dari batas laju permintaan dan token. Kenaikan salah satunya bukan berarti batas lainnya juga telah berubah.
Jika masalah berlanjut
Sebelum mengeskalasikan masalah
Siapkan pesan error persisnya, kode error jika ada, ID permintaan yang relevan, waktu terjadinya error beserta zona waktu Anda, dan batas terkait yang ditampilkan di akun Anda. Catat langkah-langkah yang sudah Anda coba.
Hubungi Dukungan OpenAI
Hubungi Dukungan OpenAI melalui Pusat Bantuan jika masalah tidak dapat diselesaikan setelah Anda memeriksa batas yang dilaporkan. Jangan sertakan kunci API atau rahasia autentikasi lainnya.
