Visão geral
A utilização da API está sujeita a limites de taxa. Estes limites restringem os pedidos, os tokens ou outra utilização durante um período especificado.
Uma resposta 429 pode indicar um limite de taxa temporário, um saldo pré-pago esgotado ou um limite de despesas ou utilização. Consulte os detalhes do erro antes de tentar novamente ou alterar as definições de faturação.
Identifique a causa
Leia a mensagem de erro e error.code, quando este for fornecido. Os erros relacionados com a faturação podem continuar a utilizar o valor mais abrangente insufficient_quota em error.type.
| Erro ou código | O que significa | O que fazer |
| Limite de taxa atingido para pedidos ou tokens | Os pedidos estão a exceder um limite de taxa aplicável. | Modere o ritmo dos pedidos e siga as instruções abaixo para tentar novamente. |
| credit_balance_exhausted | A organização já não tem créditos pré-pagos. | Adicione créditos nas definições de faturação da API. |
| organization_usage_limit_exceeded | A organização atingiu o limite de utilização atribuído pela OpenAI. | Peça a aprovação de um limite de utilização superior. |
| organization_spend_limit_exceeded | A organização atingiu o limite de despesas imposto. | Aumente ou remova o limite, ou aguarde pela reposição mensal. |
| project_spend_limit_exceeded | O projeto atingiu o limite de despesas imposto. | Aumente ou remova o limite do projeto, ou aguarde pela reposição mensal. |
Repetir um pedido após um erro de faturação, despesas ou quota não restabelece o acesso. Resolva primeiro o problema indicado com o saldo ou limite. As alterações aos limites de despesas impostos podem demorar a entrar em vigor.
A alteração de um limite de despesas exige autorização para gerir as definições da organização ou do projeto em causa. Se não tiver acesso, peça ajuda à pessoa que gere essas definições.
Para comprar créditos pré-pagos, consulte: Configurar e gerir a faturação pré-paga da API.
Para conhecer os diferentes controlos de despesas, consulte o guia de limites de despesas da API.
Verifique os limites de taxa aplicáveis
Aceda à página Limites da sua organização para consultar o nível de utilização e os limites atuais.
Os limites de taxa podem aplicar-se ao nível da organização e do projeto. Não são quotas individuais para cada utilizador. Os limites também variam consoante o modelo, e algumas famílias de modelos partilham um limite.
Verifique qual é o limite identificado pelo erro. Por exemplo, os pedidos por minuto e os tokens por minuto têm limites distintos. Pode atingir um deles e continuar abaixo do outro.
Confirme a organização utilizada pelo pedido
Se pertencer a várias organizações, confirme que os pedidos utilizam a organização e o projeto pretendidos.
Quando a sua chave de API utilizar uma organização predefinida, verifique a definição da organização predefinida. As organizações podem ter diferentes modalidades de faturação e níveis de utilização.
Reduza os erros temporários de limite de taxa
Modere o ritmo dos pedidos e evite picos
Distribua os pedidos ao longo do tempo, em vez de enviar muitos de uma só vez.
Os limites de taxa podem ser aplicados em períodos mais curtos do que o intervalo apresentado. Por exemplo, um limite de 60 pedidos por minuto também pode ser aplicado em períodos de 1 segundo. Por isso, um pico breve pode provocar um erro, mesmo que a utilização média pareça estar abaixo do limite por minuto.
Prompts longos e limites desnecessariamente elevados de tokens de saída também podem contribuir para erros de taxa de tokens.
Tente novamente após algum tempo
Para erros temporários de limite de taxa:
Verifique se existe um cabeçalho de resposta Retry-After.
Se o cabeçalho indicar um intervalo válido, aguarde pelo menos esse tempo antes de tentar novamente.
Se o cabeçalho estiver em falta ou for inválido, utilize espera exponencial com variação aleatória: aumente o intervalo após cada tentativa sem êxito e acrescente um pequeno atraso aleatório.
Limite o número de novas tentativas e o tempo total despendido nessas tentativas.
Os SDK oficiais da OpenAI já repetem os pedidos elegíveis com erros de limite de taxa e respeitam o Retry-After quando este está presente. Tenha essas tentativas em conta antes de adicionar outro ciclo de repetição.
Os pedidos sem êxito contam para os limites por minuto. Reenviar continuamente o mesmo pedido pode prolongar o problema.
Para obter instruções e exemplos de implementação, consulte o guia de limites de taxa da API. Analise qualquer biblioteca de terceiros para repetição de pedidos antes de a utilizar na sua aplicação.
Reveja o tamanho do prompt e da saída
Remova dos seus prompts instruções desnecessárias, contexto repetido e exemplos. Teste o prompt revisto para confirmar que continua a produzir o resultado de que necessita.
Utilize o parâmetro de tokens de saída suportado pelo seu endpoint e modelo:
O Chat Completions utiliza max_completion_tokens.
O Responses utiliza max_output_tokens.
Evite definir um limite muito superior ao necessário para o pedido. Estes parâmetros incluem os tokens de raciocínio e a saída visível. Por isso, tenha ambos em conta ao utilizar um modelo de raciocínio.
Consulte o seu nível de utilização
Se os erros persistirem depois de reduzir os picos e analisar a utilização de tokens, consulte na página Limites as formas disponíveis de aumentar os seus limites.
À medida que as despesas com a API aumentam, a OpenAI pode elevar automaticamente uma organização para um nível de utilização superior. Normalmente, isto aumenta os limites de taxa na maioria dos modelos.
O limite mensal de utilização aprovado é distinto dos limites de taxa de pedidos e tokens. O aumento de um não deve ser interpretado como confirmação de que o outro foi alterado.
Se o problema persistir
Antes de encaminhar o problema
Tenha consigo a mensagem de erro exata, eventuais códigos de erro, os IDs de pedido relevantes, a hora do erro com o respetivo fuso horário e o limite relevante apresentado na sua conta. Registe os passos que já tentou.
Contacte o Apoio da OpenAI
Contacte o Apoio da OpenAI através do Centro de Apoio se não conseguir resolver o problema após verificar o limite indicado. Não inclua chaves de API nem outros segredos de autenticação.
