OpenAI
Эта страница была переведена машинным переводом. Открыть оригинальную статью на английском.

Устранение ошибок API 429 и проблем с лимитами запросов

Определите причину ошибки API 429, сократите всплески запросов и выберите подходящее решение для лимитов запросов, кредитов или использования.

Обновлено: 9 days ago

Обзор

На использование API распространяются лимиты запросов. Эти лимиты ограничивают количество запросов, токенов или объем другого использования за определенный период.

Ответ 429 может указывать на временное превышение лимита запросов, исчерпание предоплаченного баланса либо достижение лимита расходов или использования. Прежде чем повторять запрос или менять настройки оплаты, проверьте сведения об ошибке.

Определите причину

Прочитайте сообщение об ошибке и значение error.code, если оно указано. Для ошибок, связанных с оплатой, в более общем поле error.type по-прежнему может быть указано значение insufficient_quota.

Ошибка или кодЧто это означаетЧто делать
Достигнут лимит запросов или токеновЗапросы превышают применимый лимит запросов.Распределите запросы по времени и следуйте приведенным ниже рекомендациям по повторным попыткам.
credit_balance_exhaustedУ организации не осталось предоплаченных кредитов.Пополните кредиты в настройках оплаты API.
organization_usage_limit_exceededОрганизация достигла назначенного OpenAI лимита использования.Запросите увеличение утвержденного лимита использования.
organization_spend_limit_exceededОрганизация достигла установленного лимита расходов.Увеличьте или снимите лимит либо дождитесь его ежемесячного сброса.
project_spend_limit_exceededПроект достиг установленного лимита расходов.Увеличьте или снимите лимит проекта либо дождитесь его ежемесячного сброса.

Повторная отправка запроса при ошибке оплаты, расходов или квоты не восстановит доступ. Сначала устраните проблему с указанным балансом или лимитом. Изменения установленных лимитов расходов могут применяться не сразу.

Для изменения лимита расходов требуется разрешение на управление настройками соответствующей организации или проекта. Если у вас нет доступа, обратитесь к тому, кто управляет этими настройками.

О покупке предоплаченных кредитов см. статью «Настройка предоплаты API и управление ею».

Сведения о различных средствах контроля расходов см. в руководстве по лимитам расходов API.

Проверьте применимые лимиты запросов

Перейдите на страницу «Лимиты» своей организации, чтобы проверить ее текущий уровень использования и лимиты.

Лимиты запросов могут применяться на уровне организации и проекта. Они не являются индивидуальными квотами пользователей. Лимиты также зависят от модели, причем у некоторых семейств моделей лимит общий.

Проверьте, какой именно лимит указан в ошибке. Например, количество запросов в минуту и количество токенов в минуту ограничиваются отдельно. Можно достичь одного лимита, не превысив другой.

Проверьте организацию, от имени которой отправлен запрос

Если вы состоите в нескольких организациях, убедитесь, что в запросах используются нужные организация и проект.

Если для ключа API используется организация по умолчанию, проверьте настройку организации по умолчанию. У разных организаций могут быть разные условия оплаты и уровни использования.

Сократите число временных ошибок превышения лимита запросов

Распределяйте запросы по времени и избегайте всплесков

Распределяйте запросы по времени, а не отправляйте большое количество одновременно.

Лимиты запросов могут применяться к более коротким периодам, чем отображаемый интервал. Например, лимит в 60 запросов в минуту может также применяться к интервалам длительностью в одну секунду. Поэтому кратковременный всплеск может вызвать ошибку, даже если средняя нагрузка не превышает поминутный лимит.

Длинные промпты и излишне большие лимиты выходных токенов также могут приводить к ошибкам лимита токенов.

Повторите запрос с задержкой

При временных ошибках превышения лимита запросов:

  1. Проверьте наличие заголовка ответа Retry-After.

  2. Если заголовок содержит корректную задержку, подождите не меньше указанного времени, прежде чем повторять запрос.

  3. Если заголовок отсутствует или некорректен, используйте экспоненциальную выдержку со случайным разбросом: увеличивайте задержку после каждой неудачной попытки и добавляйте небольшую случайную задержку.

  4. Ограничьте как количество повторных попыток, так и их общую продолжительность.

Официальные SDK OpenAI уже повторяют запросы при соответствующих ошибках превышения лимита и учитывают заголовок Retry-After, если он присутствует. Учтите эти попытки, прежде чем добавлять еще один цикл повторов.

Неуспешные запросы учитываются в поминутных лимитах. Непрерывная повторная отправка одного и того же запроса может усугубить проблему.

Рекомендации и примеры реализации приведены в руководстве по лимитам запросов API. Перед использованием сторонней библиотеки повторных попыток в приложении изучите ее документацию и код.

Проверьте размер промпта и вывода

Удалите из промптов ненужные инструкции, повторяющийся контекст и примеры. Протестируйте измененный промпт и убедитесь, что он по-прежнему дает нужный результат.

Используйте параметр выходных токенов, поддерживаемый вашей конечной точкой и моделью:

  • В Chat Completions используется max_completion_tokens.

  • В Responses используется max_output_tokens.

Не устанавливайте лимит намного выше, чем требуется для запроса. Эти параметры учитывают как токены рассуждений, так и видимый вывод, поэтому при работе с моделью рассуждений предусмотрите запас для обоих типов токенов.

Проверьте свой уровень использования

Если после сокращения всплесков и проверки расхода токенов ошибки сохраняются, узнайте о доступных способах увеличения лимитов на странице «Лимиты».

По мере роста расходов на API OpenAI может автоматически перевести организацию на более высокий уровень использования. Обычно при этом повышаются лимиты запросов для большинства моделей.

Утвержденный месячный лимит использования не связан с лимитами количества запросов и токенов. Увеличение одного лимита не означает, что другой тоже изменился.

Если проблема сохраняется

Перед обращением в поддержку

Подготовьте точный текст сообщения об ошибке, код ошибки, соответствующие идентификаторы запросов, время возникновения ошибки с указанием часового пояса и соответствующий лимит, отображаемый в аккаунте. Запишите, какие действия вы уже предприняли.

Обратитесь в службу поддержки OpenAI

Если после проверки указанного лимита устранить проблему не удалось, обратитесь в службу поддержки OpenAI через Справочный центр. Не указывайте ключи API и другие секретные данные для аутентификации.

Была ли эта статья полезной?