OpenAI
Эта страница была переведена машинным переводом. Открыть оригинальную статью на английском.

FAQ по Assistants API (v2)

Обновлено: 3 days ago

По состоянию на 11 марта 2025 года мы выпустили строительные блоки нашей новой платформы Agents. Подробнее см. в нашей документации API для Responses API, инструментов, включая Web Search, File Search и Computer Use, а также нашего Agents SDK с Tracing. На основе ваших отзывов о бета-версии Assistants API мы внесли ключевые улучшения в Responses API. После достижения полного паритета функций мы объявим план вывода Assistants API из эксплуатации позднее в этом году, с целевой датой прекращения работы в первой половине 2026 года.

Что такое Assistants API?

Assistants API позволяет разработчикам легко создавать мощных AI-ассистентов в своих приложениях. Этот API избавляет от необходимости управлять историей разговоров и добавляет доступ к инструментам, размещенным OpenAI, таким как Интерпретатор кода и File Search. API также поддерживает улучшенный вызов функций для сторонних инструментов.

Можно ли по-прежнему использовать бета-версию v1 API Assistants?

Нет. С 18 декабря 2024 года пользователям больше недоступна бета-версия v1 API Assistants. Сейчас мы поддерживаем только v2. Чтобы перевести вызовы API с v1 на v2, ознакомьтесь с этим руководством по миграции.

Как получить к нему доступ?

Assistants API доступен всем, у кого есть учетная запись OpenAI API, но он считается устаревшим и будет удален в августе 2026 года. Для новых проектов используйте вместо него Responses API. Если вы уже используете Assistants API, спланируйте миграцию на Responses API. Вы по-прежнему можете получать доступ к существующим ассистентам в Assistants Playground, пока API остается доступным.

Что такое ассистент?

Ассистент — это специализированный AI, который использует модели OpenAI и может получать доступ к файлам, поддерживать постоянные потоки и вызывать инструменты.

Что такое поток?

Поток — это сеанс общения между ассистентом и пользователем. Потоки упрощают разработку приложений: они сохраняют историю сообщений и обрезают ее, когда разговор становится слишком длинным для длины контекста модели.

Что такое инструмент поиска по файлам?

Инструмент file_search изначально реализует ряд рекомендаций по поиску данных, помогая извлекать нужную информацию из файлов и дополнять ею ответы модели. Подробнее читайте в нашей документации для разработчиков.

По умолчанию инструмент file_search использует следующие настройки:

  • Размер фрагмента: 800 токенов

  • Перекрытие фрагментов: 400 токенов

  • Модель эмбеддингов: text-embedding-3-large, 256 измерений

  • Максимальное количество фрагментов, добавляемых в контекст: 20

Какие ограничения действуют для загрузки файлов?

Ограничения для загрузки файла:

  • 512 МБ на файл

  • 5 млн токенов на файл

  • 10 тыс. файлов на векторное хранилище

  • 1 векторное хранилище на ассистента

  • 1 векторное хранилище на поток

Общий лимит хранилища для каждого проекта в организации составляет 100 ГБ.

Каковы ограничения инструмента File Search?

Есть несколько известных ограничений, поддержку которых мы планируем добавить в ближайшие месяцы:

  1. Сейчас нет возможности изменять настройки разбиения на фрагменты, эмбеддингов или извлечения.

  2. Мы не поддерживаем анализ изображений внутри документов.

  3. Мы не поддерживаем извлечение данных из структурированных форматов файлов (например, файлов .csv или .jsonl). См. поддерживаемые типы файлов.

Какие лимиты запросов действуют для Assistants API?

Лимиты запросов для Assistants API не привязаны к уровню использования и модели. Вместо этого действуют лимиты по умолчанию для типов запросов, за некоторыми исключениями:

  • GET: 1000 RPM

  • POST: 300 RPM

  • DELETE: 300 запросов в минуту

Как рассчитывается стоимость Интерпретатора кода в API?

Интерпретатор кода стоит 0,03 долл. США за сеанс. Если ваш ассистент одновременно вызывает Интерпретатор кода в двух разных потоках, это создаст два сеанса Интерпретатора кода (2 * 0,03 долл. США). По умолчанию каждый сеанс активен в течение одного часа. Это означает, что вы заплатите этот сбор только один раз, если ваш пользователь продолжит давать инструкции Интерпретатору кода в том же потоке в течение одного часа.

Как рассчитывается стоимость File Search в API?

File Search стоит 0,10 долл. США за ГБ хранилища векторного хранилища в день (первый ГБ хранилища бесплатен). Размер векторного хранилища определяется итоговым размером векторного хранилища после того, как ваш файл будет проанализирован, разбит на фрагменты и преобразован в эмбеддинги.

Все векторные хранилища, созданные до 17 апреля 2024 года, будут бесплатными до конца 2024 года, после чего они будут либо:

  • Оплачиваться по текущим тарифам (сейчас 0,10 долл. США/ГБ/день), если они использовались хотя бы один раз в Run, созданном после 17 апреля 2024 года.

  • Удалены, если они ни разу не использовались в Run в период с 17 апреля 2024 года по 31 декабря 2024 года — это нужно, чтобы с вас не взималась плата за векторные хранилища, которые вы могли создать до объявления этого изменения цен, но так и не использовали.

Есть ли ограничение на количество ассистентов, которые я могу создать?

Ограничений на количество ассистентов, которые может создать организация, нет.

Доступна ли потоковая передача в API?

Да, потоковая передача доступна в Assistants API.

Доступен ли режим JSON в API Assistants?

Да, режим JSON доступен в API Assistants через параметр response_format объектов Assistants или Run.

Будет ли Assistants API также управлять запросами для вызовов функций сторонних разработчиков?

Нет. Хотя вызов функций позволяет модели выбирать инструменты и форматировать запросы к ним, выполнение вызовов сторонних инструментов не управляется OpenAI.

Как обрабатываются данные, которые я отправляю в OpenAI?

Как и на остальной части нашей платформы, данные и файлы, передаваемые в OpenAI API, никогда не используются для обучения наших моделей, и вы можете удалить свои данные в любое время, когда вам это нужно. Данные, загруженные в Assistants API, хранятся бессрочно, пока пользователь не удалит их вручную.

Доступен ли DALL-E через Assistants API?

В настоящее время DALL-E недоступен.

Есть ли пользовательский интерфейс для Assistants API?

Вы можете попробовать Playground для Assistants API. Убедитесь, что вы находитесь в представлении Assistants на левой боковой панели и используете модель, совместимую с инструментами, которые хотите включить.

Playground Assistants view editing MyQuickstartAssistant with gpt-3.5-turbo and Code interpreter enabled

Каков лимит символов для инструкций ассистента в Assistants API?

Максимальная длина поля инструкций ассистента составляет 256 000 символов.

Я получаю сообщение об ошибке, например: «При обработке вашего запроса на сервере произошла ошибка. Приносим извинения! Повторите запрос. Если ошибка не исчезнет, свяжитесь с нами через справочный центр по адресу help.openai.com. » Что мне делать?

Эта ошибка может означать, что ваш промпт настроен неправильно. Если повторные попытки выполнить запрос не помогают, попробуйте следующее:

  1. измените структуру промпта, чтобы команды, похожие на функции, обрабатывались как функции

  2. добавьте все команды из промпта в tools как функции

Почему мой инструмент File Search работает плохо?

При использовании инструмента File Search мы рекомендуем устанавливать max_prompt_tokens не менее 20 000. Для более длинных разговоров или нескольких взаимодействий с File Search рассмотрите возможность увеличить этот лимит до 50 000, а в идеале — полностью удалить ограничения max_prompt_tokens, чтобы получать результаты наилучшего качества. Подробнее читайте здесь.

Как я могу оставить отзыв?

Мы будем рады вашим отзывам на нашем форуме разработчиков, через Справочный центр по адресу help.openai.com или в Twitter @OpenAIDevs.

Была ли эта статья полезной?