Стоп-последовательности позволяют остановить генерацию токенов моделью в нужном месте, например в конце предложения или списка. При работе с API завершения чата можно задать параметр stop и передать ему последовательность. Ответ модели не будет содержать стоп-последовательность. Можно передать до четырёх стоп-последовательностей.
Простой пример:
В этом простом примере чата используется одна стоп-последовательность — слово «world». Системное сообщение и сообщение пользователя настроены так, чтобы попытаться заставить модель вывести «Hello world»; когда сгенерированный текст достигает точной стоп-последовательности «world», ответ останавливается до включения этой стоп-последовательности, поэтому возвращаемый вывод — это текст перед «world» (в playground он отображается как «Hello»).
Дополнительные примеры стоп-последовательностей можно изучить в playground чата OpenAI.
