Las secuencias de parada se usan para que el modelo deje de generar tokens en el punto deseado, como al final de una oración o una lista. Con la API para completar chats, puedes especificar el parámetro stop y proporcionar la secuencia. La respuesta del modelo no incluirá la secuencia de parada y puedes proporcionar hasta cuatro secuencias de parada.
Ejemplo simple:
En este ejemplo de chat simple, se usa una secuencia de detención: la palabra “world”. El mensaje del sistema y el mensaje del usuario están diseñados para intentar que el modelo genere “Hello world”; cuando el texto generado llega a la secuencia de detención exacta “world”, la respuesta se detiene antes de incluir esa secuencia de detención, por lo que la salida devuelta es el texto anterior a “world” (que se muestra como “Hello” en el playground).
Puedes explorar otros ejemplos de secuencias de detención con el playground de chat de OpenAI.
