Le sequenze di arresto consentono di interrompere la generazione di token da parte del modello nel punto desiderato, ad esempio alla fine di una frase o di un elenco. Con l'API per il completamento delle chat, puoi specificare il parametro stop e fornire la sequenza. La risposta del modello non conterrà la sequenza di arresto e puoi specificare fino a quattro sequenze di arresto.
Esempio semplice:
In questo semplice esempio di chat, viene usata una sequenza di arresto, la parola "world". Il messaggio di sistema e il messaggio dell'utente sono progettati per cercare di far sì che il modello produca "Hello world"; quando il testo generato raggiunge l'esatta sequenza di arresto "world", la risposta si interrompe prima di includere tale sequenza di arresto, quindi l'output restituito è il testo prima di "world" (visualizzato come "Hello" nel playground).
Puoi esplorare altri esempi di sequenze di arresto usando il playground chat di OpenAI.
