Sekuencat e ndalimit përdoren për ta bërë modelin të ndalojë gjenerimin e tokenëve në një pikë të dëshiruar, si fundi i një fjalie ose i një liste. Duke përdorur API-në e përfundimeve të bisedës, mund të specifikoni parametrin stop dhe të kaloni sekuencën. Përgjigjja e modelit nuk do ta përmbajë sekuencën e ndalimit dhe mund të kaloni deri në katër sekuenca ndalimi.
Shembull i thjeshtë:
Në këtë shembull të thjeshtë bisede, përdoret një sekuencë ndalimi, fjala "world". Mesazhi i sistemit dhe mesazhi i përdoruesit janë hartuar për të provuar ta bëjnë modelin të nxjerrë "Hello world"; kur teksti i gjeneruar arrin sekuencën e saktë të ndalimit "world", përgjigjja ndalet përpara se ta përfshijë atë sekuencë ndalimi, kështu që dalja e kthyer është teksti përpara "world" (shfaqur si "Hello" në playground).
Mund të eksploroni shembuj shtesë të sekuencave të ndalimit duke përdorur playground-in e bisedës së OpenAI.
