Na latenciju zahtjeva za dovršavanje najviše utiču dva faktora: model i broj generisanih tokena. Pročitajte našu ažuriranu dokumentaciju za smjernice o poboljšanju latencija.
Optimizacija latencije s OpenAI API modelima
Saznajte više o faktorima koji utiču na vrijeme odgovora
Ažurirano: 18 days ago
