Na latenciju zahtjeva za dovršavanje najviše utiču dva faktora: model i broj generisanih tokena. Pročitajte našu ažuriranu dokumentaciju za smjernice o poboljšanju latencija.
Optimizacija latencije s OpenAI API modelima
Saznajte više o faktorima koji utiču na vrijeme odgovora
Ažurirano: 8 days ago
