OpenAI
Ova stranica je mašinski prevedena. Pogledaj originalni članak na engleskom jeziku.

Optimizacija latencije s OpenAI API modelima

Saznajte više o faktorima koji utiču na vrijeme odgovora

Ažurirano: 8 days ago

Na latenciju zahtjeva za dovršavanje najviše utiču dva faktora: model i broj generisanih tokena. Pročitajte našu ažuriranu dokumentaciju za smjernice o poboljšanju latencija.

Da li je ovaj članak bio koristan?