Vonesa e një kërkese për plotësim ndikohet kryesisht nga dy faktorë: modeli dhe numri i tokenëve të gjeneruar. Ju lutemi lexoni dokumentacionin tonë të përditësuar për udhëzime mbi përmirësimin e vonesave.
Optimizimi i latencës me modelet e API-së OpenAI
Mësoni rreth faktorëve që ndikojnë në kohën e përgjigjes
Përditësuar: 6 days ago
