OpenAI
Kjo faqe u përkthye automatikisht. Shih artikullin origjinal në anglisht.

Optimizimi i latencës me modelet e API-së OpenAI

Mësoni rreth faktorëve që ndikojnë në kohën e përgjigjes

Përditësuar: 6 days ago

Vonesa e një kërkese për plotësim ndikohet kryesisht nga dy faktorë: modeli dhe numri i tokenëve të gjeneruar. Ju lutemi lexoni dokumentacionin tonë të përditësuar për udhëzime mbi përmirësimin e vonesave.

A ishte i dobishëm ky artikull?