OpenAI
Halaman ini diterjemah oleh mesin. Lihat artikel asal dalam bahasa Inggeris.

Mengoptimumkan latensi dengan model API OpenAI

Ketahui faktor yang mempengaruhi masa respons

Dikemas kini: 9 days ago

Latensi permintaan pelengkapan kebanyakannya dipengaruhi oleh dua faktor: model dan bilangan token yang dijana. Sila baca dokumentasi kami yang dikemas kini untuk panduan tentang cara mengurangkan latensi.

Adakah artikel ini membantu?