API Audio menyokong dua titik akhir pertuturan kepada teks:
transcriptionstranslations
Untuk mula menggunakan API Audio, sila baca dokumentasi pembangun pertuturan kepada teks kami.
Berapakah kos menggunakan API Audio?
Lihat halaman harga kami untuk butiran lanjut.
Bahasa apakah yang disokong?
Lihat senarai bahasa yang disokong di sini.
Bagaimanakah fail audio besar boleh dikendalikan?
Untuk muat naik transkripsi API Audio legacy/whisper-1, saiz permintaan maksimum ialah 25 MiB. Laluan transkripsi gpt-4o yang lebih baharu mungkin menggunakan pengesahan yang berbeza, seperti had tempoh atau token, jadi semak dokumentasi khusus model apabila mengendalikan input audio panjang daripada pengguna.
Apakah kaedah penstriman yang tersedia?
Terdapat dua cara untuk menstrim transkripsi anda, bergantung pada kes penggunaan anda dan sama ada anda mahu mentranskripsikan rakaman audio yang sudah lengkap atau mengendalikan strim audio yang sedang berlangsung serta menggunakan OpenAI untuk pengesanan giliran:
Harap maklum bahawa penstriman tidak disokong dengan model whisper-1.
Format fail apakah yang disokong?
Format fail yang disokong disenaraikan dalam dokumen API kami.
Bolehkah saya menghantar pautan ke fail audio kepada API Audio?
Tidak, anda mesti menghantar fail dalam salah satu format audio yang disokong.
