Audio API mbështet dy pika fundore për të folur në tekst:
transcriptionstranslations
Për të filluar me Audio API, ju lutemi lexoni dokumentacionin tonë për zhvilluesit mbi të folurën në tekst.
Sa kushton përdorimi i Audio API?
Shihni faqen tonë të çmimeve për hollësi.
Cilat gjuhë mbështeten?
Shikoni një listë të gjuhëve të mbështetura këtu.
Si mund t’i trajtojmë skedarët e mëdhenj audio?
Për ngarkimet e transkriptimit në Audio API legacy/whisper-1, madhësia maksimale e kërkesës është 25 MiB. Rrugët më të reja të transkriptimit gpt-4o mund të përdorin validim të ndryshëm, si kufij kohëzgjatjeje ose tokenësh, ndaj kontrolloni dokumentacionin specifik për modelin kur trajtoni hyrje të gjata audio nga përdoruesit.
Cilat metoda transmetimi janë të disponueshme?
Ka dy mënyra për të transmetuar transkriptimin tuaj në varësi të rastit të përdorimit dhe nëse po përpiqeni të transkriptoni një regjistrim audio tashmë të përfunduar ose të trajtoni një transmetim audio në vazhdim dhe të përdorni OpenAI për zbulimin e radhës së të folurit:
Transmetimi i transkriptimit të një regjistrimi audio të përfunduar
Transmetimi i transkriptimit të një regjistrimi audio në vazhdim
Vini re se transmetimi nuk mbështetet me modelin whisper-1.
Cilat formate skedarësh mbështeten?
Formatet e mbështetura të skedarëve përfshihen në dokumentacionin tonë të API-së.
A mund t’i dërgoj Audio API lidhje drejt skedarëve audio?
Jo, duhet të dërgoni një skedar në një nga formatet audio të mbështetura.
