Audio API поддржува две крајни точки за претворање говор во текст:
transcriptionstranslations
За да започнете со Audio API, прочитајте ја нашата документација за програмери за говор во текст.
Колку чини користењето на Audio API?
За детали, погледнете ја нашата страница со цени.
Кои јазици се поддржани?
Погледнете список на поддржани јазици овде.
Како можеме да ракуваме со големи аудиодатотеки?
За поставувања на транскрипции преку legacy/whisper-1 Audio API, максималната големина на барањето е 25 MiB. Поновите рути за транскрипција на gpt-4o може да користат различна валидација, како ограничувања на траење или на токени, затоа проверете ја документацијата за конкретниот модел кога ракувате со долги аудио влезови од корисниците.
Кои методи за стримување се достапни?
Постојат два начина да ја стримувате транскрипцијата, зависно од вашиот случај на употреба и од тоа дали се обидувате да транскрибирате веќе завршена аудиоснимка или да обработувате тековен аудиострим и да го користите OpenAI за детекција на редот за говорење:
Имајте предвид дека стримувањето не е поддржано со моделот whisper-1.
Кои формати на датотеки се поддржани?
Поддржаните формати на датотеки се наведени во нашата API документација.
Може ли да испраќам врски до аудиодатотеки до Audio API?
Не, мора да испратите датотека во еден од поддржаните аудиоформати.
