Audio API atbalsta divus runas pārvēršanas tekstā galapunktus:
transcriptionstranslations
Lai sāktu darbu ar Audio API, lūdzu, izlasiet mūsu izstrādātāju dokumentāciju par runas pārvēršanu tekstā.
Cik maksā Audio API lietošana?
Plašāku informāciju skatiet mūsu cenu lapā.
Kādas valodas tiek atbalstītas?
Skatiet atbalstīto valodu sarakstu šeit.
Kā varam apstrādāt lielus audio failus?
Audio API transkripcijas augšupielādēm, kas izmanto legacy/whisper-1, maksimālais pieprasījuma lielums ir 25 MiB. Jaunākie gpt-4o transkripcijas maršruti var izmantot atšķirīgu validāciju, piemēram, ilguma vai tekstvienību ierobežojumus, tāpēc, apstrādājot garus lietotāju audio ievades datus, skatiet konkrētā modeļa dokumentāciju.
Kādas straumēšanas metodes ir pieejamas?
Ir divi veidi, kā straumēt transkripciju atkarībā no lietošanas gadījuma un tā, vai mēģināt transkribēt jau pabeigtu audio ierakstu vai apstrādāt notiekošu audio straumi un izmantot OpenAI sarunas kārtas noteikšanai:
Ņemiet vērā, ka straumēšana netiek atbalstīta ar modeli whisper-1.
Kādi failu formāti tiek atbalstīti?
Atbalstītie failu formāti ir norādīti mūsu API dokumentācijā.
Vai varu nosūtīt Audio API saites uz audio failiem?
Nē, jums jānosūta fails vienā no atbalstītajiem audio formātiem.
