Audio API podpira dve končni točki za pretvorbo govora v besedilo:
transcriptionstranslations
Za začetek uporabe Audio API preberite našo dokumentacijo za razvijalce o pretvorbi govora v besedilo.
Koliko stane uporaba Audio API?
Za podrobnosti si oglejte našo stran s cenami.
Kateri jeziki so podprti?
Tukaj si oglejte seznam podprtih jezikov.
Kako lahko obravnavamo velike zvočne datoteke?
Za nalaganja prepisov prek starejšega legacy/whisper-1 Audio API je največja velikost zahteve 25 MiB. Novejše poti za prepisovanje gpt-4o lahko uporabljajo drugačno preverjanje veljavnosti, na primer omejitve trajanja ali žetonov, zato pri obravnavi dolgih zvočnih vnosov uporabnikov preverite dokumentacijo za posamezen model.
Kateri načini pretočnega prenosa so na voljo?
Prepis lahko pretočno prenašate na dva načina, odvisno od primera uporabe in od tega, ali želite prepisati že dokončan zvočni posnetek ali obravnavati tekoči zvočni tok ter uporabiti OpenAI za zaznavanje menjav govorca:
Upoštevajte, da pretočni prenos z modelom whisper-1 ni podprt.
Kateri formati datotek so podprti?
Podprti formati datotek so navedeni v naši dokumentaciji API.
Ali lahko v Audio API pošljem povezave do zvočnih datotek?
Ne, poslati morate datoteko v enem od podprtih zvočnih formatov.
