OpenAI
Ova stranica je mašinski prevedena. Pogledaj originalni članak na engleskom jeziku.

ČPP za Audio API

Opća pitanja o Whisperu, pretvaranju govora u tekst i Audio API-ju

Ažurirano: 8 days ago

Audio API podržava dvije krajnje tačke za pretvaranje govora u tekst:

  • transcriptions

  • translations

Da biste započeli s Audio API-jem, pročitajte našu dokumentaciju za programere o pretvaranju govora u tekst.


Koliko košta korištenje Audio API-ja?

Za detalje pogledajte našu stranicu s cijenama.


Koji jezici su podržani?

Ovdje pogledajte listu podržanih jezika.


Kako možemo rukovati velikim audio datotekama?

Za otpremanja transkripcija putem legacy/whisper-1 Audio API-ja, maksimalna veličina zahtjeva je 25 MiB. Novije rute za transkripciju gpt-4o mogu koristiti drugačiju validaciju, kao što su ograničenja trajanja ili tokena, zato provjerite dokumentaciju za konkretni model kada obrađujete duge audio unose korisnika.


Koje metode streaminga su dostupne?

Postoje dva načina na koja možete streamati transkripciju, ovisno o vašem slučaju upotrebe i tome da li pokušavate transkribovati već završeni audio snimak ili rukovati tekućim audio streamom i koristiti OpenAI za detekciju smjene govornika:

Imajte na umu da streaming nije podržan s modelom whisper-1.

Koji formati datoteka su podržani?

Podržani formati datoteka navedeni su u našoj API dokumentaciji.


Mogu li poslati linkove do audio datoteka u Audio API?

Ne, morate poslati datoteku u jednom od podržanih audio formata.

Da li je ovaj članak bio koristan?