OpenAI
Энэ хуудсыг машинаар орчуулсан. Англи хэл дээрх нийтлэлийн эх хувилбарыг үзнэ үү.

Аудио API-ийн түгээмэл асуулт

Whisper, ярианаас текст, Аудио API-ийн талаарх ерөнхий асуултууд

Шинэчилсэн: last month

Audio API нь яриаг текст болгох хоёр эцсийн цэгийг дэмждэг:

  • transcriptions

  • translations

Audio API-г ашиглаж эхлэхийн тулд манай яриаг текст болгох хөгжүүлэгчийн баримт бичгийг уншина уу.


Audio API-г ашиглахад хэр үнэтэй вэ?

Дэлгэрэнгүйг манай үнийн хуудаснаас үзнэ үү.


Ямар хэлүүдийг дэмждэг вэ?

Дэмжигдсэн хэлүүдийн жагсаалтыг эндээс үзнэ үү.


Том аудио файлуудыг хэрхэн боловсруулах вэ?

Хуучин legacy/whisper-1 Audio API-д транскрипцийн файл байршуулахад нэг хүсэлтийн дээд хэмжээ 25 MiB байна. Шинэ gpt-4o транскрипцийн маршрутууд үргэлжлэх хугацаа эсвэл токены хязгаар зэрэг өөр шалгалт ашиглаж болзошгүй тул хэрэглэгчдийн урт аудио оролтыг боловсруулахдаа тухайн загварт зориулсан баримт бичгийг шалгана уу.


Ямар стрийминг аргууд боломжтой вэ?

Таны хэрэглээний тохиолдол болон аль хэдийн дууссан аудио бичлэгийг транскрипцлэх гэж байгаа эсэх, эсвэл үргэлжилж буй аудио урсгалыг боловсруулж OpenAI-г ээлж илрүүлэхэд ашиглах гэж байгаа эсэхээс хамааран транскрипцээ стрийминг хийх хоёр арга бий:

whisper-1 загварт стрийминг дэмжигдээгүйг анхаарна уу.

Ямар файлын форматуудыг дэмждэг вэ?

Дэмжигдсэн файлын форматуудыг манай API баримт бичигт оруулсан.


Audio API руу аудио файлын холбоос илгээж болох уу?

Үгүй, та дэмжигдсэн аудио форматуудын аль нэгээр файл илгээх ёстой.

Энэ нийтлэл танд тус болсон уу?