OpenAI
ဤစာမျက်နှာကို စက်ဖြင့် ဘာသာပြန်ထားပါသည်။ မူရင်း အင်္ဂလိပ်ဆောင်းပါးကို ကြည့်ရန်

Audio API အမေးများသောမေးခွန်းများ

Whisper၊ speech to text၊ Audio API ဆိုင်ရာ အထွေထွေမေးခွန်းများ

အပ်ဒိတ်လုပ်ထားသည်- 2 days ago

Audio API သည် စကားသံမှ စာသားသို့ ပြောင်းလဲရန် အဆုံးမှတ် နှစ်ခုကို ပံ့ပိုးထားသည်။

  • transcriptions

  • translations

Audio API ကို စတင်အသုံးပြုရန် ကျွန်ုပ်တို့၏ စကားသံမှ စာသားသို့ ပြောင်းလဲခြင်းဆိုင်ရာ developer စာရွက်စာတမ်းကို ဖတ်ရှုပေးပါ။


Audio API ကို အသုံးပြုရန် ကုန်ကျစရိတ် မည်မျှရှိသနည်း။

အသေးစိတ်အတွက် ကျွန်ုပ်တို့၏ စျေးနှုန်း စာမျက်နှာကို ကြည့်ပါ။


မည်သည့်ဘာသာစကားများကို ပံ့ပိုးထားသနည်း။

ဤနေရာရှိ ပံ့ပိုးထားသော ဘာသာစကားများစာရင်းကို ကြည့်ပါ။


ကြီးမားသော အသံဖိုင်များကို မည်သို့ ကိုင်တွယ်နိုင်သနည်း။

legacy/whisper-1 Audio API transcription အပ်လုဒ်များအတွက် အများဆုံး တောင်းဆိုမှုအရွယ်အစားမှာ 25 MiB ဖြစ်သည်။ ပိုသစ်သော gpt-4o transcription လမ်းကြောင်းများတွင် ကြာချိန် သို့မဟုတ် တိုကင် ကန့်သတ်ချက်များကဲ့သို့သော validation မတူညီနိုင်သောကြောင့် အသုံးပြုသူများထံမှ ရှည်လျားသော အသံ input များကို ကိုင်တွယ်ရာတွင် မော်ဒယ်အလိုက် စာရွက်စာတမ်းကို စစ်ဆေးပါ။


မည်သည့် streaming နည်းလမ်းများ ရရှိနိုင်သနည်း။

သင့်အသုံးပြုပုံနှင့် ပြီးစီးပြီးသား အသံဖမ်းယူမှုကို transcription လုပ်လိုခြင်းရှိမရှိ၊ သို့မဟုတ် ဆက်လက်ဖြစ်ပေါ်နေသော အသံ stream ကို ကိုင်တွယ်ပြီး turn detection အတွက် OpenAI ကို အသုံးပြုလိုခြင်းရှိမရှိပေါ် မူတည်၍ သင်၏ transcription ကို stream လုပ်နိုင်သည့် နည်းလမ်း နှစ်မျိုး ရှိသည်။

whisper-1 မော်ဒယ်တွင် streaming ကို မပံ့ပိုးထားကြောင်း သတိပြုပါ။

မည်သည့်ဖိုင်ဖော်မတ်များကို ပံ့ပိုးထားသနည်း။

ပံ့ပိုးထားသော ဖိုင်ဖော်မတ်များကို ကျွန်ုပ်တို့၏ API စာရွက်စာတမ်းများတွင် ထည့်သွင်းဖော်ပြထားသည်။


အသံဖိုင်များသို့ လင့်ခ်များကို Audio API ထံ ပို့နိုင်ပါသလား။

မပို့နိုင်ပါ၊ ပံ့ပိုးထားသော အသံဖော်မတ်များထဲမှ တစ်ခုဖြင့် ဖိုင်တစ်ခုကို ပို့ရပါမည်။

ဤဆောင်းပါးသည် အထောက်အကူ ဖြစ်ပါသလား။