Audio API ሁለት የንግግር ወደ ጽሑፍ መጨረሻ ነጥቦችን ይደግፋል፦
transcriptionstranslations
በAudio API ለመጀመር፣ እባክዎ የእኛን የንግግር ወደ ጽሑፍ የገንቢ ሰነድ ያንብቡ።
Audio APIን ለመጠቀም ዋጋው ምን ያህል ነው?
ለዝርዝሮች የእኛን የዋጋ ገጽ ይመልከቱ።
የትኞቹ ቋንቋዎች ይደገፋሉ?
የሚደገፉ ቋንቋዎችን ዝርዝር እዚህ ይመልከቱ።
ትላልቅ የድምጽ ፋይሎችን እንዴት መያዝ እንችላለን?
ለlegacy/whisper-1 Audio API የጽሑፍ ቅጂ ሰቀላዎች፣ ከፍተኛው የጥያቄ መጠን 25 MiB ነው። አዲሶቹ የgpt-4o የጽሑፍ ቅጂ መንገዶች እንደ ቆይታ ወይም የtoken ገደቦች ያሉ የተለየ ማረጋገጫ ሊጠቀሙ ይችላሉ፣ ስለዚህ ከተጠቃሚዎች ረጅም የድምጽ ግቤቶችን ሲይዙ ለሞዴሉ የተለየውን ሰነድ ይመልከቱ።
የትኞቹ የዥረት ዘዴዎች ይገኛሉ?
እንደ አጠቃቀም ሁኔታዎ እና ቀድሞ የተጠናቀቀ የድምጽ ቀረጻን ወደ ጽሑፍ ለመቅዳት ወይም በመቀጠል ላይ ያለ የድምጽ ዥረትን ለመያዝ እና OpenAIን ለተራ መለየት ለመጠቀም እየሞከሩ መሆኑን በመመስረት፣ የጽሑፍ ቅጂዎን በዥረት ለማስተላለፍ ሁለት መንገዶች አሉ፦
ዥረት ማስተላለፍ በwhisper-1 ሞዴል እንደማይደገፍ ያስተውሉ።
የትኞቹ የፋይል ቅርጸቶች ይደገፋሉ?
የሚደገፉት የፋይል ቅርጸቶች በእኛ API ሰነዶች ውስጥ ተካትተዋል።
ወደ Audio API የድምጽ ፋይሎች አገናኞችን መላክ እችላለሁ?
አይ፣ ከሚደገፉት የድምጽ ቅርጸቶች በአንዱ ፋይል መላክ አለብዎት።
