OpenAI
या पेजला मशीनद्वारे भाषांतरित केले आहे. मूळ इंग्रजी लेख पहा.

Audio API FAQ

Whisper, speech to text, Audio API याबद्दलचे सामान्य प्रश्न

अपडेट केले: 8 days ago

ऑडिओ API दोन वाणी-ते-मजकूर एंडपॉइंटना समर्थन देते:

  • transcriptions

  • translations

ऑडिओ API वापरण्यास सुरुवात करण्यासाठी, कृपया आमचे वाणी-ते-मजकूर विकसक दस्तऐवजीकरण वाचा.


ऑडिओ API वापरण्यासाठी किती खर्च येतो?

तपशीलांसाठी आमचे किंमत पृष्ठ पहा.


कोणत्या भाषांना समर्थन आहे?

येथे समर्थित भाषांची यादी पहा.


मोठ्या ऑडिओ फाइल्स कशा हाताळता येतील?

लेगसी/whisper-1 ऑडिओ API प्रतिलेखन अपलोडसाठी, कमाल विनंती आकार 25 MiB आहे. नवीन gpt-4o प्रतिलेखन मार्ग कालावधी किंवा टोकन मर्यादा यांसारखे वेगळे सत्यापन वापरू शकतात; म्हणून वापरकर्त्यांकडून येणारे लांब ऑडिओ इनपुट हाताळताना मॉडेल-विशिष्ट दस्तऐवजीकरण तपासा.


कोणत्या प्रवाहीकरण पद्धती उपलब्ध आहेत?

तुमच्या वापरप्रकरणावर आणि तुम्ही आधीच पूर्ण झालेल्या ऑडिओ रेकॉर्डिंगचे प्रतिलेखन करत आहात की ऑडिओचा चालू प्रवाह हाताळून बोलण्याची पाळी ओळखण्यासाठी OpenAI वापरत आहात यावर अवलंबून, तुमचे प्रतिलेखन प्रवाहित करण्याचे दोन मार्ग आहेत:

लक्षात घ्या की whisper-1 मॉडेलसह प्रवाहीकरण समर्थित नाही.

कोणत्या फाइल स्वरूपांना समर्थन आहे?

समर्थित फाइल स्वरूपे आमच्या API दस्तऐवजांमध्ये समाविष्ट आहेत.


मी ऑडिओ फाइल्सचे दुवे ऑडिओ API ला पाठवू शकतो का?

नाही, तुम्ही समर्थित ऑडिओ स्वरूपांपैकी एका स्वरूपातील फाइल पाठवली पाहिजे.

हा लेख उपयुक्त आहे का?