ऑडिओ API दोन वाणी-ते-मजकूर एंडपॉइंटना समर्थन देते:
transcriptionstranslations
ऑडिओ API वापरण्यास सुरुवात करण्यासाठी, कृपया आमचे वाणी-ते-मजकूर विकसक दस्तऐवजीकरण वाचा.
ऑडिओ API वापरण्यासाठी किती खर्च येतो?
तपशीलांसाठी आमचे किंमत पृष्ठ पहा.
कोणत्या भाषांना समर्थन आहे?
येथे समर्थित भाषांची यादी पहा.
मोठ्या ऑडिओ फाइल्स कशा हाताळता येतील?
लेगसी/whisper-1 ऑडिओ API प्रतिलेखन अपलोडसाठी, कमाल विनंती आकार 25 MiB आहे. नवीन gpt-4o प्रतिलेखन मार्ग कालावधी किंवा टोकन मर्यादा यांसारखे वेगळे सत्यापन वापरू शकतात; म्हणून वापरकर्त्यांकडून येणारे लांब ऑडिओ इनपुट हाताळताना मॉडेल-विशिष्ट दस्तऐवजीकरण तपासा.
कोणत्या प्रवाहीकरण पद्धती उपलब्ध आहेत?
तुमच्या वापरप्रकरणावर आणि तुम्ही आधीच पूर्ण झालेल्या ऑडिओ रेकॉर्डिंगचे प्रतिलेखन करत आहात की ऑडिओचा चालू प्रवाह हाताळून बोलण्याची पाळी ओळखण्यासाठी OpenAI वापरत आहात यावर अवलंबून, तुमचे प्रतिलेखन प्रवाहित करण्याचे दोन मार्ग आहेत:
लक्षात घ्या की whisper-1 मॉडेलसह प्रवाहीकरण समर्थित नाही.
कोणत्या फाइल स्वरूपांना समर्थन आहे?
समर्थित फाइल स्वरूपे आमच्या API दस्तऐवजांमध्ये समाविष्ट आहेत.
मी ऑडिओ फाइल्सचे दुवे ऑडिओ API ला पाठवू शकतो का?
नाही, तुम्ही समर्थित ऑडिओ स्वरूपांपैकी एका स्वरूपातील फाइल पाठवली पाहिजे.
