ஆடியோ API பேச்சிலிருந்து உரை மாற்றுவதற்கான இரண்டு எண்ட்பாயிண்ட்களை ஆதரிக்கிறது:
transcriptionstranslations
ஆடியோ API-யுடன் தொடங்க, எங்கள் பேச்சிலிருந்து உரை டெவலப்பர் ஆவணத்தை படிக்கவும்.
ஆடியோ API-யைப் பயன்படுத்த எவ்வளவு செலவாகும்?
விவரங்களுக்கு எங்கள் விலை நிர்ணயப் பக்கத்தை பார்க்கவும்.
எந்த மொழிகள் ஆதரிக்கப்படுகின்றன?
ஆதரிக்கப்படும் மொழிகளின் பட்டியலை இங்கே பார்க்கவும்.
பெரிய ஆடியோ கோப்புகளை எவ்வாறு கையாளலாம்?
legacy/whisper-1 ஆடியோ API உரையாக்கப் பதிவேற்றங்களுக்கு, அதிகபட்ச கோரிக்கை அளவு 25 MiB ஆகும். புதிய gpt-4o உரையாக்க வழிகள் கால அளவு அல்லது டோக்கன் வரம்புகள் போன்ற வேறு சரிபார்ப்பைப் பயன்படுத்தக்கூடும்; ஆகவே பயனர்களிடமிருந்து வரும் நீண்ட ஆடியோ உள்ளீடுகளைக் கையாளும்போது மாடல் சார்ந்த ஆவணத்தைப் பார்க்கவும்.
எந்த ஸ்ட்ரீமிங் முறைகள் உள்ளன?
உங்கள் பயன்பாட்டு நிலை மற்றும் ஏற்கனவே முடிந்த ஆடியோ பதிவை உரையாக்க முயல்கிறீர்களா அல்லது நடந்து கொண்டிருக்கும் ஆடியோ ஸ்ட்ரீமை கையாள்ந்து, டர்ன் கண்டறிதலுக்கு OpenAI-ஐ பயன்படுத்த முயல்கிறீர்களா என்பதன் அடிப்படையில், உங்கள் உரையாக்கத்தை ஸ்ட்ரீம் செய்ய இரண்டு வழிகள் உள்ளன:
whisper-1 மாடலுடன் ஸ்ட்ரீமிங் ஆதரிக்கப்படாது என்பதை கவனிக்கவும்.
எந்த கோப்பு வடிவங்கள் ஆதரிக்கப்படுகின்றன?
ஆதரிக்கப்படும் கோப்பு வடிவங்கள் எங்கள் API ஆவணங்களில் சேர்க்கப்பட்டுள்ளன.
ஆடியோ கோப்புகளுக்கான இணைப்புகளை ஆடியோ API-க்கு அனுப்பலாமா?
இல்லை, ஆதரிக்கப்படும் ஆடியோ வடிவங்களில் ஒன்றில் ஒரு கோப்பை நீங்கள் அனுப்ப வேண்டும்.
