ഓഡിയോ API സംസാരത്തെ ടെക്സ്റ്റാക്കി മാറ്റുന്ന രണ്ട് എൻഡ്പോയിന്റുകളെ പിന്തുണയ്ക്കുന്നു:
transcriptionstranslations
ഓഡിയോ API ഉപയോഗിച്ച് ആരംഭിക്കാൻ, ഞങ്ങളുടെ സംസാരം ടെക്സ്റ്റാക്കുന്ന വികസക ഡോക്യുമെന്റേഷൻ വായിക്കുക.
ഓഡിയോ API ഉപയോഗിക്കാൻ എത്ര ചെലവാകും?
വിശദാംശങ്ങൾക്ക് ഞങ്ങളുടെ വിലനിർണ്ണയ പേജ് കാണുക.
ഏത് ഭാഷകളാണ് പിന്തുണയ്ക്കുന്നത്?
പിന്തുണയ്ക്കുന്ന ഭാഷകളുടെ പട്ടിക ഇവിടെ കാണുക.
വലിയ ഓഡിയോ ഫയലുകൾ എങ്ങനെ കൈകാര്യം ചെയ്യാം?
legacy/whisper-1 ഓഡിയോ API ട്രാൻസ്ക്രിപ്ഷൻ അപ്ലോഡുകൾക്കുള്ള പരമാവധി അഭ്യർത്ഥന വലുപ്പം 25 MiB ആണ്. പുതിയ gpt-4o ട്രാൻസ്ക്രിപ്ഷൻ റൂട്ടുകൾ ദൈർഘ്യം അല്ലെങ്കിൽ ടോക്കൺ പരിധികൾ പോലുള്ള വ്യത്യസ്ത സാധൂകരണം ഉപയോഗിച്ചേക്കാം; അതിനാൽ ഉപയോക്താക്കളിൽ നിന്നുള്ള നീളമുള്ള ഓഡിയോ ഇൻപുട്ടുകൾ കൈകാര്യം ചെയ്യുമ്പോൾ മോഡൽ-നിർദ്ദിഷ്ട ഡോക്യുമെന്റേഷൻ പരിശോധിക്കുക.
ഏത് സ്ട്രീമിംഗ് രീതികളാണ് ലഭ്യമായത്?
നിങ്ങളുടെ ഉപയോഗ സാഹചര്യവും ഇതിനകം പൂർത്തിയായ ഓഡിയോ റെക്കോർഡിംഗ് ട്രാൻസ്ക്രൈബ് ചെയ്യാനാണോ, അല്ലെങ്കിൽ തുടരുന്ന ഓഡിയോ സ്ട്രീം കൈകാര്യം ചെയ്ത് ടേൺ കണ്ടെത്തലിന് OpenAI ഉപയോഗിക്കാനാണോ ശ്രമിക്കുന്നത് എന്നതും ആശ്രയിച്ച്, നിങ്ങളുടെ ട്രാൻസ്ക്രിപ്ഷൻ സ്ട്രീം ചെയ്യാൻ രണ്ട് മാർഗങ്ങളുണ്ട്:
പൂർത്തിയായ ഓഡിയോ റെക്കോർഡിംഗിന്റെ ട്രാൻസ്ക്രിപ്ഷൻ സ്ട്രീം ചെയ്യൽ
തുടരുന്ന ഓഡിയോ റെക്കോർഡിംഗിന്റെ ട്രാൻസ്ക്രിപ്ഷൻ സ്ട്രീം ചെയ്യൽ
whisper-1 മോഡലിനൊപ്പം സ്ട്രീമിംഗ് പിന്തുണയ്ക്കുന്നില്ലെന്ന് ശ്രദ്ധിക്കുക.
ഏത് ഫയൽ ഫോർമാറ്റുകളാണ് പിന്തുണയ്ക്കുന്നത്?
പിന്തുണയ്ക്കുന്ന ഫയൽ ഫോർമാറ്റുകൾ ഞങ്ങളുടെ API ഡോക്സിൽ ഉൾപ്പെടുത്തിയിട്ടുണ്ട്.
ഓഡിയോ ഫയലുകളിലേക്കുള്ള ലിങ്കുകൾ ഓഡിയോ API-ലേക്ക് അയയ്ക്കാമോ?
ഇല്ല, പിന്തുണയ്ക്കുന്ന ഓഡിയോ ഫോർമാറ്റുകളിലൊന്നിലുള്ള ഒരു ഫയൽ നിങ്ങൾ അയയ്ക്കണം.
