OpenAI
ഈ പേജ് യന്ത്രസഹായത്താൽ വിവർത്തനം ചെയ്തത് ആണ്. യഥാർത്ഥ ഇംഗ്ലീഷ് ലേഖനം കാണുക.

Audio API പതിവുചോദ്യങ്ങൾ

Whisper, speech to text, Audio API എന്നിവയെക്കുറിച്ചുള്ള പൊതുചോദ്യങ്ങൾ

അപ്‌ഡേറ്റ് ചെയ്തത്: 8 days ago.

ഓഡിയോ API സംസാരത്തെ ടെക്സ്റ്റാക്കി മാറ്റുന്ന രണ്ട് എൻഡ്‌പോയിന്റുകളെ പിന്തുണയ്ക്കുന്നു:

  • transcriptions

  • translations

ഓഡിയോ API ഉപയോഗിച്ച് ആരംഭിക്കാൻ, ഞങ്ങളുടെ സംസാരം ടെക്സ്റ്റാക്കുന്ന വികസക ഡോക്യുമെന്റേഷൻ വായിക്കുക.


ഓഡിയോ API ഉപയോഗിക്കാൻ എത്ര ചെലവാകും?

വിശദാംശങ്ങൾക്ക് ഞങ്ങളുടെ വിലനിർണ്ണയ പേജ് കാണുക.


ഏത് ഭാഷകളാണ് പിന്തുണയ്ക്കുന്നത്?

പിന്തുണയ്ക്കുന്ന ഭാഷകളുടെ പട്ടിക ഇവിടെ കാണുക.


വലിയ ഓഡിയോ ഫയലുകൾ എങ്ങനെ കൈകാര്യം ചെയ്യാം?

legacy/whisper-1 ഓഡിയോ API ട്രാൻസ്ക്രിപ്ഷൻ അപ്‌ലോഡുകൾക്കുള്ള പരമാവധി അഭ്യർത്ഥന വലുപ്പം 25 MiB ആണ്. പുതിയ gpt-4o ട്രാൻസ്ക്രിപ്ഷൻ റൂട്ടുകൾ ദൈർഘ്യം അല്ലെങ്കിൽ ടോക്കൺ പരിധികൾ പോലുള്ള വ്യത്യസ്ത സാധൂകരണം ഉപയോഗിച്ചേക്കാം; അതിനാൽ ഉപയോക്താക്കളിൽ നിന്നുള്ള നീളമുള്ള ഓഡിയോ ഇൻപുട്ടുകൾ കൈകാര്യം ചെയ്യുമ്പോൾ മോഡൽ-നിർദ്ദിഷ്ട ഡോക്യുമെന്റേഷൻ പരിശോധിക്കുക.


ഏത് സ്ട്രീമിംഗ് രീതികളാണ് ലഭ്യമായത്?

നിങ്ങളുടെ ഉപയോഗ സാഹചര്യവും ഇതിനകം പൂർത്തിയായ ഓഡിയോ റെക്കോർഡിംഗ് ട്രാൻസ്‌ക്രൈബ് ചെയ്യാനാണോ, അല്ലെങ്കിൽ തുടരുന്ന ഓഡിയോ സ്ട്രീം കൈകാര്യം ചെയ്ത് ടേൺ കണ്ടെത്തലിന് OpenAI ഉപയോഗിക്കാനാണോ ശ്രമിക്കുന്നത് എന്നതും ആശ്രയിച്ച്, നിങ്ങളുടെ ട്രാൻസ്ക്രിപ്ഷൻ സ്ട്രീം ചെയ്യാൻ രണ്ട് മാർഗങ്ങളുണ്ട്:

whisper-1 മോഡലിനൊപ്പം സ്ട്രീമിംഗ് പിന്തുണയ്ക്കുന്നില്ലെന്ന് ശ്രദ്ധിക്കുക.

ഏത് ഫയൽ ഫോർമാറ്റുകളാണ് പിന്തുണയ്ക്കുന്നത്?

പിന്തുണയ്ക്കുന്ന ഫയൽ ഫോർമാറ്റുകൾ ഞങ്ങളുടെ API ഡോക്സിൽ ഉൾപ്പെടുത്തിയിട്ടുണ്ട്.


ഓഡിയോ ഫയലുകളിലേക്കുള്ള ലിങ്കുകൾ ഓഡിയോ API-ലേക്ക് അയയ്ക്കാമോ?

ഇല്ല, പിന്തുണയ്ക്കുന്ന ഓഡിയോ ഫോർമാറ്റുകളിലൊന്നിലുള്ള ഒരു ഫയൽ നിങ്ങൾ അയയ്ക്കണം.

ഈ ലേഖനം ഉപകാരപ്രദമായിരുന്നോ?