OpenAI
ఈ పేజీ మెషిన్ ట్రాన్స్‌లేషన్‌తో అనువదించబడింది. అసలు ఇంగ్లీష్ ఆర్టికల్‌ను చూడండి.

ఆడియో API FAQ

Whisper, స్పీచ్ టు టెక్స్ట్, ఆడియో API గురించి సాధారణ ప్రశ్నలు

అప్డేట్ చేయబడిన: 8 days ago

ఆడియో API రెండు స్పీచ్-టు-టెక్స్ట్ ఎండ్‌పాయింట్‌లకు మద్దతు ఇస్తుంది:

  • transcriptions

  • translations

ఆడియో APIతో ప్రారంభించడానికి, దయచేసి మా స్పీచ్-టు-టెక్స్ట్ డెవలపర్ డాక్యుమెంటేషన్ చదవండి.


ఆడియో APIని ఉపయోగించడానికి ఎంత ఖర్చవుతుంది?

వివరాల కోసం మా ధరల పేజీ చూడండి.


ఏ భాషలకు మద్దతు ఉంది?

మద్దతు ఉన్న భాషల జాబితాను ఇక్కడ చూడండి.


పెద్ద ఆడియో ఫైల్‌లను ఎలా నిర్వహించగలం?

లెగసీ/whisper-1 ఆడియో API ట్రాన్స్‌క్రిప్షన్ అప్‌లోడ్‌లకు, గరిష్ఠ అభ్యర్థన పరిమాణం 25 MiB. కొత్త gpt-4o ట్రాన్స్‌క్రిప్షన్ రూట్‌లు వ్యవధి లేదా టోకెన్ పరిమితుల వంటి వేరే ధృవీకరణను ఉపయోగించవచ్చు, కాబట్టి వినియోగదారుల నుంచి వచ్చే పొడవైన ఆడియో ఇన్‌పుట్‌లను నిర్వహించేటప్పుడు మోడల్-నిర్దిష్ట డాక్యుమెంటేషన్‌ను తనిఖీ చేయండి.


ఏ స్ట్రీమింగ్ పద్ధతులు అందుబాటులో ఉన్నాయి?

మీ వినియోగ సందర్భాన్ని బట్టి, అలాగే ఇప్పటికే పూర్తయిన ఆడియో రికార్డింగ్‌ను ట్రాన్స్‌క్రైబ్ చేయాలనుకుంటున్నారా లేదా కొనసాగుతున్న ఆడియో స్ట్రీమ్‌ను నిర్వహించి టర్న్ గుర్తింపుకు OpenAIని ఉపయోగించాలనుకుంటున్నారా అనేదాన్ని బట్టి, మీ ట్రాన్స్‌క్రిప్షన్‌ను స్ట్రీమ్ చేయడానికి రెండు మార్గాలు ఉన్నాయి:

whisper-1 మోడల్‌తో స్ట్రీమింగ్‌కు మద్దతు లేదని గమనించండి.

ఏ ఫైల్ ఫార్మాట్‌లకు మద్దతు ఉంది?

మద్దతు ఉన్న ఫైల్ ఫార్మాట్‌లు మా API డాక్స్‌లో చేర్చబడ్డాయి.


ఆడియో ఫైల్‌లకు లింక్‌లను ఆడియో APIకి పంపవచ్చా?

లేదు, మద్దతు ఉన్న ఆడియో ఫార్మాట్‌లలో ఒకదానిలో ఫైల్‌ను పంపాలి.

ఈ వ్యాసం ఉపయోగకరంగా ఉందా?