OpenAI
ਇਸ ਪੰਨੇ ਦਾ ਮਸ਼ੀਨ ਦੁਆਰਾ ਅਨੁਵਾਦ ਕੀਤਾ ਗਿਆ ਸੀ। ਮੂਲ ਅੰਗਰੇਜ਼ੀ ਲੇਖ ਦੇਖੋ

Audio API FAQ

Whisper, speech to text, Audio API ਬਾਰੇ ਆਮ ਸਵਾਲ

ਅੱਪਡੇਟ ਕੀਤਾ: last month

ਆਡੀਓ API ਦੋ ਬੋਲੀ-ਤੋਂ-ਟੈਕਸਟ ਐਂਡਪੌਇੰਟਾਂ ਦਾ ਸਮਰਥਨ ਕਰਦਾ ਹੈ:

  • transcriptions

  • translations

ਆਡੀਓ API ਨਾਲ ਸ਼ੁਰੂਆਤ ਕਰਨ ਲਈ, ਕਿਰਪਾ ਕਰਕੇ ਸਾਡਾ ਬੋਲੀ ਤੋਂ ਟੈਕਸਟ ਡਿਵੈਲਪਰ ਦਸਤਾਵੇਜ਼ ਪੜ੍ਹੋ.


ਆਡੀਓ API ਵਰਤਣ ਦੀ ਲਾਗਤ ਕਿੰਨੀ ਹੈ?

ਵੇਰਵਿਆਂ ਲਈ ਸਾਡਾ ਕੀਮਤਾਂ ਵਾਲਾ ਪੰਨਾ ਵੇਖੋ.


ਕਿਹੜੀਆਂ ਭਾਸ਼ਾਵਾਂ ਸਮਰਥਿਤ ਹਨ?

ਸਮਰਥਿਤ ਭਾਸ਼ਾਵਾਂ ਦੀ ਸੂਚੀ ਇੱਥੇ ਵੇਖੋ.


ਅਸੀਂ ਵੱਡੀਆਂ ਆਡੀਓ ਫ਼ਾਈਲਾਂ ਨੂੰ ਕਿਵੇਂ ਸੰਭਾਲ ਸਕਦੇ ਹਾਂ?

legacy/whisper-1 ਆਡੀਓ API ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਅੱਪਲੋਡਾਂ ਲਈ, ਬੇਨਤੀ ਦਾ ਵੱਧ ਤੋਂ ਵੱਧ ਆਕਾਰ 25 MiB ਹੈ. ਨਵੇਂ gpt-4o ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਰੂਟ ਵੱਖਰੀ ਪ੍ਰਮਾਣਿਕਤਾ ਵਰਤ ਸਕਦੇ ਹਨ, ਜਿਵੇਂ ਅਵਧੀ ਜਾਂ ਟੋਕਨ ਸੀਮਾਵਾਂ, ਇਸ ਲਈ ਵਰਤੋਂਕਾਰਾਂ ਤੋਂ ਲੰਬੀਆਂ ਆਡੀਓ ਇਨਪੁੱਟਾਂ ਸੰਭਾਲਦੇ ਸਮੇਂ ਮਾਡਲ-ਵਿਸ਼ੇਸ਼ ਦਸਤਾਵੇਜ਼ ਵੇਖੋ.


ਕਿਹੜੇ ਸਟ੍ਰੀਮਿੰਗ ਤਰੀਕੇ ਉਪਲਬਧ ਹਨ?

ਤੁਹਾਡੇ ਵਰਤੋਂ ਮਾਮਲੇ ਅਤੇ ਇਸ ਗੱਲ ਦੇ ਅਧਾਰ ਤੇ ਕਿ ਤੁਸੀਂ ਪਹਿਲਾਂ ਹੀ ਪੂਰੀ ਹੋ ਚੁੱਕੀ ਆਡੀਓ ਰਿਕਾਰਡਿੰਗ ਨੂੰ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕਰਨਾ ਚਾਹੁੰਦੇ ਹੋ ਜਾਂ ਆਡੀਓ ਦੀ ਚੱਲ ਰਹੀ ਸਟ੍ਰੀਮ ਨੂੰ ਸੰਭਾਲਣਾ ਅਤੇ ਵਾਰੀ ਦੀ ਪਛਾਣ ਲਈ OpenAI ਵਰਤਣਾ ਚਾਹੁੰਦੇ ਹੋ, ਆਪਣੀ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਸਟ੍ਰੀਮ ਕਰਨ ਦੇ ਦੋ ਤਰੀਕੇ ਹਨ:

ਧਿਆਨ ਦਿਓ ਕਿ whisper-1 ਮਾਡਲ ਨਾਲ ਸਟ੍ਰੀਮਿੰਗ ਸਮਰਥਿਤ ਨਹੀਂ ਹੈ.

ਕਿਹੜੇ ਫ਼ਾਈਲ ਫਾਰਮੈਟ ਸਮਰਥਿਤ ਹਨ?

ਸਮਰਥਿਤ ਫ਼ਾਈਲ ਫਾਰਮੈਟ ਸਾਡੇ API ਦਸਤਾਵੇਜ਼ਾਂ ਵਿੱਚ ਦਿੱਤੇ ਗਏ ਹਨ.


ਕੀ ਮੈਂ ਆਡੀਓ ਫ਼ਾਈਲਾਂ ਦੇ ਲਿੰਕ ਆਡੀਓ API ਨੂੰ ਭੇਜ ਸਕਦਾ/ਸਕਦੀ ਹਾਂ?

ਨਹੀਂ, ਤੁਹਾਨੂੰ ਸਮਰਥਿਤ ਆਡੀਓ ਫਾਰਮੈਟਾਂ ਵਿੱਚੋਂ ਕਿਸੇ ਇੱਕ ਵਿੱਚ ਫ਼ਾਈਲ ਭੇਜਣੀ ਲਾਜ਼ਮੀ ਹੈ.

ਕੀ ਇਹ ਲੇਖ ਉਪਯੋਗੀ ਸੀ?