ಆಡಿಯೊ API ಮಾತಿನಿಂದ ಪಠ್ಯಕ್ಕೆ ಪರಿವರ್ತಿಸುವ ಎರಡು ಎಂಡ್ಪಾಯಿಂಟ್ಗಳನ್ನು ಬೆಂಬಲಿಸುತ್ತದೆ:
transcriptionstranslations
ಆಡಿಯೊ API ಬಳಕೆ ಆರಂಭಿಸಲು, ದಯವಿಟ್ಟು ನಮ್ಮ ಮಾತಿನಿಂದ ಪಠ್ಯಕ್ಕೆ ಪರಿವರ್ತಿಸುವ ಡೆವಲಪರ್ ದಸ್ತಾವೇಜನ್ನು ಓದಿ.
ಆಡಿಯೊ API ಬಳಸಲು ಎಷ್ಟು ವೆಚ್ಚವಾಗುತ್ತದೆ?
ವಿವರಗಳಿಗಾಗಿ ನಮ್ಮ ಬೆಲೆ ಪುಟವನ್ನು ನೋಡಿ.
ಯಾವ ಭಾಷೆಗಳು ಬೆಂಬಲಿತವಾಗಿವೆ?
ಇಲ್ಲಿ ಬೆಂಬಲಿತ ಭಾಷೆಗಳ ಪಟ್ಟಿಯನ್ನು ನೋಡಿ.
ದೊಡ್ಡ ಆಡಿಯೊ ಫೈಲ್ಗಳನ್ನು ನಾವು ಹೇಗೆ ನಿರ್ವಹಿಸಬಹುದು?
legacy/whisper-1 ಆಡಿಯೊ API ಲಿಪ್ಯಂತರಣ ಅಪ್ಲೋಡ್ಗಳಿಗೆ, ಗರಿಷ್ಠ ವಿನಂತಿ ಗಾತ್ರ 25 MiB ಆಗಿದೆ. ಹೊಸ gpt-4o ಲಿಪ್ಯಂತರಣ ಮಾರ್ಗಗಳು ಅವಧಿ ಅಥವಾ ಟೋಕನ್ ಮಿತಿಗಳಂತಹ ಬೇರೆ ಮಾನ್ಯೀಕರಣವನ್ನು ಬಳಸಬಹುದು; ಆದ್ದರಿಂದ ಬಳಕೆದಾರರಿಂದ ಬರುವ ದೀರ್ಘ ಆಡಿಯೊ ಇನ್ಪುಟ್ಗಳನ್ನು ನಿರ್ವಹಿಸುವಾಗ ಮಾಡೆಲ್-ನಿರ್ದಿಷ್ಟ ದಸ್ತಾವೇಜನ್ನು ಪರಿಶೀಲಿಸಿ.
ಯಾವ ಸ್ಟ್ರೀಮಿಂಗ್ ವಿಧಾನಗಳು ಲಭ್ಯವಿವೆ?
ನಿಮ್ಮ ಬಳಕೆಯ ಸಂದರ್ಭವನ್ನು ಅವಲಂಬಿಸಿ ಮತ್ತು ನೀವು ಈಗಾಗಲೇ ಪೂರ್ಣಗೊಂಡ ಆಡಿಯೊ ರೆಕಾರ್ಡಿಂಗ್ ಅನ್ನು ಲಿಪ್ಯಂತರಿಸಲು ಪ್ರಯತ್ನಿಸುತ್ತಿದ್ದೀರಾ ಅಥವಾ ನಡೆಯುತ್ತಿರುವ ಆಡಿಯೊ ಸ್ಟ್ರೀಮ್ ಅನ್ನು ನಿರ್ವಹಿಸಿ ಸರದಿ ಪತ್ತೆಗಾಗಿ OpenAI ಬಳಸಲು ಬಯಸುತ್ತಿದ್ದೀರಾ ಎಂಬುದನ್ನು ಅವಲಂಬಿಸಿ, ನಿಮ್ಮ ಲಿಪ್ಯಂತರಣವನ್ನು ಸ್ಟ್ರೀಮ್ ಮಾಡಲು ಎರಡು ವಿಧಾನಗಳಿವೆ:
ಪೂರ್ಣಗೊಂಡ ಆಡಿಯೊ ರೆಕಾರ್ಡಿಂಗ್ನ ಲಿಪ್ಯಂತರಣವನ್ನು ಸ್ಟ್ರೀಮ್ ಮಾಡುವುದು
ನಡೆಯುತ್ತಿರುವ ಆಡಿಯೊ ರೆಕಾರ್ಡಿಂಗ್ನ ಲಿಪ್ಯಂತರಣವನ್ನು ಸ್ಟ್ರೀಮ್ ಮಾಡುವುದು
whisper-1 ಮಾಡೆಲ್ನೊಂದಿಗೆ ಸ್ಟ್ರೀಮಿಂಗ್ ಬೆಂಬಲಿತವಾಗಿಲ್ಲ ಎಂಬುದನ್ನು ಗಮನಿಸಿ.
ಯಾವ ಫೈಲ್ ಸ್ವರೂಪಗಳು ಬೆಂಬಲಿತವಾಗಿವೆ?
ಬೆಂಬಲಿತ ಫೈಲ್ ಸ್ವರೂಪಗಳನ್ನು ನಮ್ಮ API ದಸ್ತಾವೇಜಿನಲ್ಲಿ ಸೇರಿಸಲಾಗಿದೆ.
ನಾನು ಆಡಿಯೊ ಫೈಲ್ಗಳ ಲಿಂಕ್ಗಳನ್ನು ಆಡಿಯೊ APIಗೆ ಕಳುಹಿಸಬಹುದೇ?
ಇಲ್ಲ, ನೀವು ಬೆಂಬಲಿತ ಆಡಿಯೊ ಸ್ವರೂಪಗಳಲ್ಲಿ ಒಂದರಲ್ಲಿರುವ ಫೈಲ್ ಅನ್ನು ಕಳುಹಿಸಬೇಕು.
