Create Transcription
Використовуйте CometAPI POST /v1/audio/transcriptions, щоб транскрибувати аудіо в текст за допомогою вибраної моделі транскрибування та формату відповіді.
Перший запит
Надішліть підтримуваний аудіофайл ізmodel і file. Під час перевірки обробки завантаження, автентифікації та парсингу відповіді перший файл має бути коротким.
Як читати відповідь
Відповідь за замовчуванням містить транскрибованийtext. Якщо ви запитуєте інший формат відповіді, переконайтеся, що ваш клієнт обробляє саме цей формат, а не покладається на стандартну JSON-структуру.
Наступні кроки
- Використовуйте Create Speech, коли вам потрібен вихід text-to-speech.
- Використовуйте Create Translation, коли цільовим результатом має бути англійська мова.
Авторизації
Bearer token authentication. Use your CometAPI key.
Тіло
The audio file to transcribe. Supported formats: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.
The speech-to-text model to use. Choose a current speech model from the Models page.
The language of the input audio in ISO-639-1 format (e.g., en, zh, ja). Supplying the language improves accuracy and latency.
Optional text to guide the model's style or continue a previous audio segment. The prompt should match the audio language.
The output format for the transcription.
json, text, srt, verbose_json, vtt Sampling temperature between 0 and 1. Higher values produce more random output; lower values are more focused. When set to 0, the model auto-adjusts temperature using log probability.
0 <= x <= 1Відповідь
The transcription result.
The transcribed text.