Create transcription
Gunakan CometAPI POST /v1/audio/transcriptions untuk mentranskripsikan audio menjadi teks dengan model transkripsi dan format respons yang dipilih.
Permintaan pertama
Kirim file audio yang didukung denganmodel dan file. Pertahankan file pertama tetap singkat saat Anda memvalidasi penanganan upload, autentikasi, dan parsing respons.
Baca respons
Respons default menyertakantext hasil transkripsi. Jika Anda meminta format respons lain, pastikan klien Anda mem-parsing format tersebut alih-alih mengasumsikan bentuk JSON default.
Langkah berikutnya
- Gunakan Create Speech saat Anda memerlukan output text-to-speech.
- Gunakan Create Translation saat output target harus berupa bahasa Inggris.
Otorisasi
Bearer token authentication. Use your CometAPI key.
Body
The audio file to transcribe. Supported formats: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.
The speech-to-text model to use. Choose a current speech model from the Models page.
The language of the input audio in ISO-639-1 format (e.g., en, zh, ja). Supplying the language improves accuracy and latency.
Optional text to guide the model's style or continue a previous audio segment. The prompt should match the audio language.
The output format for the transcription.
json, text, srt, verbose_json, vtt Sampling temperature between 0 and 1. Higher values produce more random output; lower values are more focused. When set to 0, the model auto-adjusts temperature using log probability.
0 <= x <= 1Respons
The transcription result.
The transcribed text.