Create transcription
Bruk CometAPI POST /v1/audio/transcriptions til å transkribere lyd til tekst med en valgt transkripsjonsmodell og et valgt responsformat.
Første forespørsel
Send en støttet lydfil medmodel og file. Hold den første filen kort mens du validerer håndtering av opplasting, autentisering og parsing av responsen.
Les responsen
Standardresponsen inkluderer den transkribertetext. Hvis du ber om et annet responsformat, må du sørge for at klienten din parser dette formatet i stedet for å anta standard JSON-struktur.
Neste steg
- Bruk Create Speech når du trenger tekst-til-tale-utdata.
- Bruk Create Translation når målutdataene skal være engelsk.
Autorisasjoner
Bearer token authentication. Use your CometAPI key.
Kropp
The audio file to transcribe. Supported formats: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.
The speech-to-text model to use. Choose a current speech model from the Models page.
The language of the input audio in ISO-639-1 format (e.g., en, zh, ja). Supplying the language improves accuracy and latency.
Optional text to guide the model's style or continue a previous audio segment. The prompt should match the audio language.
The output format for the transcription.
json, text, srt, verbose_json, vtt Sampling temperature between 0 and 1. Higher values produce more random output; lower values are more focused. When set to 0, the model auto-adjusts temperature using log probability.
0 <= x <= 1Svar
The transcription result.
The transcribed text.