Skip to main content
POST
Python
Bruk dette endepunktet til å transkribere lyd til tekst på kildespråket. Det passer for møtereferater, talemeldinger, medieindeksering, undertekster og supportarbeidsflyter som trenger søkbar tekst.

Første forespørsel

Send en støttet lydfil med model og file. Hold den første filen kort mens du validerer håndtering av opplasting, autentisering og parsing av responsen.

Les responsen

Standardresponsen inkluderer den transkriberte text. Hvis du ber om et annet responsformat, må du sørge for at klienten din parser dette formatet i stedet for å anta standard JSON-struktur.

Neste steg

Autorisasjoner

Authorization
string
header
påkrevd

Bearer token authentication. Use your CometAPI key.

Kropp

multipart/form-data
file
file
påkrevd

The audio file to transcribe. Supported formats: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.

model
string
standard:whisper-1
påkrevd

The speech-to-text model to use. Choose a current speech model from the Models page.

language
string

The language of the input audio in ISO-639-1 format (e.g., en, zh, ja). Supplying the language improves accuracy and latency.

prompt
string

Optional text to guide the model's style or continue a previous audio segment. The prompt should match the audio language.

response_format
enum<string>
standard:json

The output format for the transcription.

Tilgjengelige alternativer:
json,
text,
srt,
verbose_json,
vtt
temperature
number
standard:0

Sampling temperature between 0 and 1. Higher values produce more random output; lower values are more focused. When set to 0, the model auto-adjusts temperature using log probability.

Nødvendig område: 0 <= x <= 1

Svar

200 - application/json

The transcription result.

text
string
påkrevd

The transcribed text.

Sist endret 23. juni 2026