Skip to main content
POST
Python
Kaynak dildeki sesi metne dönüştürmek için bu uç noktayı kullanın. Aranabilir metin gerektiren toplantı notları, sesli mesajlar, medya indeksleme, altyazılar ve destek iş akışları için uygundur.

İlk istek

model ve file ile desteklenen bir ses dosyası gönderin. Yükleme işleme, kimlik doğrulama ve yanıt ayrıştırmayı doğrularken ilk dosyayı kısa tutun.

Yanıtı okuyun

Varsayılan yanıt, dönüştürülen text alanını içerir. Başka bir yanıt formatı isterseniz, istemcinizin varsayılan JSON yapısını varsaymak yerine bu formatı ayrıştırdığından emin olun.

Sonraki adımlar

Yetkilendirmeler

Authorization
string
header
gerekli

Bearer token authentication. Use your CometAPI key.

Gövde

multipart/form-data
file
file
gerekli

The audio file to transcribe. Supported formats: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.

model
string
varsayılan:whisper-1
gerekli

The speech-to-text model to use. Choose a current speech model from the Models page.

language
string

The language of the input audio in ISO-639-1 format (e.g., en, zh, ja). Supplying the language improves accuracy and latency.

prompt
string

Optional text to guide the model's style or continue a previous audio segment. The prompt should match the audio language.

response_format
enum<string>
varsayılan:json

The output format for the transcription.

Mevcut seçenekler:
json,
text,
srt,
verbose_json,
vtt
temperature
number
varsayılan:0

Sampling temperature between 0 and 1. Higher values produce more random output; lower values are more focused. When set to 0, the model auto-adjusts temperature using log probability.

Gerekli aralık: 0 <= x <= 1

Yanıt

200 - application/json

The transcription result.

text
string
gerekli

The transcribed text.