Skip to main content
POST
Python
Utilisez ce endpoint pour traduire de l’audio parlé en texte anglais. Il convient aux files de support multilingues, à la révision de médias et aux workflows qui nécessitent une transcription unique en anglais à partir d’un audio dans une autre langue.

Première requête

Envoyez un fichier audio pris en charge avec model et file. Utilisez d’abord un court échantillon afin de pouvoir vérifier la gestion de l’upload, la détection de la langue et l’analyse de la sortie.

Lire la réponse

La réponse par défaut inclut le text anglais traduit. Si vous demandez un format de réponse différent, analysez la réponse en fonction de ce format.

Étapes suivantes

  • Utilisez Create Transcription lorsque vous avez besoin du texte dans la langue d’origine.
  • Utilisez Create Speech lorsque vous avez besoin de générer de l’audio à partir de texte.

Autorisations

Authorization
string
header
requis

Bearer token authentication. Use your CometAPI key.

Corps

multipart/form-data
file
file
requis

The audio file to translate. Supported formats: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.

model
string
défaut:whisper-1
requis

The audio translation model to use. Choose a current speech model from the Models page.

prompt
string

Optional text to guide the model's style or continue a previous audio segment. The prompt should be in English.

response_format
enum<string>
défaut:json

The output format for the translation.

Options disponibles:
json,
text,
srt,
verbose_json,
vtt
temperature
number
défaut:0

Sampling temperature between 0 and 1. Higher values produce more random output; lower values are more focused. When set to 0, the model auto-adjusts temperature using log probability.

Plage requise: 0 <= x <= 1

Réponse

200 - application/json

The translation result in English.

text
string
requis

The translated text in English.