Skip to main content
POST
Python
Verwenden Sie diesen Endpunkt, um gesprochene Audiodaten in englischen Text zu übersetzen. Er eignet sich für mehrsprachige Support-Warteschlangen, Medienprüfungen und Workflows, die ein englisches Transkript aus Audio in einer anderen Sprache benötigen.

Erste Anfrage

Senden Sie eine unterstützte Audiodatei mit model und file. Verwenden Sie zuerst ein kurzes Beispiel, damit Sie Upload-Verarbeitung, Spracherkennung und Ausgabe-Parsing überprüfen können.

Antwort lesen

Die Standardantwort enthält den übersetzten englischen text. Wenn Sie ein anderes Antwortformat anfordern, parsen Sie die Antwort entsprechend diesem Format.

Nächste Schritte

Autorisierungen

Authorization
string
header
erforderlich

Bearer token authentication. Use your CometAPI key.

Body

multipart/form-data
file
file
erforderlich

The audio file to translate. Supported formats: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.

model
string
Standard:whisper-1
erforderlich

The audio translation model to use. Choose a current speech model from the Models page.

prompt
string

Optional text to guide the model's style or continue a previous audio segment. The prompt should be in English.

response_format
enum<string>
Standard:json

The output format for the translation.

Verfügbare Optionen:
json,
text,
srt,
verbose_json,
vtt
temperature
number
Standard:0

Sampling temperature between 0 and 1. Higher values produce more random output; lower values are more focused. When set to 0, the model auto-adjusts temperature using log probability.

Erforderlicher Bereich: 0 <= x <= 1

Antwort

200 - application/json

The translation result in English.

text
string
erforderlich

The translated text in English.