Skip to main content
POST
Python
Usa este endpoint para traducir audio hablado a texto en inglés. Es adecuado para colas de soporte multilingüe, revisión de medios y flujos de trabajo que necesitan una única transcripción en inglés a partir de audio en otro idioma.

Primera solicitud

Envía un archivo de audio compatible con model y file. Usa primero una muestra corta para que puedas verificar el manejo de la carga, la detección de idioma y el análisis de la salida.

Lee la respuesta

La respuesta predeterminada incluye text traducido al inglés. Si solicitas un formato de respuesta diferente, analiza la respuesta según ese formato.

Siguientes pasos

Autorizaciones

Authorization
string
header
requerido

Bearer token authentication. Use your CometAPI key.

Cuerpo

multipart/form-data
file
file
requerido

The audio file to translate. Supported formats: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.

model
string
predeterminado:whisper-1
requerido

The audio translation model to use. Choose a current speech model from the Models page.

prompt
string

Optional text to guide the model's style or continue a previous audio segment. The prompt should be in English.

response_format
enum<string>
predeterminado:json

The output format for the translation.

Opciones disponibles:
json,
text,
srt,
verbose_json,
vtt
temperature
number
predeterminado:0

Sampling temperature between 0 and 1. Higher values produce more random output; lower values are more focused. When set to 0, the model auto-adjusts temperature using log probability.

Rango requerido: 0 <= x <= 1

Respuesta

200 - application/json

The translation result in English.

text
string
requerido

The translated text in English.