Skip to main content
POST
Python
Используйте этот endpoint, чтобы переводить устную речь из аудио в английский текст. Он подходит для многоязычных очередей поддержки, проверки медиаконтента и процессов, где нужна единая английская расшифровка аудио на другом языке.

Первый запрос

Отправьте поддерживаемый аудиофайл с model и file. Сначала используйте короткий образец, чтобы проверить обработку загрузки, определение языка и разбор результата.

Чтение ответа

Ответ по умолчанию включает переведённый английский text. Если вы запрашиваете другой формат ответа, разбирайте ответ в соответствии с этим форматом.

Следующие шаги

  • Используйте Create Transcription, когда вам нужен текст на исходном языке.
  • Используйте Create Speech, когда вам нужно сгенерировать аудио из текста.

Авторизации

Authorization
string
header
обязательно

Bearer token authentication. Use your CometAPI key.

Тело

multipart/form-data
file
file
обязательно

The audio file to translate. Supported formats: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.

model
string
по умолчанию:whisper-1
обязательно

The audio translation model to use. Choose a current speech model from the Models page.

prompt
string

Optional text to guide the model's style or continue a previous audio segment. The prompt should be in English.

response_format
enum<string>
по умолчанию:json

The output format for the translation.

Доступные опции:
json,
text,
srt,
verbose_json,
vtt
temperature
number
по умолчанию:0

Sampling temperature between 0 and 1. Higher values produce more random output; lower values are more focused. When set to 0, the model auto-adjusts temperature using log probability.

Требуемый диапазон: 0 <= x <= 1

Ответ

200 - application/json

The translation result in English.

text
string
обязательно

The translated text in English.