Skip to main content
POST
Python
Используйте этот endpoint, чтобы преобразовать текст в аудиофайл через OpenAI-совместимый audio API. Он подходит для озвучивания, коротких голосовых подсказок, функций чтения вслух и других сценариев, где в вашем приложении уже есть текст и требуется речевой вывод.

Первый запрос

Начните с трех полей: model, input и voice. Сделайте первый запрос коротким, чтобы можно было проверить аутентификацию, формат аудио и обработку файла, прежде чем настраивать скорость или формат вывода.

Как читать ответ

Ответ представляет собой бинарное аудио, а не JSON. В примерах SDK записывайте ответ в файл, например output.mp3. В прямых HTTP-клиентах сохраняйте тело ответа и задавайте расширение файла в соответствии с запрошенным response_format.

Дальнейшие шаги

  • Используйте Create Transcription, если вам нужно преобразовать речь обратно в текст.
  • Используйте Create Translation, если вам нужен английский текст из неанглоязычного аудио.

Авторизации

Authorization
string
header
обязательно

Bearer token authentication. Use your CometAPI key.

Тело

application/json
model
string
по умолчанию:tts-1
обязательно

The TTS model to use. Choose a current speech model from the Models page.

input
string
обязательно

The text to generate audio for. Maximum length is 4096 characters.

Maximum string length: 4096
voice
enum<string>
по умолчанию:alloy
обязательно

The voice to use for speech synthesis.

Доступные опции:
alloy,
ash,
ballad,
coral,
echo,
fable,
onyx,
nova,
sage,
shimmer
response_format
enum<string>
по умолчанию:mp3

The audio output format.

Доступные опции:
mp3,
opus,
aac,
flac,
wav,
pcm
speed
number
по умолчанию:1

The speed of the generated audio. Select a value between 0.25 and 4.0.

Требуемый диапазон: 0.25 <= x <= 4

Ответ

200 - audio/mpeg

The audio file content.

The response is of type file.