Skip to main content
POST
Python
Use este endpoint para transformar texto em um arquivo de áudio por meio da API de áudio compatível com OpenAI. Ele é adequado para narração, prompts de voz curtos, recursos de leitura em voz alta e outros fluxos de trabalho em que seu aplicativo já tem texto e precisa de saída de fala.

Primeira solicitação

Comece com três campos: model, input e voice. Mantenha a primeira solicitação curta para que você possa verificar a autenticação, o formato de áudio e o tratamento de arquivos antes de ajustar a velocidade ou o formato de saída.

Leia a resposta

A resposta é áudio binário, não JSON. Nos exemplos de SDK, grave a resposta em um arquivo como output.mp3. Em clientes HTTP diretos, salve o corpo da resposta e defina a extensão do arquivo para corresponder ao response_format solicitado.

Próximos passos

Autorizações

Authorization
string
header
obrigatório

Bearer token authentication. Use your CometAPI key.

Corpo

application/json
model
string
padrão:tts-1
obrigatório

The TTS model to use. Choose a current speech model from the Models page.

input
string
obrigatório

The text to generate audio for. Maximum length is 4096 characters.

Maximum string length: 4096
voice
enum<string>
padrão:alloy
obrigatório

The voice to use for speech synthesis.

Opções disponíveis:
alloy,
ash,
ballad,
coral,
echo,
fable,
onyx,
nova,
sage,
shimmer
response_format
enum<string>
padrão:mp3

The audio output format.

Opções disponíveis:
mp3,
opus,
aac,
flac,
wav,
pcm
speed
number
padrão:1

The speed of the generated audio. Select a value between 0.25 and 4.0.

Intervalo necessário: 0.25 <= x <= 4

Resposta

200 - audio/mpeg

The audio file content.

The response is of type file.