Modelos de Áudio
Create Speech
Use o CometAPI POST /v1/audio/speech para converter texto em áudio com um modelo de text-to-speech e formato de saída selecionados.
POST
Python
Use este endpoint para transformar texto em um arquivo de áudio por meio da API de áudio compatível com OpenAI. Ele é adequado para narração, prompts de voz curtos, recursos de leitura em voz alta e outros fluxos de trabalho em que seu aplicativo já tem texto e precisa de saída de fala.
Primeira solicitação
Comece com três campos:model, input e voice. Mantenha a primeira solicitação curta para que você possa verificar a autenticação, o formato de áudio e o tratamento de arquivos antes de ajustar a velocidade ou o formato de saída.
Leia a resposta
A resposta é áudio binário, não JSON. Nos exemplos de SDK, grave a resposta em um arquivo comooutput.mp3. Em clientes HTTP diretos, salve o corpo da resposta e defina a extensão do arquivo para corresponder ao response_format solicitado.
Próximos passos
- Use Create Transcription quando precisar transformar fala em texto novamente.
- Use Create Translation quando precisar de texto em inglês a partir de áudio que não esteja em inglês.
Autorizações
Bearer token authentication. Use your CometAPI key.
Corpo
application/json
The TTS model to use. Choose a current speech model from the Models page.
The text to generate audio for. Maximum length is 4096 characters.
Maximum string length:
4096The voice to use for speech synthesis.
Opções disponíveis:
alloy, ash, ballad, coral, echo, fable, onyx, nova, sage, shimmer The audio output format.
Opções disponíveis:
mp3, opus, aac, flac, wav, pcm The speed of the generated audio. Select a value between 0.25 and 4.0.
Intervalo necessário:
0.25 <= x <= 4Resposta
200 - audio/mpeg
The audio file content.
The response is of type file.