Skip to main content
POST
Python
Utilisez ce endpoint pour transformer du texte en fichier audio via l’API audio compatible OpenAI. Il convient à la narration, aux courtes invites vocales, aux fonctionnalités de lecture à voix haute et à d’autres workflows où votre application dispose déjà de texte et a besoin d’une sortie vocale.

Première requête

Commencez avec trois champs : model, input et voice. Gardez la première requête courte afin de pouvoir vérifier l’authentification, le format audio et la gestion des fichiers avant d’ajuster la vitesse ou le format de sortie.

Lire la réponse

La réponse est un flux audio binaire, et non du JSON. Dans les exemples SDK, écrivez la réponse dans un fichier tel que output.mp3. Dans les clients HTTP directs, enregistrez le corps de la réponse et définissez l’extension du fichier pour qu’elle corresponde au response_format demandé.

Étapes suivantes

Autorisations

Authorization
string
header
requis

Bearer token authentication. Use your CometAPI key.

Corps

application/json
model
string
défaut:tts-1
requis

The TTS model to use. Choose a current speech model from the Models page.

input
string
requis

The text to generate audio for. Maximum length is 4096 characters.

Maximum string length: 4096
voice
enum<string>
défaut:alloy
requis

The voice to use for speech synthesis.

Options disponibles:
alloy,
ash,
ballad,
coral,
echo,
fable,
onyx,
nova,
sage,
shimmer
response_format
enum<string>
défaut:mp3

The audio output format.

Options disponibles:
mp3,
opus,
aac,
flac,
wav,
pcm
speed
number
défaut:1

The speed of the generated audio. Select a value between 0.25 and 4.0.

Plage requise: 0.25 <= x <= 4

Réponse

200 - audio/mpeg

The audio file content.

The response is of type file.