Modèles audio
Create speech
Utilisez CometAPI POST /v1/audio/speech pour convertir du texte en audio avec un modèle de synthèse vocale et un format de sortie sélectionnés.
POST
Python
Utilisez ce endpoint pour transformer du texte en fichier audio via l’API audio compatible OpenAI. Il convient à la narration, aux courtes invites vocales, aux fonctionnalités de lecture à voix haute et à d’autres workflows où votre application dispose déjà de texte et a besoin d’une sortie vocale.
Première requête
Commencez avec trois champs :model, input et voice. Gardez la première requête courte afin de pouvoir vérifier l’authentification, le format audio et la gestion des fichiers avant d’ajuster la vitesse ou le format de sortie.
Lire la réponse
La réponse est un flux audio binaire, et non du JSON. Dans les exemples SDK, écrivez la réponse dans un fichier tel queoutput.mp3. Dans les clients HTTP directs, enregistrez le corps de la réponse et définissez l’extension du fichier pour qu’elle corresponde au response_format demandé.
Étapes suivantes
- Utilisez Create Transcription lorsque vous devez reconvertir la parole en texte.
- Utilisez Create Translation lorsque vous avez besoin de texte anglais à partir d’un audio non anglais.
Autorisations
Bearer token authentication. Use your CometAPI key.
Corps
application/json
The TTS model to use. Choose a current speech model from the Models page.
The text to generate audio for. Maximum length is 4096 characters.
Maximum string length:
4096The voice to use for speech synthesis.
Options disponibles:
alloy, ash, ballad, coral, echo, fable, onyx, nova, sage, shimmer The audio output format.
Options disponibles:
mp3, opus, aac, flac, wav, pcm The speed of the generated audio. Select a value between 0.25 and 4.0.
Plage requise:
0.25 <= x <= 4Réponse
200 - audio/mpeg
The audio file content.
The response is of type file.