Lydmodeller
Create Speech
Bruk CometAPI POST /v1/audio/speech til å konvertere tekst til lyd med en valgt text-to-speech-modell og utdataformat.
POST
Python
Bruk dette endepunktet til å gjøre tekst om til en lydfil gjennom det OpenAI-kompatible lyd-API-et. Det passer for opplesning, korte stemmeprompter, høytlesningsfunksjoner og andre arbeidsflyter der appen din allerede har tekst og trenger taleutdata.
Første forespørsel
Start med tre felt:model, input og voice. Hold den første forespørselen kort, slik at du kan verifisere autentisering, lydformat og filhåndtering før du justerer hastighet eller utdataformat.
Les svaret
Svaret er binær lyd, ikke JSON. I SDK-eksempler skriver du svaret til en fil somoutput.mp3. I direkte HTTP-klienter lagrer du svarteksten og setter filendelsen til å samsvare med den forespurte response_format.
Neste steg
- Bruk Create Transcription når du trenger å gjøre tale om til tekst igjen.
- Bruk Create Translation når du trenger engelsk tekst fra lyd som ikke er på engelsk.
Autorisasjoner
Bearer token authentication. Use your CometAPI key.
Kropp
application/json
The TTS model to use. Choose a current speech model from the Models page.
The text to generate audio for. Maximum length is 4096 characters.
Maximum string length:
4096The voice to use for speech synthesis.
Tilgjengelige alternativer:
alloy, ash, ballad, coral, echo, fable, onyx, nova, sage, shimmer The audio output format.
Tilgjengelige alternativer:
mp3, opus, aac, flac, wav, pcm The speed of the generated audio. Select a value between 0.25 and 4.0.
Nødvendig område:
0.25 <= x <= 4Svar
200 - audio/mpeg
The audio file content.
The response is of type file.
Sist endret 23. juni 2026