Skip to main content
POST
Python
Bruk dette endepunktet til å gjøre tekst om til en lydfil gjennom det OpenAI-kompatible lyd-API-et. Det passer for opplesning, korte stemmeprompter, høytlesningsfunksjoner og andre arbeidsflyter der appen din allerede har tekst og trenger taleutdata.

Første forespørsel

Start med tre felt: model, input og voice. Hold den første forespørselen kort, slik at du kan verifisere autentisering, lydformat og filhåndtering før du justerer hastighet eller utdataformat.

Les svaret

Svaret er binær lyd, ikke JSON. I SDK-eksempler skriver du svaret til en fil som output.mp3. I direkte HTTP-klienter lagrer du svarteksten og setter filendelsen til å samsvare med den forespurte response_format.

Neste steg

Autorisasjoner

Authorization
string
header
påkrevd

Bearer token authentication. Use your CometAPI key.

Kropp

application/json
model
string
standard:tts-1
påkrevd

The TTS model to use. Choose a current speech model from the Models page.

input
string
påkrevd

The text to generate audio for. Maximum length is 4096 characters.

Maximum string length: 4096
voice
enum<string>
standard:alloy
påkrevd

The voice to use for speech synthesis.

Tilgjengelige alternativer:
alloy,
ash,
ballad,
coral,
echo,
fable,
onyx,
nova,
sage,
shimmer
response_format
enum<string>
standard:mp3

The audio output format.

Tilgjengelige alternativer:
mp3,
opus,
aac,
flac,
wav,
pcm
speed
number
standard:1

The speed of the generated audio. Select a value between 0.25 and 4.0.

Nødvendig område: 0.25 <= x <= 4

Svar

200 - audio/mpeg

The audio file content.

The response is of type file.

Sist endret 23. juni 2026