Skip to main content
POST
Utilisez POST /runwayml/v1/text_to_speech pour créer une tâche de parole à partir de texte. Envoyez votre clé API CometAPI avec l’authentification Bearer et un corps de requête JSON.

Choisir un modèle et une voix

Chaque requête nécessite model, promptText et voice. Pour les voix prédéfinies, sélectionnez un presetId dans le schéma de requête. Pour seed_audio, remplacez l’exemple audioUri par une URL HTTPS accessible de votre référence vocale. N’omettez pas voice et n’envoyez pas null pour ce champ.

Ajuster l’expression vocale

Avec eleven_v3, promptText peut inclure des balises expressives telles que [whispers] ou [laughs]. Le modèle accepte également ces contrôles : Pour stability, similarityBoost et style, une valeur de 0 utilise le réglage du modèle par défaut, tout comme l’omission du champ. useSpeakerBoost: false utilise également le réglage du modèle par défaut. Pour définir une graine d’échantillonnage, utilisez un entier positif ; seed: 0 choisit une graine automatiquement.

Ajuster la vitesse et le format de la parole

Avec seed_audio, utilisez speechRate et loudnessRate de -50 à 100, ou pitchRate de -12 à 12 demi-tons. Ces contrôles acceptent des entiers ; leur omission ou 0 conserve la valeur normale. Définissez sampleRate sur 8000, 16000, 24000, 32000, 44100 ou 48000 Hz. Définissez outputFormat sur wav, mp3 ou ogg_opus. N’incluez pas duration, referenceAudios, ni les contrôles Eleven v3 avec seed_audio sur cet endpoint.

Récupérer le résultat

Enregistrez le id renvoyé, puis utilisez Obtenir une tâche Runway pour récupérer l’état de la tâche. Lorsque status est SUCCEEDED, lisez les URL audio dans output. Si la tâche échoue, examinez failure et failureCode.

Autorisations

Authorization
string
header
requis

Use your CometAPI API key.

Corps

application/json

Request settings for eleven_multilingual_v2.

model
enum<string>
requis

Model ID for this request.

Options disponibles:
eleven_multilingual_v2
Allowed value: "eleven_multilingual_v2"
promptText
string
requis

Text to speak, from 1 to 1000 UTF-16 code units.

Required string length: 1 - 1000
voice
RunwayPresetVoice · object
requis

The voice to use for the generated speech.

Réponse

Task created. Save the returned id to retrieve task status.

id
string
requis

Task ID for GET /runwayml/v1/tasks/{id}.

status
string

Task state, when returned.

createdAt
string<date-time>

Task submission timestamp, when returned.

output
string<uri>[]

Result URLs, when returned.

failure
string

Failure explanation, when returned.

failureCode
string

Machine-readable failure code, when returned.

estimatedCost
object

Task estimate metadata, when returned.

cost
object

Task cost metadata, when returned.

Dernière modification le 21 septembre 2026