Générer la parole Runway à partir de texte
Convertissez du texte en parole avec une voix prédéfinie ou un audio de référence à l’aide de l’API Runway.
POST /runwayml/v1/text_to_speech pour créer une tâche de parole à partir de texte.
Envoyez votre clé API CometAPI avec l’authentification Bearer et un corps de requête JSON.
Choisir un modèle et une voix
Chaque requête nécessitemodel, promptText et voice.
presetId dans le schéma de requête. Pour seed_audio,
remplacez l’exemple audioUri par une URL HTTPS accessible de votre référence vocale.
N’omettez pas voice et n’envoyez pas null pour ce champ.
Ajuster l’expression vocale
Aveceleven_v3, promptText peut inclure des balises expressives telles que [whispers]
ou [laughs]. Le modèle accepte également ces contrôles :
stability, similarityBoost et style, une valeur de 0 utilise le réglage du modèle
par défaut, tout comme l’omission du champ. useSpeakerBoost: false utilise également le réglage du modèle
par défaut. Pour définir une graine d’échantillonnage, utilisez un entier positif ; seed: 0 choisit une graine
automatiquement.
Ajuster la vitesse et le format de la parole
Avecseed_audio, utilisez speechRate et loudnessRate de -50 à 100, ou
pitchRate de -12 à 12 demi-tons. Ces contrôles acceptent des entiers ; leur omission
ou 0 conserve la valeur normale.
Définissez sampleRate sur 8000, 16000, 24000, 32000, 44100 ou 48000 Hz.
Définissez outputFormat sur wav, mp3 ou ogg_opus. N’incluez pas duration,
referenceAudios, ni les contrôles Eleven v3 avec seed_audio sur cet endpoint.
Récupérer le résultat
Enregistrez leid renvoyé, puis utilisez Obtenir une tâche Runway
pour récupérer l’état de la tâche. Lorsque status est SUCCEEDED, lisez les URL audio dans
output. Si la tâche échoue, examinez failure et failureCode.Autorisations
Use your CometAPI API key.
Corps
- eleven_multilingual_v2
- eleven_v3
- seed_audio
Request settings for eleven_multilingual_v2.
Model ID for this request.
eleven_multilingual_v2 "eleven_multilingual_v2"Text to speak, from 1 to 1000 UTF-16 code units.
1 - 1000The voice to use for the generated speech.
Réponse
Task created. Save the returned id to retrieve task status.
Task ID for GET /runwayml/v1/tasks/{id}.
Task state, when returned.
Task submission timestamp, when returned.
Result URLs, when returned.
Failure explanation, when returned.
Machine-readable failure code, when returned.
Task estimate metadata, when returned.
Task cost metadata, when returned.