Genera parlato Runway dal testo
Converti il testo in parlato con una voce predefinita o un audio di riferimento usando l’API Runway.
POST /runwayml/v1/text_to_speech per creare un’attività di parlato dal testo.
Invia la chiave API CometAPI con autenticazione Bearer e un corpo della richiesta JSON.
Scegli un modello e una voce
Ogni richiesta richiedemodel e promptText. Il campo voice è obbligatorio
per eleven_multilingual_v2 e eleven_v3, e facoltativo per seed_audio.
presetId dallo schema della richiesta. Per seed_audio,
sostituisci l’esempio audioUri con un URL HTTPS accessibile del tuo riferimento vocale.
Regola l’espressione del parlato
Coneleven_v3, promptText può includere tag espressivi come [whispers]
o [laughs]. Il modello accetta anche questi controlli:
stability, similarityBoost e style, il valore 0 usa l’impostazione del modello
predefinita, così come l’omissione del campo. Anche useSpeakerBoost: false usa l’impostazione del modello
predefinita. Per impostare un seed di campionamento, usa un intero positivo; seed: 0 sceglie un seed
automaticamente.
Regola velocità e formato del parlato
Conseed_audio, usa speechRate e loudnessRate da -50 a 100, oppure
pitchRate da -12 a 12 semitoni. Questi controlli accettano numeri interi; l’omissione
o 0 mantiene il valore normale.
Imposta sampleRate su 8000, 16000, 24000, 32000, 44100 o 48000 Hz.
Imposta outputFormat su wav, mp3 o ogg_opus. Non includere duration,
referenceAudios, né i controlli Eleven v3 con seed_audio su questo endpoint.
Recupera il risultato
Salva il valore restituitoid, quindi usa Ottieni un’attività Runway
per recuperare lo stato dell’attività. Quando status è SUCCEEDED, leggi gli URL audio in
output. Se l’attività non riesce, esamina failure e failureCode.Autorizzazioni
Use your CometAPI API key.
Corpo
- eleven_multilingual_v2
- eleven_v3
- seed_audio
Request settings for eleven_multilingual_v2.
Model ID for this request.
eleven_multilingual_v2 "eleven_multilingual_v2"Text to speak, from 1 to 1000 UTF-16 code units.
1 - 1000The voice to use for the generated speech.
Risposta
Task created. Save the returned id to retrieve task status.
Task ID for GET /runwayml/v1/tasks/{id}.
Task state, when returned.
Task submission timestamp, when returned.
Result URLs, when returned.
Failure explanation, when returned.
Machine-readable failure code, when returned.
Task estimate metadata, when returned.
Task cost metadata, when returned.