Skip to main content
POST
Usa POST /runwayml/v1/text_to_speech per creare un’attività di parlato dal testo. Invia la chiave API CometAPI con autenticazione Bearer e un corpo della richiesta JSON.

Scegli un modello e una voce

Ogni richiesta richiede model e promptText. Il campo voice è obbligatorio per eleven_multilingual_v2 e eleven_v3, e facoltativo per seed_audio. Per le voci predefinite, seleziona un presetId dallo schema della richiesta. Per seed_audio, sostituisci l’esempio audioUri con un URL HTTPS accessibile del tuo riferimento vocale.

Regola l’espressione del parlato

Con eleven_v3, promptText può includere tag espressivi come [whispers] o [laughs]. Il modello accetta anche questi controlli: Per stability, similarityBoost e style, il valore 0 usa l’impostazione del modello predefinita, così come l’omissione del campo. Anche useSpeakerBoost: false usa l’impostazione del modello predefinita. Per impostare un seed di campionamento, usa un intero positivo; seed: 0 sceglie un seed automaticamente.

Regola velocità e formato del parlato

Con seed_audio, usa speechRate e loudnessRate da -50 a 100, oppure pitchRate da -12 a 12 semitoni. Questi controlli accettano numeri interi; l’omissione o 0 mantiene il valore normale. Imposta sampleRate su 8000, 16000, 24000, 32000, 44100 o 48000 Hz. Imposta outputFormat su wav, mp3 o ogg_opus. Non includere duration, referenceAudios, né i controlli Eleven v3 con seed_audio su questo endpoint.

Recupera il risultato

Salva il valore restituito id, quindi usa Ottieni un’attività Runway per recuperare lo stato dell’attività. Quando status è SUCCEEDED, leggi gli URL audio in output. Se l’attività non riesce, esamina failure e failureCode.

Autorizzazioni

Authorization
string
header
obbligatorio

Use your CometAPI API key.

Corpo

application/json

Request settings for eleven_multilingual_v2.

model
enum<string>
obbligatorio

Model ID for this request.

Opzioni disponibili:
eleven_multilingual_v2
Allowed value: "eleven_multilingual_v2"
promptText
string
obbligatorio

Text to speak, from 1 to 1000 UTF-16 code units.

Required string length: 1 - 1000
voice
RunwayPresetVoice · object
obbligatorio

The voice to use for the generated speech.

Risposta

Task created. Save the returned id to retrieve task status.

id
string
obbligatorio

Task ID for GET /runwayml/v1/tasks/{id}.

status
string

Task state, when returned.

createdAt
string<date-time>

Task submission timestamp, when returned.

output
string<uri>[]

Result URLs, when returned.

failure
string

Failure explanation, when returned.

failureCode
string

Machine-readable failure code, when returned.

estimatedCost
object

Task estimate metadata, when returned.

cost
object

Task cost metadata, when returned.

Ultima modifica il 18 settembre 2026