Skip to main content
POST
Usa POST /runwayml/v1/text_to_speech para crear una tarea de voz a partir de texto. Envía tu clave de API de CometAPI con autenticación Bearer y un cuerpo de solicitud JSON.

Elige un modelo y una voz

Cada solicitud requiere model y promptText. El campo voice es obligatorio para eleven_multilingual_v2 y eleven_v3, y opcional para seed_audio. Para las voces predefinidas, selecciona un presetId del esquema de solicitud. Para seed_audio, sustituye el audioUri de ejemplo por una URL HTTPS accesible de tu referencia de voz.

Ajusta la expresión de voz

Con eleven_v3, promptText puede incluir etiquetas expresivas como [whispers] o [laughs]. El modelo también acepta estos controles: Para stability, similarityBoost y style, un valor de 0 usa el valor predeterminado del modelo al igual que omitir el campo. useSpeakerBoost: false también usa el valor predeterminado del modelo predeterminado. Para establecer una semilla de muestreo, usa un entero positivo; seed: 0 elige una semilla automáticamente.

Ajusta la velocidad y el formato de voz

Con seed_audio, usa speechRate y loudnessRate de -50 a 100, o pitchRate de -12 a 12 semitonos. Estos controles aceptan enteros; omitirlos o usar 0 mantiene el valor normal. Establece sampleRate en 8000, 16000, 24000, 32000, 44100 o 48000 Hz. Establece outputFormat en wav, mp3 o ogg_opus. No incluyas duration, referenceAudios, ni controles de Eleven v3 con seed_audio en este endpoint.

Recupera el resultado

Guarda el id devuelto y luego usa Obtener una tarea de Runway para recuperar el estado de la tarea. Cuando status sea SUCCEEDED, consulta las URL de audio en output. Si la tarea falla, revisa failure y failureCode.

Autorizaciones

Authorization
string
header
requerido

Use your CometAPI API key.

Cuerpo

application/json

Request settings for eleven_multilingual_v2.

model
enum<string>
requerido

Model ID for this request.

Opciones disponibles:
eleven_multilingual_v2
Allowed value: "eleven_multilingual_v2"
promptText
string
requerido

Text to speak, from 1 to 1000 UTF-16 code units.

Required string length: 1 - 1000
voice
RunwayPresetVoice · object
requerido

The voice to use for the generated speech.

Respuesta

Task created. Save the returned id to retrieve task status.

id
string
requerido

Task ID for GET /runwayml/v1/tasks/{id}.

status
string

Task state, when returned.

createdAt
string<date-time>

Task submission timestamp, when returned.

output
string<uri>[]

Result URLs, when returned.

failure
string

Failure explanation, when returned.

failureCode
string

Machine-readable failure code, when returned.

estimatedCost
object

Task estimate metadata, when returned.

cost
object

Task cost metadata, when returned.

Última modificación el 18 de septiembre de 2026