Audio
Genera voz de Runway a partir de texto
Convierte texto en voz con una voz predefinida o audio de referencia mediante la API de Runway.
POST
Usa
POST /runwayml/v1/text_to_speech para crear una tarea de voz a partir de texto.
Envía tu clave de API de CometAPI con autenticación Bearer y un cuerpo de solicitud JSON.
Elige un modelo y una voz
Cada solicitud requieremodel y promptText. El campo voice es obligatorio
para eleven_multilingual_v2 y eleven_v3, y opcional para seed_audio.
Para las voces predefinidas, selecciona un
presetId del esquema de solicitud. Para seed_audio,
sustituye el audioUri de ejemplo por una URL HTTPS accesible de tu referencia de voz.
Ajusta la expresión de voz
Coneleven_v3, promptText puede incluir etiquetas expresivas como [whispers]
o [laughs]. El modelo también acepta estos controles:
Para
stability, similarityBoost y style, un valor de 0 usa el valor predeterminado del modelo
al igual que omitir el campo. useSpeakerBoost: false también usa el valor predeterminado del modelo
predeterminado. Para establecer una semilla de muestreo, usa un entero positivo; seed: 0 elige una semilla
automáticamente.
Ajusta la velocidad y el formato de voz
Conseed_audio, usa speechRate y loudnessRate de -50 a 100, o
pitchRate de -12 a 12 semitonos. Estos controles aceptan enteros; omitirlos
o usar 0 mantiene el valor normal.
Establece sampleRate en 8000, 16000, 24000, 32000, 44100 o 48000 Hz.
Establece outputFormat en wav, mp3 o ogg_opus. No incluyas duration,
referenceAudios, ni controles de Eleven v3 con seed_audio en este endpoint.
Recupera el resultado
Guarda elid devuelto y luego usa Obtener una tarea de Runway
para recuperar el estado de la tarea. Cuando status sea SUCCEEDED, consulta las URL de audio en
output. Si la tarea falla, revisa failure y failureCode.Autorizaciones
Use your CometAPI API key.
Cuerpo
application/json
- eleven_multilingual_v2
- eleven_v3
- seed_audio
Request settings for eleven_multilingual_v2.
Model ID for this request.
Opciones disponibles:
eleven_multilingual_v2 Allowed value:
"eleven_multilingual_v2"Text to speak, from 1 to 1000 UTF-16 code units.
Required string length:
1 - 1000The voice to use for the generated speech.
Respuesta
Task created. Save the returned id to retrieve task status.
Task ID for GET /runwayml/v1/tasks/{id}.
Task state, when returned.
Task submission timestamp, when returned.
Result URLs, when returned.
Failure explanation, when returned.
Machine-readable failure code, when returned.
Task estimate metadata, when returned.
Task cost metadata, when returned.
Última modificación el 18 de septiembre de 2026