Згенеруйте мовлення Runway із тексту
Перетворюйте текст на мовлення за допомогою попередньо налаштованого голосу або еталонного аудіо через Runway API.
POST /runwayml/v1/text_to_speech, щоб створити завдання мовлення з тексту.
Надсилайте свій ключ CometAPI API за допомогою автентифікації Bearer і тіла JSON-запиту.
Виберіть модель і голос
Кожен запит потребуєmodel і promptText. Поле voice є обов’язковим
для eleven_multilingual_v2 і eleven_v3 та необов’язковим для seed_audio.
presetId зі схеми запиту. Для seed_audio,
замініть приклад audioUri доступною HTTPS URL-адресою вашого еталонного голосу.
Налаштування виразності мовлення
За допомогоюeleven_v3 значення promptText може містити виразні теги, як-от [whispers]
або [laughs]. Модель також приймає такі елементи керування:
stability, similarityBoost і style значення 0 використовує значення моделі
за замовчуванням, як і пропуск поля. useSpeakerBoost: false також використовує значення моделі
за замовчуванням. Щоб установити seed для семплування, використовуйте додатне ціле число; seed: 0 вибирає seed
автоматично.
Налаштування швидкості та формату мовлення
За допомогоюseed_audio використовуйте speechRate і loudnessRate від -50 до 100 або
pitchRate від -12 до 12 півтонів. Ці елементи керування приймають цілі числа; пропуск
або 0 зберігає звичайне значення.
Установіть для sampleRate значення 8000, 16000, 24000, 32000, 44100 або 48000 Гц.
Установіть для outputFormat значення wav, mp3 або ogg_opus. Не додавайте duration,
referenceAudios, а також елементи керування Eleven v3 з seed_audio на цьому endpoint.
Отримання результату
Збережіть повернене значенняid, а потім використайте Отримати завдання Runway
щоб отримати статус завдання. Коли status має значення SUCCEEDED, перегляньте URL-адреси аудіо в
output. Якщо завдання не виконується, перевірте failure і failureCode.Авторизації
Use your CometAPI API key.
Тіло
- eleven_multilingual_v2
- eleven_v3
- seed_audio
Request settings for eleven_multilingual_v2.
Model ID for this request.
eleven_multilingual_v2 "eleven_multilingual_v2"Text to speak, from 1 to 1000 UTF-16 code units.
1 - 1000The voice to use for the generated speech.
Відповідь
Task created. Save the returned id to retrieve task status.
Task ID for GET /runwayml/v1/tasks/{id}.
Task state, when returned.
Task submission timestamp, when returned.
Result URLs, when returned.
Failure explanation, when returned.
Machine-readable failure code, when returned.
Task estimate metadata, when returned.
Task cost metadata, when returned.