音声
テキストから Runway 音声を生成する
Runway API を使用して、プリセット音声または参照音声でテキストを音声に変換します。
POST
POST /runwayml/v1/text_to_speech を使用して、テキストから音声タスクを作成します。
Bearer 認証と JSON リクエスト本文で CometAPI API キーを送信します。
モデルと音声を選択する
すべてのリクエストにはmodel と promptText が必要です。voice フィールドは
eleven_multilingual_v2 および eleven_v3 では必須で、seed_audio では任意です。
プリセット音声では、リクエストスキーマから
presetId を選択します。seed_audio では、
例の audioUri を、音声参照にアクセス可能な HTTPS URL に置き換えます。
音声表現を調整する
eleven_v3 では、promptText に [whispers]
や [laughs] などの表現タグを含めることができます。モデルでは、次のコントロールも使用できます。
stability、similarityBoost、および style では、0 の値を指定するとモデルの
デフォルトが使用され、フィールドを省略した場合も同様です。useSpeakerBoost: false でもモデルの
デフォルトが使用されます。サンプリングシードを設定するには正の整数を使用します。seed: 0 ではシードが
自動的に選択されます。
音声速度と形式を調整する
seed_audio では、speechRate と loudnessRate に -50~100 の値を使用するか、
pitchRate -12~12 半音の値を使用します。これらのコントロールには整数を指定でき、省略するか
0 を指定すると通常の値が維持されます。
sampleRate を 8000、16000、24000、32000、44100、または 48000 Hz に設定します。
outputFormat を wav、mp3、または ogg_opus に設定します。このエンドポイントでは、duration、
referenceAudiosまたは seed_audio を使用する Eleven v3 コントロールを含めないでください。
結果を取得する
返されたid を保存してから、 Runway タスクを取得する
を使用してタスクのステータスを取得します。status が SUCCEEDED の場合、音声 URL を次から読み取ります:
output。タスクが失敗した場合は、failure と failureCode を確認します。承認
Use your CometAPI API key.
ボディ
application/json
- eleven_multilingual_v2
- eleven_v3
- seed_audio
Request settings for eleven_multilingual_v2.
レスポンス
Task created. Save the returned id to retrieve task status.
Task ID for GET /runwayml/v1/tasks/{id}.
Task state, when returned.
Task submission timestamp, when returned.
Result URLs, when returned.
Failure explanation, when returned.
Machine-readable failure code, when returned.
Task estimate metadata, when returned.
Task cost metadata, when returned.
最終更新日 2026年9月18日