Kling アバタービデオを作成する
CometAPI の Kling Avatar API を使用して、画像からアバター駆動の動画を生成します。高速な image-to-video アバターには POST /kling/v1/videos/avatar/image2video を使用します。
呼び出す前に
- 1 つのアバター
imageを公開 URL または生の base64 文字列として提供します - Kling のピクセル要件を満たすアバター画像を使用してください。小さすぎるサムネイルは生成タスクで拒否されます
audio_idまたはsound_fileのいずれか一方のみを送信します- 最初のリクエストはシンプルにしてください。顔画像 1 枚、音声クリップ 1 つ、そして必要に応じて短いプロンプト(Prompt)を指定します
- 参照する音声が、関連付ける必要のある以前のタスクに属している場合は
task_idを含めます - より高品質なパスが明確に必要でない限り、
mode: stdから始めてください
音声ソースのルール
audio_idは、Kling TTS ルート経由ですでに音声を生成している場合に最も簡単な方法ですsound_fileは、独自の MP3、WAV、M4A、または AAC アセットをすでに持っている場合に使用できます- アバター音声の長さは 2 ~ 60 秒と文書化されています
タスクの流れ
アバタータスクを作成する
タスクをポーリングする
完了した結果を保存する
承認
Bearer token authentication. Use your CometAPI key.
ヘッダー
Optional content type header.
ボディ
- Option 1
- Option 2
Avatar image URL or base64 image string. Use an image that meets Kling pixel requirements; very small thumbnails are rejected.
Prompt describing the desired avatar performance.
Audio id from a prior Kling audio task.
Public audio URL when you provide your own audio.
Optional prior task id associated with the referenced audio asset.
Generation mode. Use std or pro; omitted requests use std.
std, pro