Skip to main content
POST
cURL
このエンドポイントは、ソース動画内の顔をすでに特定した後に、高度なリップシンクタスクを作成するために使用します。

呼び出す前に

  • session_id と利用可能な face_id の値を取得するため、まず Lip-Sync から開始します
  • 各顔を音声セグメントに対応付ける face_choose エントリを 1 つ以上構築します
  • 以前のタスクで生成された音声には audio_id を、ホストされた音声ファイルには sound_file を使用します
  • タイミング関連のフィールドはミリ秒単位で送信します。たとえば、sound_start_time: "0"sound_end_time: "2000" は最初の 2 秒を選択します。
  • 切り出した音声セグメントは少なくとも 2000 ms 以上で、かつ元の音声の長さを超えないようにしてください
  • Webhook 配信または独自の追跡 id が必要な場合にのみ、callback_url または external_task_id を設定します

タスクフロー

1

最初に顔を特定する

ソース動画に対して Lip-Sync を実行し、返された session_id と対象の face_id の値を保持します。
2

高度なリップシンクタスクを作成する

このエンドポイントを通じて session_idface_choose 配列を送信します。
3

生成されたタスクを追跡する

ステータス確認と最終結果の取得のために、返された task id を保存します。
完全なパラメータリファレンスについては、official Kling documentation を参照してください。

承認

Authorization
string
header
必須

Bearer token authentication. Use your CometAPI key.

ボディ

application/json
session_id
string
必須

Session id returned by identify-face.

face_choose
object[]
必須

One or more face/audio mappings to synthesize.

Minimum array length: 1
callback_url
string

Webhook URL to receive task status updates.

external_task_id
string

Custom task id for your own tracking. Must be unique per account.

レスポンス

200 - application/json

Task accepted.

code
integer
必須
message
string
必須
data
object
必須