Skip to main content
POST
cURL
使用此端点可在你已识别源视频中的人脸后,创建一个高级口型同步任务。

调用前准备

  • 先从 Lip-Sync 开始,获取 session_id 和可用的 face_id
  • 构建一个或多个 face_choose 条目,将每张人脸映射到一个音频片段
  • 对于先前任务生成的音频,使用 audio_id;对于托管的音频文件,使用 sound_file
  • 时间字段请使用毫秒。例如,sound_start_time: "0"sound_end_time: "2000" 表示选择前 2 秒
  • 确保裁剪后的音频片段至少为 2000 ms,且不超过源音频时长
  • 仅在你需要 webhook 投递或使用自己的跟踪 id 时设置 callback_urlexternal_task_id

任务流程

1

先识别人脸

在源视频上运行 Lip-Sync,并保留返回的 session_id 以及目标 face_id 值。
2

创建高级口型同步任务

通过此端点提交 session_idface_choose 数组。
3

跟踪生成的任务

保存返回的任务 id,以便检查状态和获取最终结果。
完整参数说明请参阅 Kling 官方文档

授权

Authorization
string
header
必填

Bearer token authentication. Use your CometAPI key.

请求体

application/json
session_id
string
必填

Session id returned by identify-face.

face_choose
object[]
必填

One or more face/audio mappings to synthesize.

Minimum array length: 1
callback_url
string

Webhook URL to receive task status updates.

external_task_id
string

Custom task id for your own tracking. Must be unique per account.

响应

200 - application/json

Task accepted.

code
integer
必填
message
string
必填
data
object
必填