Skip to main content
POST
cURL
Usa este endpoint para crear una tarea avanzada de lip-sync después de que ya hayas identificado rostros en el video de origen.

Antes de llamarlo

  • Comienza con Lip-Sync para obtener el session_id y los valores face_id disponibles
  • Crea una o más entradas face_choose que asignen cada rostro a un segmento de audio
  • Usa audio_id para audio producido por una tarea anterior, o sound_file para un archivo de audio alojado
  • Envía los campos de tiempo en milisegundos. Por ejemplo, sound_start_time: "0" y sound_end_time: "2000" seleccionan los primeros 2 segundos.
  • Asegúrate de que el segmento de audio recortado tenga al menos 2000 ms y no exceda la duración del audio de origen
  • Configura callback_url o external_task_id solo cuando necesites entrega por webhook o tu propio id de seguimiento

Flujo de la tarea

1

Identifica los rostros primero

Ejecuta Lip-Sync en el video de origen y conserva el session_id devuelto junto con los valores face_id objetivo.
2

Crea la tarea avanzada de lip-sync

Envía session_id y el arreglo face_choose a través de este endpoint.
3

Haz seguimiento de la tarea generada

Guarda el id de la tarea devuelta para consultar el estado y recuperar el resultado final.
Para la referencia completa de parámetros, consulta la documentación oficial de Kling.

Autorizaciones

Authorization
string
header
requerido

Bearer token authentication. Use your CometAPI key.

Cuerpo

application/json
session_id
string
requerido

Session id returned by identify-face.

face_choose
object[]
requerido

One or more face/audio mappings to synthesize.

Minimum array length: 1
callback_url
string

Webhook URL to receive task status updates.

external_task_id
string

Custom task id for your own tracking. Must be unique per account.

Respuesta

200 - application/json

Task accepted.

code
integer
requerido
message
string
requerido
data
object
requerido