Skip to main content
POST
cURL
Usa questo endpoint per creare un’attività di lip-sync avanzato dopo aver già identificato i volti nel video sorgente.

Prima di chiamarlo

  • Inizia con Lip-Sync per ottenere il session_id e i valori face_id disponibili
  • Crea una o più voci face_choose che associano ogni volto a un segmento audio
  • Usa audio_id per l’audio prodotto da un’attività precedente, oppure sound_file per un file audio ospitato
  • Invia i campi temporali in millisecondi. Ad esempio, sound_start_time: "0" e sound_end_time: "2000" selezionano i primi 2 secondi.
  • Assicurati che il segmento audio ritagliato sia di almeno 2000 ms e non superi la durata dell’audio sorgente
  • Imposta callback_url o external_task_id solo quando hai bisogno della consegna tramite webhook o di un tuo id di tracciamento

Flusso dell’attività

1

Identifica prima i volti

Esegui Lip-Sync sul video sorgente e conserva il session_id restituito insieme ai valori face_id di destinazione.
2

Crea l'attività di lip-sync avanzato

Invia session_id e l’array face_choose tramite questo endpoint.
3

Monitora l'attività generata

Salva l’id dell’attività restituito per i controlli di stato e il recupero del risultato finale.
Per il riferimento completo dei parametri, consulta la documentazione ufficiale di Kling.

Autorizzazioni

Authorization
string
header
obbligatorio

Bearer token authentication. Use your CometAPI key.

Corpo

application/json
session_id
string
obbligatorio

Session id returned by identify-face.

face_choose
object[]
obbligatorio

One or more face/audio mappings to synthesize.

Minimum array length: 1
callback_url
string

Webhook URL to receive task status updates.

external_task_id
string

Custom task id for your own tracking. Must be unique per account.

Risposta

200 - application/json

Task accepted.

code
integer
obbligatorio
message
string
obbligatorio
data
object
obbligatorio