Skip to main content
POST
cURL
소스 비디오에서 얼굴을 이미 식별한 후 이 엔드포인트를 사용해 고급 립싱크 작업을 생성합니다.

호출 전에 준비할 것

  • Lip-Sync로 시작해 session_id와 사용 가능한 face_id 값을 가져옵니다
  • 각 얼굴을 오디오 세그먼트에 매핑하는 하나 이상의 face_choose 항목을 구성합니다
  • 이전 작업에서 생성된 오디오에는 audio_id를 사용하고, 호스팅된 오디오 파일에는 sound_file을 사용합니다
  • 타이밍 필드는 밀리초 단위로 전송합니다. 예를 들어 sound_start_time: "0"sound_end_time: "2000"은 처음 2초를 선택합니다.
  • 잘라낸 오디오 세그먼트는 최소 2000ms 이상이어야 하며 소스 오디오 길이를 초과하면 안 됩니다
  • 웹훅 전달이나 자체 추적 id가 필요할 때만 callback_url 또는 external_task_id를 설정합니다

작업 흐름

1

먼저 얼굴 식별

소스 비디오에서 Lip-Sync를 실행하고 반환된 session_id와 대상 face_id 값을 보관합니다.
2

고급 립싱크 작업 생성

이 엔드포인트를 통해 session_idface_choose 배열을 제출합니다.
3

생성된 작업 추적

상태 확인 및 최종 결과 조회를 위해 반환된 작업 id를 저장합니다.
전체 파라미터 참조는 Kling 공식 문서를 확인하세요.

인증

Authorization
string
header
필수

Bearer token authentication. Use your CometAPI key.

본문

application/json
session_id
string
필수

Session id returned by identify-face.

face_choose
object[]
필수

One or more face/audio mappings to synthesize.

Minimum array length: 1
callback_url
string

Webhook URL to receive task status updates.

external_task_id
string

Custom task id for your own tracking. Must be unique per account.

응답

200 - application/json

Task accepted.

code
integer
필수
message
string
필수
data
object
필수