Skip to main content
POST
cURL
Użyj tego endpointu, aby tworzyć klipy z mówiącym awatarem z jednego obrazu źródłowego i jednego źródła audio.

Zanim go wywołasz

  • Podaj jeden image awatara jako publiczny URL lub surowy ciąg base64
  • Użyj obrazu awatara spełniającego wymagania Kling dotyczące pikseli; małe miniatury są odrzucane przez zadanie generowania
  • Prześlij dokładnie jedno z pól audio_id lub sound_file
  • Zachowaj prostotę pierwszego żądania: jeden obraz twarzy, jeden klip audio i krótki opcjonalny prompt
  • Dołącz task_id, gdy wskazane audio należy do wcześniejszego zadania, które musi zostać powiązane
  • Zacznij od mode: std, chyba że konkretnie potrzebujesz ścieżki o wyższej jakości

Zasady dotyczące źródła audio

  • audio_id to najprostsza ścieżka, gdy mowa została już wygenerowana przez trasę Kling TTS
  • sound_file działa, gdy masz już własny zasób MP3, WAV, M4A lub AAC
  • Długość audio dla awatara jest opisana w dokumentacji jako od 2 do 60 sekund

Przepływ zadania

1

Utwórz zadanie awatara

Prześlij obraz i jedno źródło audio, a następnie zapisz zwrócone id zadania.
2

Sprawdzaj zadanie

Kontynuuj z Pobierz zadanie Kling, aż zadanie osiągnie stan końcowy.
3

Zapisz gotowy wynik

Skopiuj końcowy zasób do własnej pamięci, jeśli potrzebujesz przechowywania dłuższego niż czas dostępności pod URL dostawcy.
Pełne informacje o parametrach znajdziesz w oficjalnej dokumentacji Kling Avatar.

Autoryzacje

Authorization
string
header
wymagane

Bearer token authentication. Use your CometAPI key.

Nagłówki

Content-Type
string

Optional content type header.

Treść

application/json
image
string
wymagane

Avatar image URL or base64 image string. Use an image that meets Kling pixel requirements; very small thumbnails are rejected.

prompt
string
wymagane

Prompt describing the desired avatar performance.

audio_id
string
wymagane

Audio id from a prior Kling audio task.

sound_file
string

Public audio URL when you provide your own audio.

task_id
string

Optional prior task id associated with the referenced audio asset.

mode
enum<string>

Generation mode. Use std or pro; omitted requests use std.

Dostępne opcje:
std,
pro

Odpowiedź

200 - application/json

Task accepted.

code
integer
wymagane
message
string
wymagane
data
object
wymagane