Skip to main content
POST
cURL
Gebruik deze endpoint om pratende avatarclips te maken van één bronafbeelding plus één audiobron.

Voordat je deze aanroept

  • Geef één avatar-image op als openbare URL of ruwe base64-string
  • Gebruik een avatarafbeelding die voldoet aan de pixelvereisten van Kling; kleine thumbnails worden door de generation task afgewezen
  • Verstuur precies één van audio_id of sound_file
  • Houd de eerste aanvraag eenvoudig: één gezichtsafbeelding, één audioclip en een korte optionele prompt
  • Voeg task_id toe wanneer de opgegeven audio bij een eerdere taak hoort die gekoppeld moet worden
  • Begin met mode: std, tenzij je specifiek het pad met hogere kwaliteit nodig hebt

Regels voor audiobronnen

  • audio_id is de eenvoudigste route wanneer je al spraak hebt gegenereerd via de Kling TTS-route
  • sound_file werkt wanneer je al je eigen MP3-, WAV-, M4A- of AAC-bestand hebt
  • Avatar-audio is gedocumenteerd als 2 tot 60 seconden lang

Taakverloop

1

Maak de avatartaak

Dien de afbeelding en één audiobron in en sla daarna de geretourneerde taak-id op.
2

Poll de taak

Ga door met Een Kling-taak ophalen totdat de taak een eindstatus bereikt.
3

Sla het voltooide resultaat op

Kopieer het uiteindelijke bestand naar je eigen opslag als je bewaring nodig hebt die langer duurt dan de delivery URL van de provider.
Zie voor de volledige parameterreferentie de officiële Kling Avatar-documentatie.

Autorisaties

Authorization
string
header
vereist

Bearer token authentication. Use your CometAPI key.

Headers

Content-Type
string

Optional content type header.

Body

application/json
image
string
vereist

Avatar image URL or base64 image string. Use an image that meets Kling pixel requirements; very small thumbnails are rejected.

prompt
string
vereist

Prompt describing the desired avatar performance.

audio_id
string
vereist

Audio id from a prior Kling audio task.

sound_file
string

Public audio URL when you provide your own audio.

task_id
string

Optional prior task id associated with the referenced audio asset.

mode
enum<string>

Generation mode. Use std or pro; omitted requests use std.

Beschikbare opties:
std,
pro

Respons

200 - application/json

Task accepted.

code
integer
vereist
message
string
vereist
data
object
vereist