Skip to main content
POST
cURL
Utilisez ce endpoint pour créer des clips d’avatar parlant à partir d’une image source et d’une source audio.

Avant de l’appeler

  • Fournissez une image d’avatar sous forme d’URL publique ou de chaîne base64 brute
  • Utilisez une image d’avatar qui respecte les exigences de pixels de Kling ; les minuscules miniatures sont rejetées par la tâche de génération
  • Envoyez exactement un seul de audio_id ou sound_file
  • Gardez la première requête simple : une image de visage, un clip audio et un court prompt facultatif
  • Incluez task_id lorsque l’audio référencé appartient à une tâche précédente qui doit être liée
  • Commencez avec mode: std sauf si vous avez spécifiquement besoin du chemin de meilleure qualité

Règles de source audio

  • audio_id est la voie la plus simple lorsque vous avez déjà généré de la parole via la route Kling TTS
  • sound_file fonctionne lorsque vous disposez déjà de votre propre ressource MP3, WAV, M4A ou AAC
  • La documentation indique que l’audio d’avatar doit durer de 2 à 60 secondes

Flux de tâche

1

Créer la tâche d’avatar

Soumettez l’image et une source audio, puis enregistrez l’id de tâche renvoyé.
2

Interroger la tâche

Continuez avec Obtenir une tâche Kling jusqu’à ce que la tâche atteigne un état terminal.
3

Stocker le résultat final

Copiez la ressource finale dans votre propre stockage si vous avez besoin d’une conservation au-delà de l’URL de livraison du fournisseur.
Pour la référence complète des paramètres, consultez la documentation officielle de Kling Avatar.

Autorisations

Authorization
string
header
requis

Bearer token authentication. Use your CometAPI key.

En-têtes

Content-Type
string

Optional content type header.

Corps

application/json
image
string
requis

Avatar image URL or base64 image string. Use an image that meets Kling pixel requirements; very small thumbnails are rejected.

prompt
string
requis

Prompt describing the desired avatar performance.

audio_id
string
requis

Audio id from a prior Kling audio task.

sound_file
string

Public audio URL when you provide your own audio.

task_id
string

Optional prior task id associated with the referenced audio asset.

mode
enum<string>

Generation mode. Use std or pro; omitted requests use std.

Options disponibles:
std,
pro

Réponse

200 - application/json

Task accepted.

code
integer
requis
message
string
requis
data
object
requis