Skip to main content
POST
cURL
このエンドポイントを使用すると、1 枚の元画像と 1 つの音声ソースから、話すアバターのクリップを作成できます。

呼び出す前に

  • 1 つのアバター image を公開 URL または生の base64 文字列として提供します
  • Kling のピクセル要件を満たすアバター画像を使用してください。小さすぎるサムネイルは生成タスクで拒否されます
  • audio_id または sound_file のいずれか一方のみを送信します
  • 最初のリクエストはシンプルにしてください。顔画像 1 枚、音声クリップ 1 つ、そして必要に応じて短いプロンプト(Prompt)を指定します
  • 参照する音声が、関連付ける必要のある以前のタスクに属している場合は task_id を含めます
  • より高品質なパスが明確に必要でない限り、mode: std から始めてください

音声ソースのルール

  • audio_id は、Kling TTS ルート経由ですでに音声を生成している場合に最も簡単な方法です
  • sound_file は、独自の MP3、WAV、M4A、または AAC アセットをすでに持っている場合に使用できます
  • アバター音声の長さは 2 ~ 60 秒と文書化されています

タスクの流れ

1

アバタータスクを作成する

画像と 1 つの音声ソースを送信し、返された task id を保存します。
2

タスクをポーリングする

タスクが終了状態に達するまで、Kling タスクを取得する を続けます。
3

完了した結果を保存する

プロバイダーの配信 URL を超えて保持する必要がある場合は、最終アセットを自分のストレージにコピーします。
完全なパラメータリファレンスについては、Kling Avatar の公式ドキュメント を参照してください。

承認

Authorization
string
header
必須

Bearer token authentication. Use your CometAPI key.

ヘッダー

Content-Type
string

Optional content type header.

ボディ

application/json
image
string
必須

Avatar image URL or base64 image string. Use an image that meets Kling pixel requirements; very small thumbnails are rejected.

prompt
string
必須

Prompt describing the desired avatar performance.

audio_id
string
必須

Audio id from a prior Kling audio task.

sound_file
string

Public audio URL when you provide your own audio.

task_id
string

Optional prior task id associated with the referenced audio asset.

mode
enum<string>

Generation mode. Use std or pro; omitted requests use std.

利用可能なオプション:
std,
pro

レスポンス

200 - application/json

Task accepted.

code
integer
必須
message
string
必須
data
object
必須