Skip to main content
POST
cURL
Используйте этот endpoint, чтобы создавать ролики с говорящим аватаром из одного исходного изображения и одного аудиоисточника.

Перед вызовом

  • Укажите одно аватарное image как публичный URL или строку raw base64
  • Используйте изображение аватара, соответствующее требованиям Kling к пикселям; маленькие миниатюры отклоняются задачей генерации
  • Передавайте ровно одно из audio_id или sound_file
  • Для первого запроса используйте простую конфигурацию: одно изображение лица, один аудиоклип и короткий необязательный prompt
  • Включайте task_id, когда связанное аудио принадлежит предыдущей задаче, которую необходимо привязать
  • Начинайте с mode: std, если вам специально не нужен путь с более высоким качеством

Правила для аудиоисточника

  • audio_id — самый простой вариант, если вы уже сгенерировали речь через маршрут Kling TTS
  • sound_file подходит, если у вас уже есть собственный ресурс в формате MP3, WAV, M4A или AAC
  • Для аудио аватара в документации указана длительность от 2 до 60 секунд

Поток задачи

1

Создайте задачу аватара

Отправьте изображение и один аудиоисточник, затем сохраните возвращённый id задачи.
2

Опрашивайте задачу

Продолжайте с Получение задачи Kling, пока задача не достигнет терминального состояния.
3

Сохраните готовый результат

Скопируйте финальный ресурс в собственное хранилище, если вам нужно хранение дольше, чем обеспечивает URL доставки провайдера.
Полное описание параметров см. в официальной документации Kling Avatar.

Авторизации

Authorization
string
header
обязательно

Bearer token authentication. Use your CometAPI key.

Заголовки

Content-Type
string

Optional content type header.

Тело

application/json
image
string
обязательно

Avatar image URL or base64 image string. Use an image that meets Kling pixel requirements; very small thumbnails are rejected.

prompt
string
обязательно

Prompt describing the desired avatar performance.

audio_id
string
обязательно

Audio id from a prior Kling audio task.

sound_file
string

Public audio URL when you provide your own audio.

task_id
string

Optional prior task id associated with the referenced audio asset.

mode
enum<string>

Generation mode. Use std or pro; omitted requests use std.

Доступные опции:
std,
pro

Ответ

200 - application/json

Task accepted.

code
integer
обязательно
message
string
обязательно
data
object
обязательно