Kling AI Avatar
Говорящий или поющий портрет из одной фотографии и готовой аудиодорожки.
Для какой задачи выбрать
Kling AI Avatar подходит, когда текст уже озвучен и нужен персонаж в кадре. Модель подстраивает лицо под вашу запись, поэтому сценарий, голос и паузы лучше утвердить заранее. Для первого теста возьмите короткий фрагмент и портрет с хорошо видимым лицом.
- Использует готовую речь или вокал, а не создаёт новую реплику из промпта.
- Позволяет собирать объяснения, приветствия и музыкальные портреты без съёмки ведущего.
Режимы и настройки
- Обязательны одно фото и один аудиофайл.
- Standard — 720p, Pro — 1080p. Длительность следует аудио, максимум 300 секунд.
Цена в монетах
| Версия | Качество / размер | Что на входе | Монет / секунду |
|---|---|---|---|
| Standard | 720p | Портрет + аудио | ≈ 5,6 |
| Pro | 1080p | Портрет + аудио | ≈ 10,92 |
Оплата за каждую секунду, а не за ролик фиксированной длины. Тариф умножается на оплачиваемую длительность; итог округляется вверх до целой монеты один раз за весь запрос.
Длительность определяется загруженной аудиодорожкой; тариф зависит от выбранного качества.
≈ — дробный тариф показан с округлением до сотых; расчёт использует полную точность.
Что можно сделать
- Ведущий короткого обучающего видео.
- Поющий персонаж под подготовленный вокальный фрагмент.
Как поставить задачу
- Подготовьте чистую запись одного голоса с естественными паузами.
- Используйте портрет анфас или почти анфас, без волос и предметов перед ртом.
Пример подготовки: приветствие ведущего
Фото: портрет по грудь, лицо направлено к камере, рот и подбородок хорошо видны. Аудио: короткое приветствие одним голосом без фоновой музыки. Начните с Standard и десятисекундного фрагмента; проверьте губы, паузы и положение головы.
Что учитывать
- Введённый текст не заменяет аудиофайл.
- Сильный профиль, закрытое лицо и несколько голосов мешают синхронизации.
Источники
- Цены и доступность — каталог Mixer AI, обновлено 2026-09-18.
- Официальный сайт создателя модели: Kuaishou
Факты модели проверены: 2026-09-20.
Гайды и сравнения с этой моделью
Частые вопросы
Можно просто написать текст?
Нет. Сначала озвучьте его и загрузите аудио вместе с фотографией.
Можно использовать пение?
Да, подготовьте дорожку с отчётливым вокалом. Слишком громкий аккомпанемент усложняет задачу.
Как определяется длина видео?
По длительности аудио. Предел одного результата — 300 секунд.
Какое фото выбрать?
С одним хорошо видимым лицом, близким к фронтальному ракурсом и ровным освещением.
Зачем пробовать короткий отрывок?
Чтобы проверить конкретное сочетание лица и голоса до обработки всей записи.
Можно сделать двух собеседников?
Для этой карточки готовьте одного спикера. Реплики разных персонажей удобнее обработать отдельно и собрать в монтаже.
От чего зависит стоимость?
Тариф в монетах за секунду зависит от качества, режима и, у некоторых моделей, звука. Он умножается на оплачиваемую длительность. Когда учитывается входное видео, его длительность тоже входит в расчёт. Итог округляется один раз за весь запрос.
Нужна отдельная подписка на модель?
Нет. В Mixer AI используется общий баланс в монетах: пополняете его и оплачиваете нужные задачи. Отдельная подписка на эту модель не требуется.