Mixer AIMixer AI
Começar a gerar
Mixer AI › Base de conhecimento › Vídeo › Kling AI Avatar

Kling AI Avatar

Um retrato que fala ou canta a partir de uma foto e de uma faixa de áudio pronta.

Quando escolher

O Kling AI Avatar serve quando a voz já está gravada e você precisa de um personagem na tela. O modelo anima o rosto conforme o áudio; por isso, aprove roteiro, voz e pausas antes. Teste um trecho curto com o rosto bem visível antes de processar a gravação inteira.

Modos e configurações

Preço em moedas

VersãoQualidade / tamanhoEntradaMoedas / segundo
Standard720pRetrato + áudio≈ 5,6
Pro1080pRetrato + áudio≈ 10,92

A cobrança é por segundo, não por clipe de duração fixa. A tarifa é multiplicada pela duração cobrada; o total do pedido é arredondado para cima uma única vez, até a próxima moeda inteira.

A duração segue o áudio enviado; a tarifa depende da qualidade escolhida.

≈ indica uma tarifa arredondada para duas casas na exibição; o cálculo usa a precisão completa.

O que você pode criar

Como orientar o resultado

  1. Prepare uma gravação limpa de uma voz só, com pausas naturais.
  2. Use um retrato frontal ou quase frontal, sem cabelo ou objetos na frente da boca.

Preparação: cumprimento de um apresentador

Foto: retrato do peito para cima olhando para a câmera, com boca e queixo visíveis. Áudio: cumprimento curto de uma voz só, sem música. Comece com Standard e dez segundos; confira lábios, pausas e posição da cabeça.

O que levar em conta

Fontes

Dados do modelo verificados: 2026-09-20.

Guias e comparações com este modelo

Perguntas frequentes

Basta escrever o roteiro?

Não. Grave ou sintetize a voz primeiro e envie o áudio junto com o retrato.

Pode animar canto?

Sim. Use uma faixa com voz clara; acompanhamento muito alto dificulta o trabalho.

O que define a duração?

A duração do áudio, com limite de 300 segundos por resultado.

Qual retrato usar?

Um rosto bem visível, enquadramento quase frontal e luz uniforme.

Por que testar um trecho?

Para avaliar aquela combinação de rosto e voz antes de processar a gravação completa.

Posso fazer dois interlocutores?

Prepare um falante por pedido. Processe os personagens separadamente e junte as falas na edição.

O que muda o preço?

A tarifa por segundo depende da qualidade, do modo e, em alguns modelos, do som. Ela é multiplicada pela duração cobrada. Quando o vídeo de entrada é cobrado, sua duração também conta. O total é arredondado uma única vez.

Preciso de uma assinatura do modelo?

Não. No Mixer AI, você recarrega um saldo em moedas e usa esse saldo nas tarefas que precisar. Não é necessário assinar este modelo separadamente.