Mixer AIMixer AI
Empezar a generar
Mixer AI › Base de conocimiento › Vídeo › Kling AI Avatar

Kling AI Avatar

Un retrato que habla o canta a partir de una foto y una pista de audio preparada.

Cuándo elegirlo

Kling AI Avatar sirve cuando ya tienes la voz grabada y necesitas un personaje en pantalla. El modelo anima el rostro siguiendo tu audio, así que conviene aprobar antes el guion, la voz y las pausas. Prueba un fragmento corto con un rostro bien visible antes de procesar toda la grabación.

Modos y ajustes

Precio en monedas

VersiónCalidad / tamañoEntradaMonedas / segundo
Standard720pRetrato + audio≈ 5,6
Pro1080pRetrato + audio≈ 10,92

El cobro es por segundo, no por un clip de duración fija. La tarifa se multiplica por la duración facturable; el total de la solicitud se redondea hacia arriba a una moneda entera una sola vez.

La duración sigue al audio subido; la tarifa depende de la calidad elegida.

≈ indica una tarifa redondeada a dos decimales para mostrarla; el cálculo usa la precisión completa.

Qué puedes crear

Cómo pedir el resultado

  1. Prepara una grabación limpia de una sola voz con pausas naturales.
  2. Usa un retrato frontal o casi frontal, sin objetos ni cabello sobre la boca.

Preparación: saludo de un presentador

Foto: retrato de pecho hacia arriba mirando a cámara, con boca y mentón visibles. Audio: saludo corto de una sola voz y sin música. Empieza con Standard y diez segundos; revisa labios, pausas y posición de la cabeza.

Qué tener en cuenta

Fuentes

Datos del modelo verificados: 2026-09-20.

Guías y comparaciones con este modelo

Preguntas frecuentes

¿Basta escribir el guion?

No. Graba o sintetiza primero la voz y sube el audio junto con el retrato.

¿Puede animar canto?

Sí. Usa una pista con voz clara; un acompañamiento muy fuerte dificulta la tarea.

¿Qué determina la duración?

La duración del audio, con un máximo de 300 segundos por resultado.

¿Qué retrato conviene?

Un rostro bien visible, encuadre casi frontal y luz uniforme.

¿Por qué probar un fragmento?

Permite evaluar esa combinación de rostro y voz antes de procesar la grabación completa.

¿Puedo hacer dos interlocutores?

Prepara un hablante por solicitud. Procesa los personajes por separado y une las intervenciones en edición.

¿De qué depende el precio?

La tarifa por segundo depende de la calidad, el modo y, en algunos modelos, el sonido. Se multiplica por la duración facturable. Cuando se cobra el video de entrada, su duración también cuenta. El total se redondea una sola vez.

¿Necesito una suscripción al modelo?

No. En Mixer AI recargas un saldo en monedas y lo usas para las tareas que necesites. No hace falta contratar una suscripción aparte para este modelo.