Vídeo desde texto, primer y último fotograma, y referencias de imagen, vídeo o audio.
MiniMax H3 crea clips de 4–15 segundos en 768p o 2K con sonido estéreo nativo. Empieza desde texto, fija primer y último fotograma o añade referencias: hasta 9 imágenes, 3 vídeos y 3 audios. El audio necesita una entrada visual.
| Tipo | Generación de vídeo (text-to-video, image-to-video) |
|---|---|
| Animar una foto | Sí |
| Fotogramas de entrada | primer y último fotograma |
| Referencias | hasta 9 imágenes, 3 vídeos y 3 audios; el audio necesita una entrada visual |
| Audio | sí, nativo |
| Duración del clip | 4–15s |
| Resolución | 768p, 2K |
| Longitud del prompt | 7000 caracteres |
| Modelo del proveedor | MiniMax H3 |
| Lanzamiento | 2026-07-31 |
Vídeo desde texto, primer y último fotograma, y referencias de imagen, vídeo o audio. Es un modelo de vídeo de MiniMax (MiniMax H3), disponible en Mixer AI con pago por uso — el precio se muestra antes de generar.
Pago por uso, sin planes — el precio se muestra antes de generar. El precio exacto se muestra antes de ejecutar.
Sí — sube una foto como fotograma o referencia y el modelo la convierte en vídeo. También funciona texto a vídeo.
No. Mixer AI es de pago por uso: recargas un saldo en monedas y lo gastas solo en las generaciones que quieras. Disponible en el sitio y en el bot de Telegram @addbeer_bot.