MiniMax H3 Max — Creación de escenas de vídeo
Genera vídeos de 5–15 segundos en 480p/768p desde texto, fotogramas inicial/final o referencias multimodales. Combina imágenes, vídeo y audio para controlar sujeto, movimiento y ritmo.

¿Qué es MiniMax H3 Max?
MiniMax H3 Max es un modelo de vídeo de la familia H3 para texto a vídeo, imagen a vídeo con fotograma inicial, final o ambos, y referencia multimodal a vídeo. Las rutas actuales de EvoLink producen MP4 de 5–15 segundos en 480p o 768p. El modo de referencia admite imágenes, vídeos y audio para dar más control sobre identidad, movimiento y tiempo.

Funciones de MiniMax H3 Max
Elige texto, fotogramas clave o referencias multimodales según el control que necesite la toma.
Core Features Overview
Texto a vídeo
Genera clips de 5–15 segundos en 21:9, 16:9, 4:3, 1:1, 3:4 o 9:16 desde un prompt.
Fotograma inicial y final
En imagen a vídeo puedes usar solo el fotograma inicial, solo el final o ambos.
Referencias multimodales
Usa hasta 9 imágenes, 3 vídeos y 3 audios, con un máximo total de 12 referencias.
Salida 480p y 768p
Usa 480p para pruebas económicas o 768p para una revisión más nítida.
Preguntas frecuentes sobre MiniMax H3 Max
MiniMax H3 Max — Creación de escenas de vídeo FAQ
Un modelo de vídeo H3 para texto a vídeo, animación con fotogramas y referencia multimodal.
Hasta 9 imágenes, 3 vídeos y 3 audios, 12 en total. Se requiere al menos una imagen o un vídeo; el audio por sí solo no es válido.
MP4 en 480p y 768p con duraciones enteras de 5 a 15 segundos.
H3 Max añade referencias multimodales de imagen, vídeo y audio. Turbo es la opción más rápida y económica para texto y fotograma inicial.
El generador muestra la estimación actual antes de enviar. Depende de resolución y duración; el modo de referencia también puede incluir segundos de vídeo de referencia e imágenes adicionales.
Explorar Más Modelos de Video IA
Crear vídeo con MiniMax H3 Max
Empieza con texto, fotogramas clave o referencias multimodales directamente en el navegador.
10,000+ users