MiniMax H3 Max — Création de scènes vidéo
Générez des vidéos 480p/768p de 5–15 secondes à partir de texte, d’images de début/fin ou de références multimodales. Combinez images, vidéos et audio pour mieux guider sujet, mouvement et rythme.

Qu’est-ce que MiniMax H3 Max ?
MiniMax H3 Max est un modèle vidéo de la famille H3 pour texte-vers-vidéo, image-vers-vidéo avec image de départ, image de fin ou les deux, ainsi que référence multimodale-vers-vidéo. Les routes EvoLink actuelles produisent des MP4 de 5–15 secondes en 480p ou 768p. Le mode référence accepte images, vidéos et audio pour un contrôle plus précis de l’identité, du mouvement et du timing.

Fonctions de MiniMax H3 Max
Choisissez texte, images clés ou références multimodales selon le niveau de contrôle souhaité.
Core Features Overview
Texte vers vidéo
Générez 5–15 secondes en 21:9, 16:9, 4:3, 1:1, 3:4 ou 9:16 depuis un prompt.
Images de début et de fin
En image-vers-vidéo, vous pouvez utiliser l’image de départ seule, l’image de fin seule ou les deux.
Références multimodales
Utilisez jusqu’à 9 images, 3 vidéos et 3 audios, avec 12 références maximum au total.
Sortie 480p et 768p
Utilisez 480p pour explorer à moindre coût ou 768p pour une prévisualisation plus nette.
FAQ MiniMax H3 Max
MiniMax H3 Max — Création de scènes vidéo FAQ
Un modèle vidéo H3 pour texte-vers-vidéo, animation par images clés et génération à partir de références multimodales.
Jusqu’à 9 images, 3 vidéos et 3 audios, 12 au total. Il faut au moins une image ou une vidéo ; l’audio seul n’est pas accepté.
MP4 480p et 768p avec une durée entière de 5 à 15 secondes.
H3 Max ajoute les références multimodales image, vidéo et audio. Turbo est l’option plus rapide et moins coûteuse pour texte et image de départ.
Le générateur affiche l’estimation actuelle avant l’envoi. Le coût dépend de la résolution et de la durée ; le mode référence peut aussi inclure la durée des vidéos de référence et des images supplémentaires.
Explorer Plus de Modèles Vidéo IA
Créer une vidéo avec MiniMax H3 Max
Commencez avec du texte, des images clés ou des références multimodales directement dans le navigateur.
10,000+ users