Modèles IA
Comparez les modèles IA image et vidéo, puis ouvrez la page de modèle ou le générateur adapté.
Modèles IA image
FireRed Image Edit
Un modèle d’édition d’images IA conçu pour l’inpainting ciblé, le remplacement d’objets, la modification d’arrière-plan et l’affinage du style. Il est idéal pour des retouches contrôlées et de haute qualité qui conservent la composition et le sujet principal d’origine, notamment pour la retouche e-commerce, la mise à jour d’affiches, l’optimisation de visuels sociaux et les reworks créatifs.
Nano Banana 2
Modèle de génération d'images multimodal de nouvelle génération prenant en charge jusqu'à 14 images de référence, la recherche Google et une sortie 4K. Offre une plus grande flexibilité créative avec des prompts ultra-longs jusqu'à 20 000 caractères.
Nano Banana 2 Lite
Le modèle Gemini Image le plus rapide et le plus efficace de Google DeepMind pour générer et éditer des images avec une faible latence. Idéal pour brouillons rapides, retouches avec référence et exploration visuelle légère.
Nano Banana Pro
Un modèle de génération professionnel nécessitant une haute fidélité, des détails élevés et une cohérence dans la composition et les personnages/objets.
Seedream 5.0 Lite
Modèle de génération d'images léger de nouvelle génération avec une compréhension sémantique améliorée et un rendu photoréaliste. Optimisé pour une génération rapide et de haute qualité de texte en image avec des résolutions de sortie 2K et 3K.
GPT-Image 1.5
Modèle de génération d'images photoréalistes de niveau professionnel, spécialisé dans la capture de textures délicates de lumière/ombre et d'expressions humaines naturelles. Prend en charge les modes texte-vers-image et image-vers-image, avec d'excellentes performances en fidélité et restauration de détails, particulièrement adapté aux scénarios commerciaux nécessitant un haut réalisme.
GPT Image 2
Un modèle de génération multi-références prenant en charge jusqu'à 16 images de référence, conçu pour une meilleure cohérence, plus de contrôle et des workflows commerciaux plus complexes. Prend en charge le texte-vers-image et l'image-vers-image.
Seedream 4.5
Modèle de génération visuelle phare avec une compréhension ultime du langage naturel et une expression de l'ombre et de la lumière. Il ne dépend plus de l'empilement mécanique de balises, mais comprend les 'histoires' et l''atmosphère', passant librement de la photographie hyper-réaliste à l'art surréaliste.
FLUX.2
Modèle de qualité industrielle de nouvelle génération, brisant la 'malédiction du texte' du dessin par IA. Il possède la capacité de suivi d'instructions la plus puissante à ce jour, générant non seulement parfaitement des mots/textes spécifiés dans les images, mais contrôlant également avec précision les mouvements complexes des mains et les relations spatiales des objets.
Z-Image
Un modèle optimisé pour les scénarios texte-image, dédié à la cartographie précise de descriptions complexes en éléments visuels, excellant particulièrement dans la conceptualisation et la réalisation de descriptions abstraites.
Grok 4.2 Image
xAI's latest Grok 4.2 image generation model, excelling at creative composition and stylized expression. Supports text-to-image and image-to-image, with outstanding performance in portraits, scene rendering, and artistic creation.
FLUX.2 Klein 9B
Black Forest Labs' ultra-fast lightweight image generation model with 9B parameters, delivering blazing speed for high-frequency batch generation and rapid iteration workflows.
Nano Banana
Modèle de génération d'images basé sur Google avec un excellent rendu des détails et support multi-images de référence. Jusqu'à 14 images de référence.
GLM Image
Modèle texte-vers-image de Zhipu AI avec forte compréhension bilingue. Génération rapide à coût ultra-bas.
Modèles IA vidéo
Veo 3.1
Le dernier modèle phare de génération vidéo de Google. Veo 3.1 Quality dispose d'un moteur physique de pointe et d'une fidélité ultra-élevée, reproduisant parfaitement les textures, la dynamique et les détails du monde réel. Prend en charge les formats 16:9, 9:16 et Auto, idéal pour la production vidéo commerciale de haute qualité.
Sora 2
L'édition standard de la série Sora. Conserve la compréhension supérieure des prompts d'OpenAI tout en optimisant la vitesse et les coûts. Parfait pour le storyboard, les courtes vidéos pour les réseaux sociaux et l'itération créative rapide.
HappyHorse
HappyHorse est le modèle multimodal de nouvelle génération d'Alibaba, avec co-génération native audio-vidéo. Un seul modèle couvre quatre scénarios — texte-à-vidéo, image-à-vidéo, référence multi-image-à-vidéo et édition vidéo en place — idéal pour la publicité, l'e-commerce, les mini-séries et les créations sociales.
Wan 2.6
Wan 2.6 est un modèle de génération vidéo avancé prenant en charge les modes texte-vidéo, image-vidéo et vidéo-vidéo. Offre des options de durée de 5s, 10s et 15s avec des résolutions 720p et 1080p. Comprend des capacités multi-prises pour créer divers contenus vidéo.
Kling Contrôle de mouvement
Le modèle Kling Motion Control contrôle précisément les mouvements et les poses des personnages via des images et vidéos de référence téléchargées. Prend en charge les vidéos de 3 à 30 secondes, génère des actions de personnages cohérentes avec les références, idéal pour l'animation de personnages et les scénarios de transfert de mouvement.
Kling 2.6
Réputé pour capturer des mouvements complexes et les lois de la physique. Kling 2.6 excelle à générer des mouvements de personnages très dynamiques, des interactions d'objets complexes et des mouvements de caméra cinématographiques avec fluidité.
Seedance 1.5 Pro
Modèle avancé de génération vidéo de ByteDance. Seedance 1.5 Pro excelle dans l'animation de personnages avec une synchronisation labiale précise et des expressions naturelles. Dispose d'une physique de mouvement réaliste, prend en charge plusieurs formats d'image (1:1, 21:9, 4:3, 3:4, 16:9, 9:16) et offre des options de durée flexibles (4s, 8s, 12s) avec génération audio optionnelle.
Seedance 2
Le modèle vidéo nouvelle génération de ByteDance. Seedance 2 met l'accent sur une haute qualité visuelle, des mouvements complexes et un contrôle multimodal par références. Il prend en charge les entrées texte, image, vidéo et audio, idéal pour des productions vidéo professionnelles nécessitant davantage de cohérence et une mise en scène plus riche.
Seedance 2.5
Le modèle vidéo nouvelle génération de ByteDance. Il prend en charge le texte vers vidéo, l'image vers vidéo avec première et dernière image, ainsi que les références multimodales image, vidéo et audio, en 480p/720p, de 4 à 30 secondes, avec génération audio optionnelle.
Seedance 2 Fast
La version plus rapide et plus rentable de Seedance 2. Idéale pour itérer rapidement sur des idées, tester des prompts en lot et produire du contenu à haute fréquence, tout en conservant la prise en charge des références image, vidéo et audio.
Seedance 2 Mini
Lightweight Seedance 2 for lower-cost drafts with first/last frames and multimodal references.
Grok Imagine
Modèle de génération vidéo créatif de xAI. Grok Imagine excelle dans la transformation de descriptions textuelles en contenu vidéo imaginatif, prend en charge plusieurs ratios d'aspect (2:3, 3:2, 1:1, 9:16, 16:9), offre trois modes de style (fun, normal, spicy), parfait pour la production de contenu créatif et le prototypage rapide.
Grok Imagine 1.5 Preview
Grok Imagine 1.5 Preview is a newer xAI-style video model for fast text-to-video and image-to-video creation. It supports 16:9 and 9:16 aspect ratios, 480p and 720p resolution, and short duration controls for social clips, ads, and creative tests.
Grok Video
Grok Video est le modèle avancé de génération vidéo de xAI prenant en charge des durées de 6s, 10s, 12s, 16s et 20s. Supporte le texte vers vidéo et l'image vers vidéo avec jusqu'à 5 images de référence. Offre plusieurs ratios d'aspect (16:9, 9:16, 2:3, 3:2, 1:1) et des prompts jusqu'à 5000 caractères.
Gemini Omni
Gemini Omni est le modèle avancé de génération vidéo de Google basé sur Omni-Flash-Ext. Prend en charge le texte vers vidéo, l'image vers vidéo et la fusion de 3 images de référence. Offre des durées de 4/6/8/10 secondes avec les rapports d'aspect 16:9 et 9:16.
PixVerse V6
PixVerse V6 est un modèle vidéo polyvalent pour le texte vers vidéo, l’animation d’image, les transitions entre première et dernière image et l’extension vidéo. Il prend en charge 360p à 1080p, 1 à 15 secondes et l’audio natif en option.