| Statut du modèle | Disponible sur MindVideo AI | Disponible sur MindVideo AI |
| Entrées principales | Texte, images, vidéos, audio | Texte, images, vidéos, audio |
| Workflows pris en charge | Texte vers vidéo, image vers vidéo, vidéo vers vidéo, montage vidéo et génération basée sur des références | Texte vers vidéo, image vers vidéo, vidéo vers vidéo, montage vidéo et génération basée sur des références |
| Durée de la vidéo | Jusqu’à 30 secondes en une seule génération | 4 à 15 secondes |
| Supports de référence | Jusqu’à 30 images, 10 clips vidéo et 10 clips audio | Jusqu’à 9 images de référence, 3 vidéos de référence et 3 fichiers audio de référence |
| Extension en plusieurs étapes | Permet une extension vidéo plus cohérente pour les séquences longues | Prend en charge l’extension vidéo |
| Génération audio | Génération audio-vidéo native améliorée | Prend en charge la génération audio native |
| Audio et synchronisation labiale | Meilleure coordination entre les dialogues, le son, le mouvement et le rythme des scènes | Prend en charge la synchronisation audiovisuelle et labiale |
| Cohérence visuelle | Meilleure continuité des personnages, produits, scènes et styles visuels sur les séquences longues | Cohérence des sujets améliorée, avec encore une marge de progression dans les scènes à plusieurs sujets |
| Montage ciblé | Modifications plus ciblées avec des prompts, des références et un montage localisé | Contrôle par prompt du montage des clips, personnages, actions et intrigues |
| Workflow 3D | Rendus clay et références 3D pour guider la composition, le mouvement, la direction de caméra et l’éclairage | Non mentionné |