| Modellstatus | Auf MindVideo AI verfügbar | Auf MindVideo AI verfügbar |
| Kerneingaben | Text, Bilder, Videos, Audio | Text, Bilder, Videos, Audio |
| Unterstützte Workflows | Text zu Video, Bild zu Video, Video zu Video, Videobearbeitung und referenzbasierte Generierung | Text zu Video, Bild zu Video, Video zu Video, Videobearbeitung und referenzbasierte Generierung |
| Videodauer | Bis zu 30 Sekunden in einer Generierung | 4 bis 15 Sekunden |
| Referenzmaterialien | Bis zu 30 Bilder, 10 Videoclips und 10 Audioclips | Bis zu 9 Referenzbilder, 3 Referenzvideos und 3 Referenz-Audiodateien |
| Mehrstufige Verlängerung | Unterstützt eine kohärentere Videoverlängerung für längere Sequenzen | Unterstützt Videoverlängerung |
| Audiogenerierung | Verbesserte native Audio-Video-Generierung | Unterstützt native Audiogenerierung |
| Audio und Lippensynchronität | Verbesserte Abstimmung zwischen Dialog, Ton, Bewegung und Szenentiming | Unterstützt audiovisuelle Synchronisierung und Lippensynchronität |
| Visuelle Konsistenz | Bessere Kontinuität bei Figuren, Produkten, Szenen und visuellem Stil über längere Sequenzen hinweg | Verbesserte Motivkonsistenz mit weiterem Potenzial bei Szenen mit mehreren Motiven |
| Gezielte Bearbeitung | Gezieltere Änderungen mit Prompts, Referenzen und lokaler Bearbeitung | Promptbasierte Bearbeitung von Clips, Figuren, Aktionen und Handlungssträngen |
| 3D-Workflow | Clay Renders und 3D-Referenzen zur Steuerung von Komposition, Bewegung, Kameraführung und Beleuchtung | Nicht erwähnt |