- Entrées multimodales image, vidéo, audio et texte
- Prise en charge de jusqu’à neuf images, trois vidéos et trois fichiers audio
- Système de référence @ pour attribuer des rôles aux assets
- Cohérence des personnages, produits, styles et scènes
- Réplication des mouvements des personnages et de la caméra
- Extension de vidéo et génération de plans-séquences
- Remplacement de personnages et montage vidéo ciblé
- Achèvement de l’intrigue à partir d’entrées minimales
- Lip-sync, effets sonores et fidélité audio
- Synchronisation automatique de la musique et des battements visuels