- Multimodale Eingaben aus Text, Bild, Video und Audio
- Referenz-Tagging mit natürlicher Sprachsteuerung
- Replikation von Bewegung, Choreografie und Kamerabewegung
- Konsistenz von Charakteren, Kleidung, Szenen, Text und Stil
- Videoerweiterung und Segmentbearbeitung
- Szenenfusion und gezielter Inhaltsersatz
- Generierung kontextbezogener Soundeffekte und Hintergrundmusik
- Beat-synchronisierte Videoerstellung
- Batch-Generierung von bis zu 10 Videos
- Mehrere Auflösungen und Seitenverhältnisse
- Wasserzeichenfreie Downloads
- API-Zugriff