MiniMax H3 — это универсальная мультимодальная видеомодель, построенная вокруг четырёх вещей: клипов от 4 до 15 секунд, вывода в 2K, смешанного входа референсов и точного редактирования.
Изображения, видео и аудио передаются в одном запросе. H3 считывает персонажей, движение, эмоции, язык камеры, стиль и творческий замысел внутри каждого референса, а затем объединяет их в одну цельную аудиовизуальную сцену, а не в сырой материал, который вам ещё нужно собирать вручную.
Редактирование — это другая половина модели. Укажите на персонажа, объект, сцену, звук или сам темп, и H3 изменит именно это, следуя подробным инструкциям и оставляя всё остальное нетронутым — так вы итеративно улучшаете уже существующий материал вместо того, чтобы заново переснимать весь кадр.
Такое сочетание подходит для реального коммерческого производства: рекламы, брендовых фильмов, e-commerce, коротких драм и игрового контента. H3 компонуeт субтитры, бренд-маркеры и UI-элементы как часть дизайна, а не накладывает их поверх, и именно здесь он сильнее всего среди других моделей.