Содержание
MiniMax H3 объединяет генерацию и мультимодальные референсы в одной AI-видеомодели
MiniMax представила H3 — открытую универсальную AI-модель для создания видео. Она работает с текстом, изображениями, видеороликами и аудио в едином запросе, а результат можно получить в разрешении до 2K и длительностью от 5 до 15 секунд.
Что умеет MiniMax H3
Модель поддерживает генерацию видео с нуля по промпту, оживление первого или последнего кадра и создание по референсам. В качестве ориентиров можно передать персонажа, стиль, движение камеры, голос или ритм монтажа — H3 должна сохранять эти особенности в готовом ролике.
Один запрос может включать до девяти изображений, трёх видео и трёх аудиофайлов, но не более 12 материалов суммарно. Для видео- и аудиореференсов действует ограничение в 15 секунд общей длительности, а промпт может содержать до 7000 символов.
Сколько стоит генерация
Через API секунда 2K-видео стоит $0,13, а в 768p — $0,09. Таким образом, 10-секундный ролик обойдётся примерно в $1,30 или $0,90 соответственно. Аудиореференсы не тарифицируются, первые пять изображений бесплатны, а каждое следующее стоит $0,04.
Почему это важно для креаторов
Главное изменение — возможность собрать в одном запросе не только описание сцены, но и набор разнородных референсов. Для авторов, рекламных команд и UGC-продакшена это означает более управляемую генерацию: можно закрепить внешность героя, показать нужную пластику движения, передать визуальный стиль и добавить ориентир по голосу или монтажу.
MiniMax H3 уже доступна через API компании. Для интеграций предусмотрен асинхронный процесс: сервис создаёт задачу, после завершения возвращает готовую ссылку на видео. MiniMax также заявляет открытые веса модели, что делает релиз особенно заметным на фоне закрытых коммерческих видеогенераторов.