MiniMax представила модель H3 для генерации видео с поддержкой мультимодальных данных

Китайская компания MiniMax, специализирующаяся на разработках в области искусственного интеллекта, анонсировала новую модель для генерации видео H3. Об этом стало известно 31 июля.
Модель H3 способна создавать видеоролики длительностью до 15 секунд с разрешением 2K и объемным стереозвуком. Помимо генерации, она умеет редактировать существующий контент и переносить движения из одного видео в другое, используя текстовые инструкции и различные форматы исходных материалов.
MiniMax планирует в ближайшие дни опубликовать веса модели H3, что позволит пользователям загружать и настраивать систему под свои нужды. Такой подход с открытыми весами постепенно становится трендом среди китайских разработчиков ИИ, тогда как многие популярные видео-модели остаются закрытыми.
Компания была основана в 2022 году и входит в число перспективных стартапов Китая, известных как «AI-тигры», конкурирующих с крупными технологическими гигантами и международными лидерами в сфере фундаментальных моделей. В январе 2026 года MiniMax стала второй из этой группы, кто вышел на биржу Гонконга после Z.AI.
Ранее в июле Reuters сообщал, что MiniMax готовится к запуску H3 и работает над языковой моделью с 2,7 триллионами параметров.
Рынок китайских видео-ИИ-моделей активно развивается: в начале года ByteDance представила Seedance 2.0, способную создавать сложные видеоклипы на основе текста, изображений, звука и видео, а Kuaishou выпустил Kling 3.0.
MiniMax позиционирует H3 для коммерческого использования в рекламе, электронной коммерции, дизайне продуктов и игровой индустрии. Стоимость генерации видео в 2K формате обещает быть менее трети цены аналогичных решений конкурентов.
В условиях усиливающейся в Китае политики технологической независимости от американских полупроводников MiniMax отметила, что H3 оптимизирована для работы на нескольких китайских чипах.
По данным Reuters.com.
