Да. Модель доступна через асинхронную конечную точку APIXO и может быть вызвана с тем же API-ключом, что и любая другая модель в каталоге. Генерация также доступна в Playground на этой странице.
MiniMax H3 — это мультимодальная видеомодель общего назначения, которая объединяет текстовый, графический, видео- и аудиоконтекст в едином рабочем процессе генерации. Она создаёт видео до 15 секунд в разрешении 2K с нативным стереозвуком и поддерживает управление первым и последним кадром, референсы из смешанных медиа, перенос движения, многокадровое повествование и редактирование видео по инструкциям.
Входные данные
Текст / Изображение / Видео / Аудио
Цена APIXO
$0.09–$0.13 / секунду
Разрешение
768P / 2K
Длительность
5-15 секунд
Аудио
Нативный стереозвук
Загрузка рабочего пространства...
Объединяйте письменные указания с референсами изображений, видео и аудио в одном запросе. Назначайте каждому источнику роль, такую как внешний вид, движение, камера, голос, ритм, окружение или стиль.
Задайте начальный кадр, конечный кадр или оба, чтобы направлять трансформации, переходы, презентации продуктов и ключевые моменты раскадровки, сохраняя при этом более четкую визуальную траекторию.
Используйте референсные изображения, видео и аудио вместе, чтобы передать идентичность персонажа, особенности продукта, движение, операторский язык, вокальное исполнение, музыку или атмосферу.
Сгенерируйте голос, звуковые эффекты, эмбиент и музыку вместе с видео в виде нативного стерео аудио, вместо того чтобы собирать отдельные аудиодорожки после генерации.
Создавайте короткие последовательности со скоординированной сменой кадров, развитием сцены, непрерывностью действия и аудиовизуальным ритмом в рамках одного рабочего процесса, управляемого промптом или референсами.
Преобразуйте существующий визуальный материал с помощью инструкций на естественном языке или переносите движение из видеореференсов, проверяя при этом идентичность, композицию, окклюзию и точность деталей источника.
Объединяйте изображения продуктов, письменные указания, референсы движения и звуковые концепции для разработки идей кампании. Проверяйте этикетки, логотипы, материалы, размеры и геометрию продукта перед утверждением сгенерированных коммерческих материалов.
Задайте повторяющийся объект с помощью визуальных референсов, затем управляйте движением, поведением камеры, голосом или контекстом сцены с помощью дополнительных медиафайлов. Оцените непрерывность идентичности, анатомию, выражение и тайминги в итоговом результате.
Превратите сценарную заявку в короткие сцены, которые сочетают в себе действие, операторский язык, атмосферу и аудиовизуальный темп. Используйте сгенерированный материал для оценки идей перед тем, как приступать к физическому производству или детальной постобработке.
Изменяйте стиль, окружение, объект или сцену с помощью инструкций на естественном языке и опциональных референсов. Покадрово проверяйте временные границы, окклюзию, непреднамеренные изменения и сохранение деталей исходника.
Подтверждено на действующем развёртывании APIXO.
Текст / Изображение / Видео / Аудио
Ввод
Текст в видео / Изображение в видео / Референс
Рабочие процессы
768P / 2K
Разрешение
5–15 секунд
Длительность
Нативное стерео
Аудио
6 соотношений + адаптивное
Кадрирование
MiniMax H3 работает через асинхронную конечную точку задач APIXO. Отправьте запрос на generateTask и опрашивайте statusTask или укажите URL для обратного вызова (webhook).
Доступны три режима: «текст в видео», «изображение в видео» и «видео по референсу». Режим «изображение в видео» принимает 1-2 изображения в качестве первого и опционально последнего кадра; для режима «видео по референсу» требуется как минимум одно референсное изображение или видео.
Выходное видео в разрешении 768p или 2K, длительностью 5-15 секунд (только целые значения). Разрешение определяет тариф за секунду. Промпты ограничены 4000 символами. Референсное видео и аудио ограничены 3 файлами каждое, длительностью 2-15 секунд на файл и не более 15 секунд в сумме.
«MiniMax H3» — это ID модели в APIXO. Не переносите значения параметров, уровни качества или модель биллинга из Hailuo 2.3 или Hailuo 2.3 Fast — это отдельные маршруты с другими условиями.
Референсы направляют генерацию, но не гарантируют точное сохранение идентичности, типографики, логотипов, материалов или геометрии продукта.
Перед выпуском проверяйте анатомию, кисти рук, контакт с объектами, быстрое движение, окклюзию, переходы камеры, речь и аудиовизуальную синхронизацию.
Да. Модель доступна через асинхронную конечную точку APIXO и может быть вызвана с тем же API-ключом, что и любая другая модель в каталоге. Генерация также доступна в Playground на этой странице.
«Текст в видео», «изображение в видео» и «видео по референсу». Режим «видео по референсу» принимает до 9 изображений, 3 видео и 3 аудиофайлов в качестве комбинированного творческого контекста; аудио не может быть предоставлено отдельно.
Выходное видео в разрешении 768p или 2K длительностью от 5 до 15 секунд (только целые значения). 2K — разрешение по умолчанию и максимальное, доступное для этой конечной точки; 768p тарифицируется по более низкой ставке за секунду. Соотношение сторон можно установить на 21:9, 16:9, 4:3, 1:1, 3:4 или 9:16 для генерации из текста и по референсу; в режиме «изображение в видео» кадрирование определяется по первому предоставленному кадру.
Стоимость выходного видео во всех режимах рассчитывается за секунду по тарифу, соответствующему выбранному разрешению — 768p стоит дешевле за секунду, чем 2K. В режиме генерации по референсу фактическая длительность ваших референсных видео тарифицируется по той же ставке за секунду, при этом первые 5 референсных изображений бесплатны, а каждое последующее оплачивается отдельно. Референсное аудио не тарифицируется. Актуальные тарифы смотрите на вкладке «Цены».
Да. Аудио генерируется в нативном стереоформате одновременно с изображением, при этом речь, звуковые эффекты, эмбиент и музыка моделируются совместно, а не как отдельные дорожки.
Нет. Мультимедийные референсы передают творческий замысел, но не гарантируют точное сохранение идентичности, движения, голоса, структуры продукта или покадрового воспроизведения. Использование в продакшене требует визуальной и звуковой проверки.
Откройте для себя больше AI-моделей для вашего следующего творческого процесса