APIXO
多模态视频原生立体声音频2K 分辨率生成

MiniMax H3 是一款通用多模态视频模型,在单一生成工作流中结合了文本、图像、视频和音频上下文。它能生成分辨率高达2K、时长15秒并带有原生立体声的视频,同时支持首尾帧控制、混合媒体参考、动作迁移、多镜头叙事以及指令引导的视频编辑。

输入

文本 / 图像 / 视频 / 音频

APIXO 价格

发布时公布

分辨率

768P / 2K

时长

4-15 秒

音频

原生立体声

使用 MiniMax H3 创作

即将推出

MiniMax H3 暂未开放生成

本页面在正式上线前开放。当 MiniMax H3 在 APIXO 上线时,创作控件、参数选项和定价信息将即刻在此页面显示——无需收藏其他网址。

统一多模态上下文

在单一工作流中,直接控制外观、动作、镜头、语音和音效

MiniMax H3 将文本、图像、视频和音频解析为一个互相关联的创意语境。您可以为每个参考素材分配明确的角色,以指导角色外观、产品细节、动作、镜头语言、语音、节奏、环境音或剪辑意图,而无需在多个不同的生成工具之间拆分创意。

能力

MiniMax H3 功能特性

统一上下文

在单个请求中结合书面指导以及图像、视频和音频参考。为每个参考源分配一个角色,如外观、动作、镜头、声音、节奏、环境或风格。

首尾帧

定义起始帧、结束帧或两者,以指导变换、过渡、产品展示和故事板节奏,同时保持更清晰的视觉轨迹。

混合媒体参考

结合使用参考图、视频和音频,以传达角色身份、产品特征、运动、镜头语言、人声表演、音乐或氛围。

原生立体声

将语音、音效、环境音和音乐与视频一同生成为原生立体声音频,而无需在生成后单独合成音轨。

原生多镜头

通过单个提示词引导或参考图指导的工作流,构建包含协调镜头切换、场景推进、动作连续性和视听节奏的短片序列。

编辑与动作迁移

通过自然语言指导转换现有视觉素材,或从视频参考中迁移运动,同时检查角色一致性、构图、遮挡和源细节的保真度。

应用场景

适用于 MiniMax H3 的应用场景

营销活动制作

视听产品故事

结合产品图像、书面指导、动态参考和声音意图来构思营销活动概念。在批准生成的商业资产前,请审查标签、标志、材质、尺寸和产品几何形状。

角色指导

参考引导的表现

使用视觉参考素材确立一个连贯的主体,然后通过额外的媒体内容指导其动作、镜头、语音或场景。在最终生成的完整结果中,评估主体一致性、身体结构、表情和表演节奏。

创意开发

叙事预演

将脚本大纲转化为结合了动作、镜头语言、氛围和音视频节奏的短场景。在投入实景拍摄或详细的后期制作之前,使用生成的素材来评估创意。

引导式修改

影像变换

通过自然语言指令和可选的参考素材,探索风格、环境、主体或场景的变化。逐帧检查时间边界、遮挡、意外修改以及源细节的保留情况。

规格

MiniMax H3 模型规格

已验证的上游能力,需与最终的 APIXO 部署进行确认。

文本 / 图像 / 视频 / 音频

输入

文生视频 / 图生视频 / 参考

工作流

768P / 2K

分辨率

4–15 秒

时长

原生立体

音频

6 种宽高比 + 自适应

构图

说明与常见问题

MiniMax H3 可用性与集成指南

备注

01

APIXO 尚未公开发布可用的 MiniMax H3 路由、模型 ID、模式枚举或交付协议。

02

在路由映射发布之前,请勿假定 “MiniMax H3” 和 “Hailuo 3.0” 是可互换的 APIXO 名称。

03

APIXO 的时长、分辨率、宽高比、参考图数量、提示词和媒体文件的限制尚未公布。

04

请勿直接套用 Hailuo 2.3 或 Hailuo 2.3 Fast 的参数值、质量等级、输出规则或计费行为。

05

参考可引导生成,但不能保证精确还原身份、字体、标志、材质或产品几何形状。

06

发布前请审核解剖结构、手部、物体接触、快速运动、遮挡、镜头过渡、语音和音画同步等细节。

常见问题解答

APIXO 尚未发布 MiniMax H3 模型页面或可用的 API 协议。在 APIXO 提供官方文档之前,路由可用性、身份验证路径、请求字段和交付行为等信息不应公开。

公开发布的资料描述了提示词引导视频、图像引导生成、多模态参考使用、音视频创作以及自然语言视频修订等功能。APIXO 可能仅开放这些工作流的一部分。

目前尚无经过验证的 APIXO 特定分辨率或时长值。上游演示、社区工作流或第三方托管平台展示的数值,不得作为 APIXO 的官方保证。

MiniMax H3 已被发布为一款具有音频感知生成能力的视听模型。APIXO 平台的特定音频输入、输出行为、声道配置、声音开关和文件限制等细节尚未公布。

否。混合媒体参考可传达创作意图,但不能保证精确还原身份、动作、声音、产品结构或实现帧级复刻。用于生产环境前,需要进行视觉和音频审核。

探索其他模型

探索更多 AI 模型,赋能您的创意工作流

hailuo

Hailuo 2.3

Hailuo 2.3 已在 APIXO 上线,支持 视频。该模型页面将示例、创作控件、定价和结果整合到一个专注的工作区中。

视频新建
$0.056/sec
hailuo

Hailuo 2.3 Fast

Hailuo 2.3 Fast 已在 APIXO 上线,支持 视频。该模型页面将示例、创作控件、定价和结果整合到一个专注的工作区中。

视频新建
$0.032/sec
Alibaba

HappyHorse

HappyHorse 已在 APIXO 上线,支持 视频。该模型页面将示例、创作控件、定价和结果整合到一个专注的工作区中。

视频新建
$0.125/sec
Google

Gemini Omni

Gemini Omni 已在 APIXO 上线,支持 视频。该模型页面将示例、创作控件、定价和结果整合到一个专注的工作区中。

视频新建
$0.1/sec
Alibaba

Wan 2.7

Wan 2.7 已在 APIXO 上线,支持 视频。该模型页面将示例、创作控件、定价和结果整合到一个专注的工作区中。

视频新建
$0.1/sec
Kuaishou

Kling 3.0 Std

Kling 3.0 Std 已在 APIXO 上线,支持 视频。该模型页面将示例、创作控件、定价和结果整合到一个专注的工作区中。

视频新建
$0.084/sec
ByteDance

Seedance 2.0

Seedance 2.0 已在 APIXO 上线,支持 视频。该模型页面将示例、创作控件、定价和结果整合到一个专注的工作区中。

视频新建
$0.0573/sec
ByteDance

Seedance 2.0 Fast

Seedance 2.0 Fast 已在 APIXO 上线,支持 视频。该模型页面将示例、创作控件、定价和结果整合到一个专注的工作区中。

视频新建
$0.044/sec