네. 해당 모델은 APIXO 비동기 작업 엔드포인트에서 활성화되어 있으며, 카탈로그의 다른 모든 모델과 동일한 API 키로 호출할 수 있습니다. 이 페이지의 Playground에서도 생성이 가능합니다.
MiniMax H3는 텍스트, 이미지, 비디오, 오디오 컨텍스트를 하나의 생성 워크플로우에 결합한 범용 멀티모달 비디오 모델입니다. 네이티브 스테레오 사운드와 함께 최대 2K 해상도, 15초 길이의 비디오를 생성하며, 첫 프레임과 마지막 프레임 제어, 혼합 미디어 레퍼런스, 모션 트랜스퍼, 멀티샷 스토리텔링, 지침 기반 비디오 편집을 지원합니다.
입력
텍스트 / 이미지 / 비디오 / 오디오
APIXO 가격
$0.09–$0.13 / 초
해상도
768p / 2K
재생 시간
5-15초
오디오
네이티브 스테레오 사운드
작업 공간 로딩 중...
하나의 요청에 서면 디렉팅과 이미지, 비디오, 오디오 참조를 결합하고, 각 소스에 외형, 모션, 카메라, 음성, 리듬, 환경, 스타일 등의 역할을 할당하세요.
시작 프레임, 종료 프레임 또는 둘 다를 정의하여 변형, 전환, 제품 공개, 스토리보드 비트를 유도하면서 더 명확한 시각적 경로를 유지하세요.
레퍼런스 이미지, 비디오, 오디오를 함께 사용하여 캐릭터 정체성, 제품 단서, 움직임, 카메라 언어, 보컬 퍼포먼스, 음악 또는 분위기를 전달하세요.
생성 후 별도의 오디오 트랙을 조합하는 대신, 음성, 음향 효과, 앰비언스, 음악을 비디오와 함께 네이티브 스테레오 오디오로 생성합니다.
하나의 프롬프트 주도 또는 참조 기반 워크플로우를 통해 조화로운 샷 전환, 장면 진행, 액션 연속성, 시청각적 속도감을 갖춘 짧은 시퀀스를 제작하세요.
자연어 지시를 통해 기존 시각 자료를 변형하거나, 정체성, 구성, 가려짐, 소스 디테일의 충실도를 검토하면서 비디오 레퍼런스에서 모션을 이전하세요.
제품 이미지, 서면 디렉팅, 모션 참조, 사운드 의도를 결합하여 캠페인 컨셉을 개발하세요. 생성된 상업용 에셋을 승인하기 전에 라벨, 로고, 재질, 치수, 제품 형태를 검토하세요.
시각적 레퍼런스로 반복되는 피사체를 설정하고, 추가 미디어를 통해 움직임, 카메라 동작, 음성 또는 장면 컨텍스트를 유도합니다. 완성된 결과물 전체에 걸쳐 인물의 일관성, 신체 구조, 표정, 연기 타이밍을 평가하세요.
액션, 카메라 언어, 분위기, 시청각적 속도감을 결합한 짧은 장면으로 트리트먼트를 변환하세요. 생성된 영상을 사용하여 실제 제작이나 상세한 후반 작업에 들어가기 전에 아이디어를 평가할 수 있습니다.
자연어 지침과 선택적 레퍼런스를 통해 스타일, 환경, 피사체 또는 장면 변경을 시도하고, 시간적 경계, 가려짐(occlusion), 의도하지 않은 수정, 원본 디테일 보존 여부를 프레임 단위로 검토하세요.
실제 APIXO 배포 환경에서 확인되었습니다.
텍스트 / 이미지 / 비디오 / 오디오
입력
T2V / I2V / 레퍼런스
워크플로우
768p / 2K
해상도
5–15초
재생 시간
네이티브 스테레오
오디오
6가지 화면 비율 + 적응형
프레이밍
MiniMax H3는 APIXO 비동기 작업 엔드포인트에서 실행됩니다. generateTask에 제출하고 statusTask를 폴링하거나, 웹훅 전송을 위한 콜백 URL을 제공하세요.
텍스트 투 비디오, 이미지 투 비디오, 레퍼런스 투 비디오의 세 가지 모드를 제공합니다. 이미지 투 비디오는 1~2개의 이미지를 첫 프레임과 선택적 마지막 프레임으로 사용하며, 레퍼런스 투 비디오는 최소 하나 이상의 이미지 또는 비디오 참조가 필요합니다.
출력물은 768p 또는 2K 해상도로 5~15초 사이이며, 정수 초 단위로만 가능합니다. 해상도에 따라 초당 요금이 결정됩니다. 프롬프트는 4,000자로 제한됩니다. 레퍼런스 비디오와 오디오는 각각 최대 3개 파일, 파일당 2~15초, 총 15초로 제한됩니다.
“MiniMax H3”는 APIXO 모델 ID입니다. Hailuo 2.3 또는 Hailuo 2.3 Fast의 파라미터 값, 품질 등급 또는 과금 방식을 그대로 사용하지 마십시오. 이들은 별도의 계약을 가진 개별 경로입니다.
레퍼런스는 생성 과정을 안내하지만, 정확한 정체성, 타이포그래피, 로고, 재질 또는 제품 형태를 보장하지는 않습니다.
배포 전에 해부학적 구조, 손, 물체 접촉, 빠른 움직임, 가림 현상, 카메라 전환, 음성 및 시청각 동기화를 검토하십시오.
네. 해당 모델은 APIXO 비동기 작업 엔드포인트에서 활성화되어 있으며, 카탈로그의 다른 모든 모델과 동일한 API 키로 호출할 수 있습니다. 이 페이지의 Playground에서도 생성이 가능합니다.
텍스트 투 비디오, 이미지 투 비디오, 레퍼런스 투 비디오. 레퍼런스 투 비디오는 최대 9개의 이미지, 3개의 비디오, 3개의 오디오 파일을 창의적 컨텍스트로 조합하여 사용합니다. 오디오는 단독으로 사용할 수 없습니다.
768p 또는 2K 해상도로 5초에서 15초 사이의 동영상을 정수 단위로 출력합니다. 2K는 기본값이자 해당 라우트에서 제공하는 가장 높은 등급이며, 768p는 더 낮은 초당 요금으로 청구됩니다. 텍스트 투 비디오 및 레퍼런스 투 비디오의 경우 화면 비율을 21:9, 16:9, 4:3, 1:1, 3:4, 9:16으로 설정할 수 있습니다. 이미지 투 비디오는 제공된 첫 번째 프레임의 구도를 따릅니다.
출력 동영상은 모든 모드에서 선택한 해상도에 맞는 요율로 초당 과금됩니다. 768p가 2K보다 초당 비용이 저렴합니다. 레퍼런스 투 비디오의 경우, 레퍼런스 비디오의 실제 길이(초)가 동일한 초당 요율로 과금되며, 최초 5개의 레퍼런스 이미지는 무료이고 추가 이미지는 별도로 요금이 부과됩니다. 레퍼런스 오디오는 과금되지 않습니다. 현재 요금은 요금 탭에서 확인하세요.
네. 오디오는 네이티브 스테레오로 영상과 동일한 과정에서 생성되며, 음성, 음향 효과, 주변 소리, 음악이 별도의 트랙이 아닌 통합적으로 모델링됩니다.
혼합 미디어 레퍼런스는 창의적인 의도를 전달하지만, 정확한 정체성, 움직임, 음성, 제품 구조 또는 프레임 단위의 재현을 보장하지는 않습니다. 프로덕션 용도로 사용하려면 시각 및 오디오 검토가 필요합니다.
다음 크리에이티브 워크플로우에 필요한 더 많은 AI 모델을 만나보세요