디자인 모드는 서면 설명과 미리보기 스크립트를 통해 독창적인 커스텀 음성을 생성합니다. 반면 복제 모드는 하나의 참조 녹음 파일에서 음성을 추출합니다. 두 모드는 필요한 입력값이 다르지만, 모두 재사용 가능한 MiniMax 음성 ID를 반환합니다.
MiniMax Voice
APIXO의 MiniMax Voice는 텍스트로 묘사하는 보이스 디자인과 단일 클립을 이용한 보이스 클론이라는 두 가지 워크플로우를 통해 재사용 가능한 커스텀 음성 ID를 생성합니다. 디자인에는 필수적인 음성 미리듣기가 포함되며, 클론은 미리듣기 텍스트를 제공하면 미리듣기 오디오를 반환할 수 있습니다. 생성된 음성 ID는 별도의 MiniMax Speech 2.8 경로를 통해 후속 텍스트 음성 변환 생성에 재사용할 수 있습니다.
APIXO 모드
디자인 / 복제
가격
요청당 $0.50
결과
재사용 가능한 음성 ID
복제 입력
오디오 URL 1개
사용 가능 기간
APIXO에서 라이브
MiniMax Voice(으)로 만들기
작업 공간 로딩 중...
재사용 가능한 MiniMax 음성 생성을 위한 두 가지 경로
텍스트로 설명하는 음성 디자인
소스 오디오 없이 원하는 억양, 외견상 나이, 톤, 속도, 에너지, 의도된 사용법을 설명하세요. MiniMax가 커스텀 음성을 생성하고 제공된 미리보기 텍스트를 읽어주어 결과를 평가할 수 있습니다.
단일 클립 음성 복제
복제 모드는 공개적으로 접근 가능한 단 하나의 참조 오디오 URL에서 재사용 가능한 음성 ID를 추출합니다. 이 녹음 파일은 변환이나 더빙을 위한 음성 콘텐츠가 아닌, 화자 소스로 사용됩니다.
재사용 가능한 음성 에셋
두 워크플로 모두 완성된 오디오 파일만 반환하는 대신 MiniMax 음성 ID를 반환합니다. 이 식별자는 반복적인 내레이터나 캐릭터가 필요할 때 호환되는 후속 합성 요청에서 저장하고 선택할 수 있습니다.
합성 전 미리보기
보이스 디자인은 미리듣기 텍스트가 필요하며, 생성된 음성을 평가하기 위한 오디오를 반환합니다. 클론 모드 역시 선택적 미리듣기 텍스트를 제공하면 미리듣기 오디오를 생성할 수 있어, 팀이 광범위한 합성에 사용하기 전에 결과를 검토할 수 있습니다.
복제 클린업 제어
APIXO는 복제 참조 파일에 대한 노이즈 감소 및 볼륨 정규화 옵션을 제공합니다. 이 기능들은 허가된 녹음 파일에 일관되지 않은 레벨이나 관리 가능한 수준의 배경 소음이 있을 때 소스 준비 과정을 개선할 수 있습니다.
인식 가이던스
복제 모드에는 언어 힌트와 조절 가능한 정확도 제어 기능이 포함됩니다. 힌트는 참조 음성 인식을 돕고, 정확도 제어는 APIXO가 지원하는 범위 내에서 요청된 복제 동작을 미세 조정할 수 있게 합니다.
독창적인 음성 디자인 또는 승인된 화자 복제하기
서면 브리핑을 통한 음성 디자인
음성 설명, 미리듣기용 텍스트, 유효한 식별자 접두사를 제공하세요. 이 모드는 실제 화자의 녹음 없이 요청된 특성으로 음성을 생성하므로, 가상 캐릭터나 브랜드 내레이터에 적합합니다.
단일 녹음으로 음성 복제
복제 권한이 있는 화자의 공개 MP3, M4A 또는 WAV URL 하나를 제공하세요. 선택적인 정리, 인식 및 정확도 제어 기능을 통해 소스를 준비한 후, APIXO가 재사용 가능한 복제된 음성 ID를 반환합니다. 검증을 위해 오디오 샘플이 필요한 경우 선택적으로 미리듣기 텍스트를 제공하세요.
APIXO의 MiniMax 음성 입력
각 모드는 요구사항이 다르므로 독립적으로 구현해야 합니다.
설명 + 미리보기
디자인 입력
1–500자
디자인 미리보기
정확히 하나의 URL
복제 입력
MP3 / M4A / WAV
복제 형식
0–1
복제 정확도
영문자 시작 · 6자 이상
음성 ID 접두사
프로덕션 시스템을 위한 재사용 가능한 음성 구축
오리지널 브랜드 내레이터
따뜻함, 권위, 속도, 나이, 억양과 같은 특성을 기반으로 음성을 디자인하고, 대표 미리보기로 검증하세요. 생성된 ID는 실제 개인의 음성을 복사하지 않고도 제품 둘러보기, 설명 영상, 캠페인 내레이션을 위한 기준 음성으로 사용할 수 있습니다.
라이선스 화자 워크플로우
적절한 동의 및 사용 조건 하에 제공된 깨끗한 녹음 파일로 재사용 가능한 음성을 생성하세요. 이를 통해 승인된 내레이터나 연기자를 현지화된 스크립트와 반복적인 콘텐츠에 걸쳐 활용하면서 소스 권한을 명시적으로 유지할 수 있습니다.
반복 등장 캐릭터 음성
게임 캐릭터, 학습 도우미, 디지털 발표자, 가상 어시스턴트를 위한 독특한 음성을 생성하세요. 반환된 ID를 캐릭터 메타데이터와 함께 저장한 후, 새로운 대화가 필요할 때마다 별도의 합성 라우트를 사용하세요.
일관된 낭독 음성
교육 자료, 인터페이스 가이드 또는 접근성을 위한 읽기 경험에 친숙한 커스텀 음성을 적용해 보세요. 특히 스크립트의 언어가 바뀌거나 전문 용어가 포함된 경우, 후속 음성 합성 단계에서 발음과 감정 표현을 검토하세요.
음성 생성, 활성화 및 권한
중요 참고사항
MiniMax Voice는 재사용 가능한 음성 에셋을 생성하며, 최종 텍스트 음성 변환(TTS) 내레이션 제어 기능은 제공하지 않습니다.
디자인 모드를 사용하려면 음성 설명, 미리보기 텍스트, 유효한 음성 ID 접두사가 필요합니다.
복제 모드는 공개적으로 접근 가능한 MP3, M4A, 또는 WAV 참조 URL이 정확히 하나 필요합니다.
새로 생성된 후 음성 합성에 사용되지 않은 음성은 7일 후에 사용할 수 없게 될 수 있습니다.
APIXO는 생성 요청 후 약 10초 뒤에 상태 확인을 시작할 것을 권장하지만, 실제 처리 시간은 다를 수 있습니다.
처리 및 복제 권한이 있는 음성만 복제하십시오. 생성 성공이 동의나 상업적 권리를 의미하지는 않습니다.
자주 묻는 질문
아니요. 해당 라우트는 재사용 가능한 음성 에셋을 생성하고 미리보는 기능입니다. 전체 내레이션, 대화 또는 애플리케이션 음성을 합성해야 할 경우, 생성된 음성 ID를 APIXO의 별도 MiniMax Speech 2.8 라우트에 전달하여 사용하세요.
APIXO는 승인된 보이스 디자인 또는 보이스 클론 생성 요청 건당 $0.50을 청구합니다. 이후의 텍스트 음성 변환 생성은 별도의 작업이며, 선택한 MiniMax Speech 2.8 티어의 문자 기반 요금제를 따릅니다.
한 명의 화자에 초점을 맞춘 선명하고 승인된 녹음 파일을 사용하세요. 파일이 기술적으로 승인되더라도 음악, 겹치는 목소리, 긴 침묵, 강한 울림, 클리핑, 심한 배경 소음은 사용 가능한 화자 신호를 약화시킬 수 있습니다.
클론 모드는 지원되는 음성 인식 컨텍스트에 대한 언어 힌트를 제공하며, 호환되는 MiniMax 음성 합성 모델은 여러 언어에 걸쳐 커스텀 음성 ID를 재사용할 수 있습니다. 억양, 발음, 정체성, 감정적 특성은 달라질 수 있으므로, 다른 언어에 대한 결과는 화자를 인지한 상태에서 검토해야 합니다.
다른 모델 살펴보기
다음 크리에이티브 워크플로우에 필요한 더 많은 AI 모델을 만나보세요
