APIXO는 두 가지 MiniMax Speech 2.8 티어를 제공합니다: Speech Turbo를 통한 speech-2.8-turbo와 Speech HD를 통한 speech-2.8-hd입니다. 이 라우트에는 Speech 2.6, Speech-02, Speech-01 또는 별도의 MiniMax Voice 워크플로우가 포함되지 않습니다.
MiniMax Speech 2.8
MiniMax Speech 2.8은 Speech 2.8 HD 및 Turbo 등급으로 출시된 MiniMax의 표현력이 풍부한 텍스트 음성 변환 생성 모델입니다. 개발자는 APIXO를 통해 사전 설정되거나 이전에 생성된 커스텀 음성 ID, 네이티브 사운드 태그, 감정 표현, 발음 재정의, 그리고 속도 및 출력 인코딩을 위한 프로덕션 제어 기능을 사용하여 다국어 오디오를 합성할 수 있습니다.
APIXO 모드
Speech Turbo / HD
가격
$0.06 / 1000자
언어
40
형식
MP3 / WAV / PCM / FLAC
출시일
2026년 1월 23일
MiniMax Speech 2.8(으)로 만들기
작업 공간 로딩 중...
표현력 있는 전달을 위해 구축된 음성 제어 기능
네이티브 사운드 태그
Speech 2.8은 숨소리, 웃음, 기침, 한숨, 목 가다듬기 등 모델링된 감탄사와 발성 이벤트를 도입합니다. 이러한 신호들은 쓰여진 대화가 균일하게 다듬어진 전달 방식 대신 대화의 불완전함을 포함하도록 돕습니다.
감성 연기
APIXO는 기쁨, 슬픔, 분노, 두려움, 혐오, 놀람, 중립의 7가지 감정 방향을 제공합니다. 감정은 선택된 음성 및 스크립트와 함께 작동하므로, 팀은 전체 구절에 걸쳐 일관성을 평가해야 합니다.
더 깨끗한 음성 출력
MiniMax는 Speech 2.8을 배경 소음을 줄이고 인공적인 오디오 아티팩트를 최소화하는 데 중점을 두고 있습니다. HD 등급은 저렴한 Turbo 가격보다 내레이션의 선명도가 더 중요할 때 고품질 오디오를 제공하기 위한 것입니다.
교차 언어 합성
이 모델 제품군은 문서화된 40개 언어에 걸쳐 음성 합성을 지원합니다. APIXO의 언어 부스트 설정은 광둥어 및 다양한 유럽 및 아시아 언어를 포함하여 명시적인 발음 및 운율 힌트를 제공합니다.
유연한 음성 선택
문서화된 MiniMax 사전 설정 음성 ID를 사용하거나 MiniMax Voice를 통해 미리 생성된 재사용 가능한 커스텀 음성 ID를 전달하세요. 이 합성 경로는 해당 ID를 사용하지만, 음성 자체를 생성하거나 복제하지는 않습니다.
발음 재정의
APIXO는 특정 발음이 필요한 용어를 위한 발음 사전을 제공합니다. 이는 자동 발음에만 의존해서는 안 되는 제품명, 약어, 흔하지 않은 이름 및 전문 용어에 유용합니다.
더 빠른 반복 또는 더 높은 충실도의 음성 선택
효율적인 반복 작업을 위한 Speech 2.8 Turbo
APIXO는 Speech Turbo를 MiniMax의 speech-2.8-turbo 등급에 매핑합니다. 이는 미리보기, 자주 변경되는 스크립트, 애플리케이션 메시지 및 HD 요금 없이 표현력 있는 합성이 필요한 워크플로우를 위한 기본 저비용 옵션입니다.
최종 결과물을 위한 Speech 2.8 HD
h1Xyew
APIXO에서의 Speech 2.8 출력 제어
현재 공개 경로에 대한 검증된 합성 및 인코딩 옵션입니다.
10,000자
텍스트 제한
프리셋 / 커스텀 ID
음성 소스
0.5–2.0
속도
8 / 16 / 22.05 / 24 / 32 / 44.1KHZ
샘플 레이트
32 / 64 / 128 / 256KBPS
비트레이트
모노 / 스테레오
채널
MiniMax Speech 2.8 프로덕션 워크플로우
가이드형 앱 경험
테스트된 사전 설정 또는 맞춤형 음성 ID를 사용하여 온보딩 내레이션, 어시스턴트 응답, 도움말 프롬프트 및 음성 알림을 생성하세요. Turbo는 빠른 스크립트 반복 작업을 지원하며, 발음 재정의 기능은 제품 용어의 일관성을 유지하는 데 도움이 됩니다.
내레이션 및 오디오북
챕터, 기사, 설명, 팟캐스트 스크립트를 제어된 내레이션으로 변환하세요. 긴 작업물은 검토된 섹션으로 나누어 전체 프로덕션에 걸쳐 속도, 발음, 감정, 음성 캐릭터를 적절하게 유지할 수 있습니다.
다국어 캠페인 오디오
명시적인 언어 힌트를 사용하여 현지화된 광고, 강의, 제품 둘러보기, 디지털 발표자 트랙을 합성하세요. 출시 전 원어민과 함께 이름, 코드 스위칭 구절, 지역 발음, 감정적 어조를 검토하세요.
캐릭터 및 게임 대화
캐릭터 대사, 분기형 대화, 교육 시나리오 또는 접근성 내레이션에 사운드 태그와 감정 제어를 적용하세요. 맞춤형 음성 ID는 승인된 소스 자료로 별도 생성된 반복 등장 캐릭터를 지원할 수 있습니다.
Speech 2.8 요구 사항 및 음성 경계
중요 참고사항
APIXO는 quality 모드, 유효한 voice ID, 그리고 비어있지 않은 합성 텍스트를 요구합니다. 공백 처리 후 프롬프트 길이는 10,000자로 제한됩니다.
커스텀 음성 생성은 별도의 MiniMax Voice 라우트에 속합니다. 이 엔드포인트는 기존의 커스텀 음성 ID만 허용합니다.
APIXO 문서에 따르면 일반적인 처리 시간은 5-30초이지만, 지연 시간은 텍스트 길이, 티어, 대기열 부하 및 라우트 상태에 따라 달라집니다.
공개 라우트는 참조 오디오, 음성 대 음성 변환, 실시간 스트리밍, 자막 또는 타임스탬프 정렬 기능을 제공하지 않습니다.
발음, 코드 스위칭, 감정, 화자 특성은 개별 샘플 라인이 아닌 전체 구절에 걸쳐 검토해야 합니다.
기술적으로 유효한 커스텀 보이스 ID가 해당 음성에 대한 동의나 상업적 권리를 보장하는 것은 아닙니다.
숨소리, 웃음소리, 한숨과 같은 표현적인 사운드 태그를 프롬프트 텍스트에 삽입하여 더 자연스러운 대화를 만들 수 있습니다.
기술적으로 유효한 사용자 지정 voice_id라 하더라도 해당 음성에 대한 동의나 상업적 권리가 보장되는 것은 아닙니다.
자주 묻는 질문
아니요. 호환되는 커스텀 음성 ID로 음성을 합성할 수는 있지만, 참조 오디오를 받거나 해당 ID를 생성하지는 않습니다. 먼저 별도의 MiniMax 음성 워크플로우를 사용한 다음, 그 결과로 얻은 승인된 음성 ID를 Speech 2.8에 전달하세요.
APIXO는 최종 오디오 길이가 아닌 제출된 텍스트를 기준으로 요금을 청구합니다. Speech Turbo는 프롬프트 1,000자당 $0.06가, Speech HD는 프롬프트 1,000자당 $0.10가 청구됩니다.
APIXO는 기쁨, 슬픔, 분노, 두려움, 혐오, 놀람, 중립 감정을 제공합니다. 결과는 음성, 표현, 구두점, 사운드 태그, 구절 길이에 따라 달라지므로, 선택된 감정이 특정 연기를 보장하는 것으로 간주해서는 안 됩니다.
공개 APIXO 라우트는 생성된 오디오 전달에 대해 문서화하지만, 문장 타임스탬프, 단어 타임스탬프, 음소 정렬 또는 자막 제어 기능은 제공하지 않습니다. 동기화된 캡션이 필요한 애플리케이션은 별도의 정렬 또는 스크립트 변환 단계를 추가해야 합니다.
다른 모델 살펴보기
다음 크리에이티브 워크플로우에 필요한 더 많은 AI 모델을 만나보세요
