デザインモードでは、記述的な説明とプレビュースクリプトからオリジナルのカスタム音声を作成します。一方、クローンモードでは、1つの参照録音から音声を派生させます。両モードは必要な入力が異なりますが、どちらも再利用可能なMiniMaxの音声IDを返します。
MiniMax Voice
APIXO上のMiniMax Voiceは、テキスト記述による「ボイスデザイン」と、単一クリップによる「ボイスクローン」という2つの異なるワークフローを通じて、再利用可能なカスタムボイスIDを作成します。デザインには必須の音声プレビューが含まれ、クローンではプレビューテキストが提供された場合にプレビュー音声を返すことができます。生成されたボイスIDは、別のMiniMax Speech 2.8ルートを通じて、その後のテキスト読み上げ生成に再利用できます。
APIXOモード
デザイン / クローン
価格
$0.50 / リクエスト
結果
再利用可能な音声ID
クローン入力
1つの音声URL
利用可能性
APIXOで利用可能
MiniMax Voiceで作成
ワークスペースを読み込み中...
再利用可能なMiniMaxボイスを作成する2つの方法
テキスト記述による音声デザイン
ソース音声を提供せずに、希望するアクセント、見た目の年齢、トーン、ペース、エネルギー、意図する用途を記述します。MiniMaxはカスタム音声を生成し、提供されたプレビューテキストを読み上げるため、結果を評価できます。
シングルクリップ音声クローン
クローンモードは、公開されているただ一つの参照音声URLから、再利用可能な音声アイデンティティを生成します。この録音は、変換や吹き替えの対象となる音声コンテンツとしてではなく、話者のソースとして機能します。
再利用可能な音声アセット
どちらのワークフローも、完成した音声ファイルだけでなくMiniMaxの音声IDを返します。このIDは、繰り返し登場するナレーターやキャラクターが必要な場合に、互換性のある後続の合成リクエストで保存および選択できます。
合成前のプレビュー
ボイスデザインでは、生成された音声を評価するためにプレビューテキストが必須で、音声が返されます。クローンモードでも、オプションのプレビューテキストを提供することでプレビュー音声を生成でき、チームは広範な合成利用の前に結果を確認できます。
クローンクリーンアップ制御
APIXOは、クローン参照用のオプションとしてノイズリダクションと音量正規化の機能を提供しています。これらのコントロールは、許可された録音に音量レベルのばらつきや対処可能な背景ノイズが含まれている場合に、ソースの準備を改善することができます。
認識ガイダンス
クローンモードには、言語ヒントと調整可能な精度制御が含まれます。ヒントは参照音声の認識を補助し、精度によってアプリケーションはAPIXOがサポートする範囲内で要求されるクローニング動作を調整できます。
オリジナルボイスをデザイン、または許諾された話者をクローン
書面での概要からの音声デザイン
音声の説明、プレビュー用のテキスト、有効な識別子プレフィックスを提供してください。このモードは、実在する話者の録音を必要とせず、要求された特性から音声を生成するため、架空のキャラクターやブランドナレーターに適しています。
1つの録音からの音声クローン
複製する権限を持つ話者のMP3、M4A、またはWAV形式の公開URLを1つ提供してください。オプションのクリーンアップ、音声認識、精度コントロール機能でソースを準備した後、APIXOは再利用可能なクローンボイスIDを返します。検証用の音声サンプルが必要な場合は、オプションのプレビューテキストを提供してください。
APIXOでのMiniMax Voice入力
各モードには個別の要件があり、独立して実装する必要があります。
説明+プレビュー
デザイン入力
1~500文字
デザインプレビュー
URLは1つのみ
クローン入力
MP3 / M4A / WAV
クローンフォーマット
0–1
クローンの精度
英字で開始・6文字以上
ボイスIDプレフィックス
本番システム向けの再利用可能な音声を構築
オリジナルブランドナレーター
温かみ、権威、ペース、年齢、アクセントなどの特性に基づいて音声をデザインし、代表的なプレビューで検証します。生成されたIDは、実在の個人をコピーすることなく、プロダクトツアー、解説、キャンペーンのナレーションの土台として使用できます。
ライセンス許諾済み話者ワークフロー
適切な同意と利用規約の下で提供されたクリーンな録音から、再利用可能な音声を作成します。これにより、ソースの許諾を明確に保ちつつ、承認されたナレーターや演者をローカライズされた脚本や定期的なコンテンツにわたって活用できます。
キャラクターボイスの再利用
ゲームキャラクター、学習コンパニオン、デジタルプレゼンター、または架空のアシスタントのために、それぞれ異なる音声を生成します。返された識別子をキャラクターのメタデータと一緒に保存し、新しい対話が必要になるたびに別の合成ルートを使用します。
一貫した読み上げ音声
教材、インターフェースガイダンス、またはアクセシブルな読書体験のために、親しみやすいカスタム音声を作成します。特にスクリプトの言語が変更されたり、専門用語が含まれたりする場合は、下流の合成で発音や感情表現を確認してください。
音声の作成、有効化、権利
重要事項
MiniMax Voiceは再利用可能な音声アセットを作成します。最終的なテキスト読み上げナレーションの制御機能は公開していません。
デザインモードには、音声の説明、プレビューテキスト、および有効な音声IDプレフィックスが必要です。
クローンモードでは、公開アクセス可能なMP3、M4A、またはWAV形式の参照URLが1つだけ必要です。
新規に生成された音声が、その後の合成に一度も使用されなかった場合、7日後に利用できなくなる可能性があります。
APIXOは、作成から約10秒後にステータスチェックを開始することを推奨しますが、実際の処理時間は異なる場合があります。
処理および複製する権限を持つ音声のみをクローンしてください。作成が成功したとしても、同意や商業的権利が確立されるわけではありません。
よくある質問
いいえ。このルートは再利用可能な音声アセットを作成し、プレビューするものです。完全なナレーション、対話、またはアプリケーションの音声を合成する必要がある場合は、その音声IDをAPIXOの別のMiniMax Speech 2.8ルートに渡してください。
APIXOは、承認されたボイスデザインまたはボイスクローンの作成リクエスト1件につき$0.50を課金します。その後のテキスト読み上げ生成は別の操作となり、選択したMiniMax Speech 2.8ティアの文字数ベースの料金体系に従います。
一人の話者に焦点を当てた、明瞭で権限のある録音を使用してください。音楽、重なった声、長い無音、強い反響、クリッピング、過度な背景ノイズは、ファイルが技術的に受理された場合でも、利用可能な話者信号を弱める可能性があります。
クローンモードは、サポートされている音声認識コンテキストに対して言語のヒントを提供します。互換性のあるMiniMaxの合成モデルは、言語間でカスタムボイスIDを再利用できる場合があります。アクセント、発音、アイデンティティ、感情的な特徴は変化する可能性があるため、多言語での使用結果には話者を意識したレビューが必要です。
他のモデルを見る
次のクリエイティブワークフローのために、さらに多くのAIモデルを発見しましょう
