La conception crée une voix personnalisée originale à partir d'une description écrite et d'un script d'aperçu. Le clonage, lui, dérive une voix à partir d'un seul enregistrement de référence. Les deux modes ont des entrées requises différentes, mais retournent tous deux un ID de voix MiniMax réutilisable.
MiniMax Voice sur APIXO crée des identifiants de voix personnalisés et réutilisables via deux flux de travail distincts : la Création de Voix par description textuelle (Voice Design) et le Clonage de Voix à partir d'un seul extrait (Voice Clone). La Création inclut un aperçu vocal obligatoire, tandis que le Clonage peut retourner un aperçu audio si un texte d'aperçu est fourni. L'identifiant de voix obtenu peut être réutilisé pour des générations ultérieures par synthèse vocale via le point de terminaison distinct MiniMax Speech 2.8.
Modes APIXO
Conception / Clonage
Prix
$0.50 / requête
Résultat
ID de Voix Réutilisable
Entrée pour le clone
Une URL audio
Disponibilité
Disponible sur APIXO
Créer avec MiniMax Voice
Chargement de l'espace de travail...
Deux approches pour une voix MiniMax réutilisable
Conception de Voix Décrite par Texte
Décrivez l'accent, l'âge apparent, le ton, le rythme, l'énergie et l'utilisation prévue sans fournir d'audio source. MiniMax génère une voix personnalisée et lit le texte d'aperçu fourni afin que le résultat puisse être évalué.
Clonage vocal à partir d'un seul clip
Le mode de clonage dérive une identité vocale réutilisable à partir d'une seule URL publique d'un fichier audio de référence. L'enregistrement sert de source pour le locuteur plutôt que de contenu vocal pour la conversion ou le doublage.
Ressource vocale réutilisable
Les deux flux de travail retournent un identifiant de voix MiniMax au lieu d'un simple fichier audio final. Cet identifiant peut être stocké et sélectionné dans les requêtes de synthèse vocale compatibles en aval lorsqu'un narrateur ou un personnage récurrent est nécessaire.
Aperçu avant la synthèse
La Création de Voix (Voice Design) nécessite un texte d'aperçu et retourne un fichier audio pour évaluer la voix générée. Le mode Clonage peut également produire un aperçu audio lorsqu'un texte d'aperçu optionnel est fourni, permettant aux équipes de valider le résultat avant une utilisation plus large pour la synthèse.
Contrôles de nettoyage du clone
APIXO expose une réduction de bruit et une normalisation du volume optionnelles pour les références de clonage. Ces contrôles peuvent améliorer la préparation de la source lorsqu'un enregistrement autorisé contient un niveau sonore incohérent ou un bruit de fond gérable.
Aide à la reconnaissance
Le mode clone inclut un indice de langue et un contrôle de précision ajustable. L'indice aide à la reconnaissance de la parole de référence, tandis que la précision permet aux applications d'ajuster le comportement de clonage demandé dans la plage prise en charge par APIXO.
Concevez une voix originale ou clonez un locuteur autorisé
Conception vocale à partir d'un brief écrit
Fournissez une description de voix, un texte d'aperçu et un préfixe d'identifiant valide. Ce mode est adapté aux personnages de fiction et aux narrateurs de marque car il crée une voix à partir des caractéristiques demandées sans nécessiter l'enregistrement d'un vrai locuteur.
Clonage de voix à partir d'un seul enregistrement
Fournissez une URL publique d'un fichier MP3, M4A ou WAV d'un locuteur que vous êtes autorisé à reproduire. Des contrôles optionnels de nettoyage, de reconnaissance et de précision préparent la source avant qu'APIXO ne retourne l'identifiant de voix clonée réutilisable. Fournissez un texte d'aperçu optionnel lorsqu'un échantillon audio est nécessaire pour la validation.
Entrées vocales MiniMax sur APIXO
Chaque mode a des exigences distinctes et doit être implémenté indépendamment.
Description + Aperçu
Entrée de design
1–500 caractères
Aperçu du design
Une seule URL exactement
Entrée pour le clone
MP3 / M4A / WAV
Formats de clone
0–1
Précision du clonage
Lettre en premier · 6+ car.
Préfixe de l'ID de voix
Créez des Voix Réutilisables pour les Systèmes de Production
Narrateurs de marque originaux
Concevez une voix autour de traits tels que la chaleur, l'autorité, le rythme, l'âge et l'accent, puis validez-la avec un aperçu représentatif. L'ID résultant peut servir de base pour des visites de produits, des explications et la narration de campagnes sans copier une personne réelle.
Workflows de locuteurs sous licence
Créez une voix réutilisable à partir d'un enregistrement clair fourni avec le consentement et les conditions d'utilisation appropriés. Cela peut étendre l'utilisation d'un narrateur ou d'un acteur approuvé à des scripts localisés et à du contenu récurrent tout en maintenant l'autorisation de la source explicite.
Voix de personnages récurrents
Générez des voix distinctes pour des personnages de jeu, des compagnons d'apprentissage, des présentateurs numériques ou des assistants fictifs. Stockez les identifiants retournés avec les métadonnées des personnages, puis utilisez la route de synthèse séparée chaque fois qu'un nouveau dialogue est requis.
Voix de lecture cohérentes
Établissez une voix personnalisée familière pour le matériel éducatif, le guidage d'interface ou les expériences de lecture accessible. Vérifiez la prononciation et la transmission des émotions dans la synthèse en aval, en particulier lorsque les scripts changent de langue ou contiennent une terminologie spécialisée.
Création, activation et droits de la voix
Remarques importantes
MiniMax Voice crée des ressources vocales réutilisables ; il n'expose pas les contrôles finaux de narration par synthèse vocale.
Le mode de conception nécessite une description de la voix, un texte d'aperçu et un préfixe d'ID de voix valide.
Le mode de clonage requiert exactement une URL de référence publique au format MP3, M4A ou WAV.
Une voix nouvellement créée qui n'est jamais utilisée pour une synthèse ultérieure peut devenir indisponible après sept jours.
APIXO recommande de commencer la vérification du statut environ dix secondes après la création, mais le temps de traitement réel peut varier.
Ne clonez que les voix que vous êtes autorisé à traiter et à reproduire ; la réussite de la création n'établit pas le consentement ou les droits commerciaux.
Foire Aux Questions
Non. Cette route crée et prévisualise une ressource vocale réutilisable. Transmettez son ID de voix à la route distincte MiniMax Speech 2.8 d'APIXO lorsque vous avez besoin de synthétiser une narration complète, un dialogue ou une parole d'application.
APIXO facture $0.50 pour chaque demande de Création de Voix (Voice Design) ou de Clonage de Voix (Voice Clone) acceptée. La génération ultérieure par synthèse vocale est une opération distincte et suit la tarification par caractère du niveau MiniMax Speech 2.8 sélectionné.
Utilisez un enregistrement clair et autorisé, centré sur un seul locuteur. La musique, les voix superposées, les longs silences, un écho prononcé, la saturation (clipping) et un bruit de fond important peuvent affaiblir le signal vocal utilisable, même si le fichier est techniquement accepté.
Le mode Clonage fournit des indications de langue pour les contextes de reconnaissance pris en charge, et les modèles de synthèse MiniMax compatibles peuvent réutiliser les identifiants de voix personnalisés entre les langues. L'accent, la prononciation, l'identité et le caractère émotionnel peuvent varier, les résultats multilingues nécessitent donc une vérification attentive.
Explorer d'autres modèles
Découvrez d'autres modèles d'IA pour votre prochain workflow créatif
