El diseño crea una voz personalizada original a partir de una descripción escrita y un guion de vista previa. La clonación, en cambio, deriva una voz de una única grabación de referencia. Los dos modos tienen entradas requeridas diferentes, pero ambos devuelven un ID de voz reutilizable de MiniMax.
MiniMax Voice en APIXO crea ID de voz personalizados y reutilizables a través de dos flujos de trabajo distintos: diseño de voz descrito por texto (Voice Design) y clonación de voz a partir de un único clip (Voice Clone). El diseño incluye una vista previa de voz obligatoria, mientras que la clonación puede devolver un audio de vista previa si se proporciona texto para ello. El ID de voz resultante puede reutilizarse para la generación posterior de texto a voz a través de la ruta separada de MiniMax Speech 2.8.
Modos de APIXO
Diseñar / Clonar
Precio
$0.50 / solicitud
Resultado
ID de voz reutilizable
Entrada para clonación
Una URL de Audio
Disponibilidad
Disponible en APIXO
Crear con MiniMax Voice
Cargando espacio de trabajo...
Dos rutas para una voz reutilizable de MiniMax
Diseño de voz descrito por texto
Describa el acento, la edad aparente, el tono, el ritmo, la energía y el uso previsto sin proporcionar audio de origen. MiniMax genera una voz personalizada y lee el texto de vista previa proporcionado para que el resultado pueda ser evaluado.
Clonación de voz de un solo clip
El modo de clonación deriva una identidad de voz reutilizable a partir de una única URL de audio de referencia pública. La grabación actúa como la fuente del hablante en lugar de como contenido de voz para conversión o doblaje.
Activo de voz reutilizable
Ambos flujos de trabajo devuelven un ID de voz de MiniMax en lugar de solo un archivo de audio final. Ese identificador se puede almacenar y seleccionar en solicitudes de síntesis posteriores compatibles cuando se necesita un narrador o personaje recurrente.
Vista Previa Antes de la Síntesis
El diseño de voz requiere texto de vista previa y devuelve un audio para evaluar la voz generada. El modo de clonación también puede producir un audio de vista previa cuando se proporciona texto opcional, permitiendo a los equipos revisar el resultado antes de su uso en síntesis a mayor escala.
Controles de limpieza de clonación
APIXO expone la reducción de ruido y la normalización de volumen opcionales para las referencias de clonación. Estos controles pueden mejorar la preparación de la fuente cuando una grabación permitida contiene un nivel inconsistente o ruido de fondo manejable.
Guía de reconocimiento
El modo de clonación incluye una sugerencia de idioma y un control de precisión ajustable. La sugerencia ayuda al reconocimiento de la voz de referencia, mientras que la precisión permite a las aplicaciones ajustar el comportamiento de clonación solicitado dentro del rango admitido por APIXO.
Diseñe una voz original o clone un hablante autorizado
Diseño de voz a partir de una descripción escrita
Proporcione una descripción de la voz, un texto de vista previa y un prefijo de identificador válido. Este modo es adecuado para personajes de ficción y narradores de marca, ya que crea una voz a partir de los rasgos solicitados sin necesidad de la grabación de un hablante real.
Clonación de voz a partir de una grabación
Proporcione una URL pública de un archivo MP3, M4A o WAV de un hablante que usted tenga autorización para reproducir. Los controles opcionales de limpieza, reconocimiento y precisión preparan la fuente antes de que APIXO devuelva el ID de voz clonada reutilizable. Proporcione texto de vista previa opcional cuando se necesite una muestra de audio para su validación.
Entradas de voz de MiniMax en APIXO
Cada modo tiene requisitos distintos y debe implementarse de forma independiente.
Descripción + Vista previa
Entrada de diseño
1–500 caracteres
Vista previa del diseño
Exactamente una URL
Entrada para clonación
MP3 / M4A / WAV
Formatos de clonación
0–1
Precisión de la clonación
Inicia con letra · 6+ caract.
Prefijo de ID de voz
Cree voces reutilizables para sistemas de producción
Narradores de Marca Originales
Diseñe una voz a partir de rasgos como calidez, autoridad, ritmo, edad y acento, y luego valídela con una vista previa representativa. El ID resultante puede servir de base para guías de producto, vídeos explicativos y narraciones de campañas sin necesidad de copiar a una persona real.
Flujos de trabajo con locutores licenciados
Cree una voz reutilizable a partir de una grabación limpia proporcionada con el consentimiento y los términos de uso adecuados. Esto puede extender a un narrador o intérprete aprobado a través de guiones localizados y contenido recurrente, manteniendo explícita la autorización de la fuente.
Voces de personajes recurrentes
Genere voces distintas para personajes de videojuegos, compañeros de aprendizaje, presentadores digitales o asistentes ficticios. Almacene los identificadores devueltos con los metadatos del personaje y luego use la ruta de síntesis independiente cada vez que se requiera un nuevo diálogo.
Voces de lectura consistentes
Establezca una voz personalizada familiar para material educativo, guías de interfaz o experiencias de lectura accesible. Revise la pronunciación y la entonación emocional en la síntesis posterior, especialmente cuando los guiones cambien de idioma o contengan terminología especializada.
Creación, activación y derechos de voz
Notas Importantes
MiniMax Voice crea recursos de voz reutilizables; no expone los controles finales de narración de texto a voz.
El modo de diseño requiere una descripción de la voz, un texto de vista previa y un prefijo de ID de voz válido.
El modo de clonación requiere exactamente una URL de referencia pública en formato MP3, M4A o WAV.
Una voz recién creada que no se utilice para síntesis posteriores puede dejar de estar disponible después de siete días.
APIXO recomienda comenzar las comprobaciones de estado unos diez segundos después de la creación, pero el tiempo de procesamiento real puede variar.
Clone solo las voces que tenga autorización para procesar y reproducir; una creación exitosa no establece consentimiento ni derechos comerciales.
Preguntas frecuentes
No. Esta ruta crea y genera una vista previa de un recurso de voz reutilizable. Pase su ID de voz a la ruta independiente MiniMax Speech 2.8 de APIXO cuando necesite sintetizar narraciones completas, diálogos o locuciones para aplicaciones.
APIXO cobra $0.50 por cada solicitud aceptada de diseño (Voice Design) o clonación de voz (Voice Clone). La generación posterior de texto a voz es una operación separada y sigue el precio basado en caracteres del nivel seleccionado de MiniMax Speech 2.8.
Utilice una grabación clara y autorizada centrada en un solo hablante. La música, las voces superpuestas, los silencios prolongados, el eco fuerte, el recorte de audio (clipping) y el ruido de fondo intenso pueden debilitar la señal útil del hablante, incluso si el archivo se acepta técnicamente.
El modo de clonación proporciona sugerencias de idioma para los contextos de reconocimiento compatibles, y los modelos de síntesis de MiniMax compatibles pueden reutilizar los ID de voz personalizados en diferentes idiomas. El acento, la pronunciación, la identidad y el carácter emocional pueden variar, por lo que los resultados entre idiomas requieren una revisión consciente del hablante.
Explorar otros modelos
Descubra más modelos de IA para su próximo flujo de trabajo creativo
