APIXO asigna esta ruta a Kling Video 2.6 de Kuaishou y no expone un selector de nivel de calidad Standard, Pro, Master o Turbo.
Kling Video 2.6 de Kuaishou genera vídeos cortos y audio sincronizado opcional en una sola pasada. A través de APIXO, los desarrolladores pueden crear a partir de texto o una imagen inicial, añadir un fotograma final opcional, seleccionar una duración de cinco o diez segundos y elegir entre generación silenciosa o con voz, efectos, ambiente y música.
Flujos de trabajo de APIXO
Texto a vídeo / Imagen a vídeo
Precio silencioso
Desde $0.30 / vídeo5 segundos sin sonido
Con sonido
Desde $0.60 / vídeo5 segundos con audio generado
Duración
5 o 10 segundos
Lanzado
3 de dic. de 2025
Crear con Kling 2.6
Cargando espacio de trabajo...
El audio responde a la escena, no es una pista aislada
Generación audiovisual simultánea
Kling Video 2.6 genera las imágenes y el sonido en la misma pasada del modelo. Esto permite una coordinación más estrecha entre la acción visible, el ritmo vocal, los eventos ambientales y la sincronización de la banda sonora resultante.
Múltiples tipos de sonido
Dirija el habla, el diálogo, la narración, el canto, el rap, la música, el sonido ambiental y los efectos de forma independiente o combinada en el prompt. El interruptor de sonido de APIXO determina si la salida solicitada incluye audio generado.
Voces en chino e inglés
Kling Video 2.6 admite escenas con diálogos que involucran a múltiples personajes, como entrevistas, intercambios guionizados y actuaciones cortas. La atribución del hablante, la pronunciación y la sincronización aún deben revisarse antes de publicar.
Alineación semántica del sonido
El modelo interpreta descripciones textuales, expresiones coloquiales y escenarios de historias cortas para coordinar el sonido con los eventos visuales. Describa explícitamente quién habla, qué sucede y cuándo debe ocurrir cada sonido.
Escenas de audio por capas
Combine la voz con el ambiente del entorno y efectos específicos de eventos en lugar de producir un único sonido aislado. Esto permite crear escenas compactas donde la atmósfera, la acción y el contenido hablado contribuyen al resultado.
Opción de flujo de trabajo silencioso
A través del flujo de trabajo de imagen a vídeo de APIXO, una imagen establece la composición inicial y una segunda imagen opcional puede guiar el fotograma final deseado. El modelo genera el movimiento intermedio en lugar de realizar una interpolación determinista.
Genere libremente o ancle la composición inicial
Texto a vídeo
Genere a partir de un prompt obligatorio sin imágenes de origen. APIXO expone relaciones de aspecto de 1:1, 9:16 y 16:9 para este flujo de trabajo, admitiendo escenas audiovisuales cuadradas, verticales y horizontales.
Imagen a vídeo
Proporcione una imagen como fotograma inicial y, opcionalmente, una segunda imagen como fotograma final. APIXO no transmite la selección de relación de aspecto en este modo, así que prepare las imágenes de origen para la composición deseada.
Controles de Kling 2.6 a través de APIXO
La ruta de APIXO expone controles de audio opcionales sin un selector de nivel de calidad separado.
1–1000 caracteres
Longitud del prompt
Hasta 500 caracteres
Prompt negativo
1–2 URL de imagen
Entrada de imagen
JPG / PNG / WebP
Formatos de origen
0–1
Escala CFG
URL de vídeo MP4
Resultado de APIXO
Cree historias compactas con sonido coordinado
Vídeos de producto con narración
Genere demostraciones de productos con narración, sonido ambiental y efectos específicos de la acción en una sola pasada. Utilice un flujo de trabajo basado en imágenes cuando una composición de producto aprobada deba anclar la toma, y luego verifique las etiquetas, la geometría, el habla y las afirmaciones.
Clips de diálogo e interpretación
Cree entrevistas, breves intercambios guionizados, conceptos de comedia, actuaciones de canto o rap. Kling Video 2.6 admite diálogos generados, pero la atribución de los hablantes, la pronunciación, la sincronización y la sincronización labial deben revisarse antes de publicar.
Prototipos de escenas con reconocimiento de sonido
Prototipa cómo interactúan el movimiento de la cámara, la acción física, el diálogo, el ambiente y los efectos dentro de una escena de cinco o diez segundos. Esto ayuda a los equipos a evaluar la idea audiovisual completa antes de la producción o postproducción por separado.
Animación de imagen enmarcada
Anime una imagen aprobada o guíe el clip hacia un fotograma final opcional. Agregue sonido cuando la transición necesite una atmósfera o efectos sincronizados, o genere en silencio para un flujo de trabajo de audio existente.
Controles documentados separados de futuras características de Kling
Restricciones de APIXO
APIXO expone una variante de Kling 2.6 en lugar de los niveles de calidad Standard, Pro, Master o Turbo.
Cada solicitud requiere un prompt, una duración de 5 o 10 segundos y un valor de sonido explícito.
La conversión de texto a vídeo acepta la selección de relación de aspecto; la de imagen a vídeo deriva la composición de su imagen de origen.
La función de imagen a vídeo acepta una imagen de inicio y una imagen de fotograma final opcional.
La ruta no expone la entrada de vídeo, el control de movimiento, la extensión, la edición ni la generación arbitraria de múltiples referencias.
APIXO admite la consulta de estado o la entrega por webhook; los clips más largos con audio generado suelen requerir más tiempo de procesamiento; la entrega por callback es preferible para cargas de trabajo de producción.
Preguntas sobre Kling 2.6
La salida silenciosa cuesta $0.06 por segundo generado: $0.30 por cinco segundos o $0.60 por diez. Con el audio generado por el modelo habilitado, la tarifa es de $0.12 por segundo: $0.60 o $1.20 respectivamente.
Sí. Kuaishou soporta oficialmente el habla, el diálogo, la narración, el canto y el rap, además de efectos y sonido ambiente. El modelo genera voces en chino e inglés, y APIXO expone esta capacidad a través del interruptor de sonido requerido y el prompt.
No. APIXO no expone campos de carga de audio ni de entrada de vídeo para esta ruta. Kling 2.6 genera el sonido solicitado a partir del prompt; no acepta una voz pregrabada, banda sonora, clip de movimiento o vídeo de origen aquí.
Verifique la identidad, anatomía, manos, texto incrustado, contacto de objetos, movimiento rápido, transiciones, precisión de los diálogos, asignación de hablantes, pronunciación y sincronización de audio. Las escenas con múltiples personajes y las indicaciones de sonido densas pueden requerir varias generaciones.
Explorar otros modelos
Descubra más modelos de IA para su próximo flujo de trabajo creativo