APIXO mappe cette route vers Kling Video 2.6 de Kuaishou et n'expose pas de sélecteur de niveau de qualité Standard, Pro, Master ou Turbo.
Le modèle Kling Video 2.6 de Kuaishou génère une courte vidéo et, en option, un son synchronisé en un seul passage. Via APIXO, les développeurs peuvent créer à partir d'un texte ou d'une image de départ, ajouter une image de fin optionnelle, choisir une durée de cinq ou dix secondes, et opter pour une génération silencieuse ou avec dialogue, effets, ambiance et musique.
Workflows APIXO
Texte vers vidéo / Image vers vidéo
Prix silencieux
À partir de $0.30 / vidéo5 secondes sans son
Avec Son
À partir de $0.60 / vidéo5 secondes avec audio généré
Durée
5 ou 10 secondes
Publié le
3 déc. 2025
Créer avec Kling 2.6
Chargement de l'espace de travail...
L'audio répond à la scène, ce n'est pas une piste isolée
Génération audiovisuelle simultanée
Kling Video 2.6 génère les visuels et le son au cours du même passage du modèle. Cela permet une coordination plus étroite entre l'action visible, le rythme vocal, les événements environnementaux et la synchronisation de la bande sonore qui en résulte.
Plusieurs types de sons
Dirigez la parole, le dialogue, la narration, le chant, le rap, la musique, le son ambiant et les effets, de manière autonome ou combinée, dans le prompt. Le sélecteur de son d'APIXO détermine si la sortie demandée inclut l'audio généré.
Voix chinoises et anglaises
Kling Video 2.6 prend en charge les scènes dialoguées impliquant plusieurs personnages, y compris des interviews, des échanges scénarisés et de courtes performances. L'attribution des locuteurs, la prononciation et la synchronisation doivent tout de même être vérifiées avant publication.
Alignement sonore sémantique
Le modèle interprète les descriptions textuelles, les expressions familières et les scénarios de courtes histoires pour coordonner le son avec les événements visuels. Décrivez explicitement qui parle, ce qui se passe et quand chaque son doit se produire.
Scènes sonores multi-couches
Combinez la voix avec l'ambiance environnante et des effets spécifiques à un événement au lieu de produire un seul son isolé. Cela permet de créer des scènes compactes où l'atmosphère, l'action et le contenu parlé contribuent tous au résultat.
Option de flux de travail silencieux
Grâce au workflow image vers vidéo d'APIXO, une image établit la composition de départ et une seconde image optionnelle peut guider l'image finale souhaitée. Le modèle génère le mouvement intermédiaire plutôt que d'effectuer une interpolation déterministe.
Générez librement ou ancrez la composition d'ouverture
Texte vers vidéo
Générez à partir d'un prompt requis sans images sources. APIXO expose les formats d'image 1:1, 9:16 et 16:9 pour ce flux de travail, prenant en charge les scènes audiovisuelles carrées, verticales et paysage.
Image vers vidéo
Fournissez une image comme image de départ et, optionnellement, une seconde image comme image de fin. APIXO ne transmet pas la sélection du format d'image dans ce mode, préparez donc les images sources pour la composition souhaitée.
Contrôles de Kling 2.6 via APIXO
Le point de terminaison APIXO expose des contrôles audio optionnels sans sélecteur de niveau de qualité distinct.
1–1 000 caractères
Longueur du prompt
Jusqu'à 500 caractères
Prompt négatif
1 à 2 URL d'images
Entrée image
JPG / PNG / WebP
Formats source
0–1
Échelle CFG
URL de la vidéo MP4
Résultat APIXO
Créez des histoires compactes avec un son coordonné
Vidéos de produit avec narration
Générez des démonstrations de produits avec narration, son ambiant et effets spécifiques à l'action en une seule passe. Utilisez un flux de travail basé sur une image lorsqu'une composition de produit approuvée doit ancrer le plan, puis vérifiez les étiquettes, la géométrie, la parole et les affirmations.
Clips de dialogue et de performance
Créez des interviews, de courts échanges scénarisés, des concepts comiques, des performances de chant ou de rap. Kling Video 2.6 prend en charge le dialogue généré, mais l'attribution des locuteurs, la prononciation, le timing et la synchronisation labiale doivent être vérifiés avant publication.
Prototypes de scènes sensibles au son
Prototypez l'interaction entre le mouvement de la caméra, l'action physique, le dialogue, l'ambiance et les effets au sein d'une scène de cinq ou dix secondes. Cela aide les équipes à évaluer l'idée audiovisuelle complète avant une production ou une postproduction séparées.
Animation d'image cadrée
Animez une image approuvée ou orientez le clip vers une image de fin optionnelle. Ajoutez du son lorsque la transition nécessite une atmosphère ou des effets synchronisés, ou générez silencieusement pour un flux de travail audio existant.
Commandes documentées distinctes des fonctionnalités ultérieures de Kling
Contraintes APIXO
APIXO expose une variante de Kling 2.6 plutôt que des niveaux de qualité Standard, Pro, Master ou Turbo.
Chaque requête nécessite un prompt, une durée de 5 ou 10 secondes et une valeur sonore explicite.
Le mode texte vers vidéo accepte la sélection du format d'image ; le mode image vers vidéo déduit la composition de son image source.
L'image vers vidéo accepte une image de départ et une image de fin optionnelle.
La route n'expose pas l'entrée vidéo, le contrôle de mouvement, l'extension, l'édition ou la génération multi-références arbitraire.
APIXO prend en charge le polling de statut ou la livraison par webhook ; les clips plus longs avec audio généré nécessitent généralement plus de temps de traitement ; la livraison par callback est préférable pour les charges de travail en production.
Questions sur Kling 2.6
La sortie silencieuse coûte $0.06 par seconde générée : $0.30 pour cinq secondes ou $0.60 pour dix. Avec l'audio généré par le modèle, le tarif est de $0.12 par seconde : $0.60 ou $1.20 respectivement.
Oui. Kuaishou supporte officiellement la parole, le dialogue, la narration, le chant et le rap, ainsi que les effets et l'ambiance. Le modèle génère des voix en chinois et en anglais, et APIXO expose cette capacité via le commutateur de son requis et le prompt.
Non. APIXO n'expose pas de champs de téléversement audio ou d'entrée vidéo pour ce point de terminaison. Kling 2.6 génère le son demandé à partir du prompt ; il n'accepte pas de voix préenregistrée, de bande sonore, de clip de mouvement ou de vidéo source ici.
Vérifiez l'identité, l'anatomie, les mains, le texte incrusté, le contact des objets, les mouvements rapides, les transitions, la précision des dialogues, l'attribution des locuteurs, la prononciation et la synchronisation audio. Les scènes avec plusieurs personnages et les indications sonores denses peuvent nécessiter plusieurs générations.
Explorer d'autres modèles
Découvrez d'autres modèles d'IA pour votre prochain workflow créatif