APIXO
Vidéo audiovisuelleTexte ou ImageSon optionnel

Le modèle Kling Video 2.6 de Kuaishou génère une courte vidéo et, en option, un son synchronisé en un seul passage. Via APIXO, les développeurs peuvent créer à partir d'un texte ou d'une image de départ, ajouter une image de fin optionnelle, choisir une durée de cinq ou dix secondes, et opter pour une génération silencieuse ou avec dialogue, effets, ambiance et musique.

Workflows APIXO

Texte vers vidéo / Image vers vidéo

Prix silencieux

À partir de $0.30 / vidéo5 secondes sans son

Avec Son

À partir de $0.60 / vidéo5 secondes avec audio généré

Durée

5 ou 10 secondes

Publié le

3 déc. 2025

Créer avec Kling 2.6

Chargement de l'espace de travail...

Son et mouvement simultanés

Générez la scène visuelle et sa bande-son en une seule passe

Kling Video 2.6 remplace le flux de travail "vidéo silencieuse puis doublage" par une génération audiovisuelle simultanée. Décrivez par prompt le dialogue, la narration, le chant, la musique, les effets sonores ou l'ambiance en même temps que la scène, ou désactivez le son via APIXO lorsqu'un pipeline audio de postproduction distinct est préférable.

Capacités

L'audio répond à la scène, ce n'est pas une piste isolée

Génération audiovisuelle simultanée

Kling Video 2.6 génère les visuels et le son au cours du même passage du modèle. Cela permet une coordination plus étroite entre l'action visible, le rythme vocal, les événements environnementaux et la synchronisation de la bande sonore qui en résulte.

Plusieurs types de sons

Dirigez la parole, le dialogue, la narration, le chant, le rap, la musique, le son ambiant et les effets, de manière autonome ou combinée, dans le prompt. Le sélecteur de son d'APIXO détermine si la sortie demandée inclut l'audio généré.

Voix chinoises et anglaises

Kling Video 2.6 prend en charge les scènes dialoguées impliquant plusieurs personnages, y compris des interviews, des échanges scénarisés et de courtes performances. L'attribution des locuteurs, la prononciation et la synchronisation doivent tout de même être vérifiées avant publication.

Alignement sonore sémantique

Le modèle interprète les descriptions textuelles, les expressions familières et les scénarios de courtes histoires pour coordonner le son avec les événements visuels. Décrivez explicitement qui parle, ce qui se passe et quand chaque son doit se produire.

Scènes sonores multi-couches

Combinez la voix avec l'ambiance environnante et des effets spécifiques à un événement au lieu de produire un seul son isolé. Cela permet de créer des scènes compactes où l'atmosphère, l'action et le contenu parlé contribuent tous au résultat.

Option de flux de travail silencieux

Grâce au workflow image vers vidéo d'APIXO, une image établit la composition de départ et une seconde image optionnelle peut guider l'image finale souhaitée. Le modèle génère le mouvement intermédiaire plutôt que d'effectuer une interpolation déterministe.

Modes APIXO

Générez librement ou ancrez la composition d'ouverture

Texte vers vidéo

Générez à partir d'un prompt requis sans images sources. APIXO expose les formats d'image 1:1, 9:16 et 16:9 pour ce flux de travail, prenant en charge les scènes audiovisuelles carrées, verticales et paysage.

Scène pilotée par prompt

Image vers vidéo

Fournissez une image comme image de départ et, optionnellement, une seconde image comme image de fin. APIXO ne transmet pas la sélection du format d'image dans ce mode, préparez donc les images sources pour la composition souhaitée.

Début + Fin optionnelle
Spécifications de production

Contrôles de Kling 2.6 via APIXO

Le point de terminaison APIXO expose des contrôles audio optionnels sans sélecteur de niveau de qualité distinct.

1–1 000 caractères

Longueur du prompt

Jusqu'à 500 caractères

Prompt négatif

1 à 2 URL d'images

Entrée image

JPG / PNG / WebP

Formats source

0–1

Échelle CFG

URL de la vidéo MP4

Résultat APIXO

Utilisations en production

Créez des histoires compactes avec un son coordonné

Publicité

Vidéos de produit avec narration

Générez des démonstrations de produits avec narration, son ambiant et effets spécifiques à l'action en une seule passe. Utilisez un flux de travail basé sur une image lorsqu'une composition de produit approuvée doit ancrer le plan, puis vérifiez les étiquettes, la géométrie, la parole et les affirmations.

Contenu pour les réseaux sociaux

Clips de dialogue et de performance

Créez des interviews, de courts échanges scénarisés, des concepts comiques, des performances de chant ou de rap. Kling Video 2.6 prend en charge le dialogue généré, mais l'attribution des locuteurs, la prononciation, le timing et la synchronisation labiale doivent être vérifiés avant publication.

Développement de scénarios

Prototypes de scènes sensibles au son

Prototypez l'interaction entre le mouvement de la caméra, l'action physique, le dialogue, l'ambiance et les effets au sein d'une scène de cinq ou dix secondes. Cela aide les équipes à évaluer l'idée audiovisuelle complète avant une production ou une postproduction séparées.

Transitions Visuelles

Animation d'image cadrée

Animez une image approuvée ou orientez le clip vers une image de fin optionnelle. Ajoutez du son lorsque la transition nécessite une atmosphère ou des effets synchronisés, ou générez silencieusement pour un flux de travail audio existant.

Notes d'intégration

Commandes documentées distinctes des fonctionnalités ultérieures de Kling

Contraintes APIXO

01

APIXO expose une variante de Kling 2.6 plutôt que des niveaux de qualité Standard, Pro, Master ou Turbo.

02

Chaque requête nécessite un prompt, une durée de 5 ou 10 secondes et une valeur sonore explicite.

03

Le mode texte vers vidéo accepte la sélection du format d'image ; le mode image vers vidéo déduit la composition de son image source.

04

L'image vers vidéo accepte une image de départ et une image de fin optionnelle.

05

La route n'expose pas l'entrée vidéo, le contrôle de mouvement, l'extension, l'édition ou la génération multi-références arbitraire.

06

APIXO prend en charge le polling de statut ou la livraison par webhook ; les clips plus longs avec audio généré nécessitent généralement plus de temps de traitement ; la livraison par callback est préférable pour les charges de travail en production.

Questions sur Kling 2.6

APIXO mappe cette route vers Kling Video 2.6 de Kuaishou et n'expose pas de sélecteur de niveau de qualité Standard, Pro, Master ou Turbo.

La sortie silencieuse coûte $0.06 par seconde générée : $0.30 pour cinq secondes ou $0.60 pour dix. Avec l'audio généré par le modèle, le tarif est de $0.12 par seconde : $0.60 ou $1.20 respectivement.

Oui. Kuaishou supporte officiellement la parole, le dialogue, la narration, le chant et le rap, ainsi que les effets et l'ambiance. Le modèle génère des voix en chinois et en anglais, et APIXO expose cette capacité via le commutateur de son requis et le prompt.

Non. APIXO n'expose pas de champs de téléversement audio ou d'entrée vidéo pour ce point de terminaison. Kling 2.6 génère le son demandé à partir du prompt ; il n'accepte pas de voix préenregistrée, de bande sonore, de clip de mouvement ou de vidéo source ici.

Vérifiez l'identité, l'anatomie, les mains, le texte incrusté, le contact des objets, les mouvements rapides, les transitions, la précision des dialogues, l'attribution des locuteurs, la prononciation et la synchronisation audio. Les scènes avec plusieurs personnages et les indications sonores denses peuvent nécessiter plusieurs générations.

Explorer d'autres modèles

Découvrez d'autres modèles d'IA pour votre prochain workflow créatif