Oui. APIXO désigne et tarifie cet itinéraire comme Kling 3.0 Standard. Il est distinct de Kling 3.0 Turbo et Video 3.0 Omni, donc leur vitesse, leurs fonctionnalités de référence, leurs contrôles d'édition et leur tarification ne doivent pas être appliqués ici.
Kling Video 3.0 Standard de Kuaishou combine la génération texte vers vidéo, l'animation d'image et le transfert de mouvement de personnage sur APIXO. Il étend les clips générés à 15 secondes, prend en charge l'audio natif facultatif et ajoute des prompts par plan pour un meilleur contrôle narratif, tandis que le contrôle de mouvement associe une image de personnage à une vidéo de performance de référence.
Modes APIXO
Générer / Animer / Transférer
Prix silencieux
$0.084/secModes texte et image sans son généré
Prix du son généré
$0.13/secModes texte et image avec audio généré
Durée de la génération
3–15 secondes
Publié le
5 fév 2026
Créer avec Kling 3.0 Std
Chargement de l'espace de travail...
Meilleur contrôle sur la narration et la continuité
Durée de scène étendue
Kling Video 3.0 étend la génération native à 15 secondes, offrant plus d'espace pour les actions, les dialogues, les changements de caméra et le développement de scènes que le maximum de dix secondes de Kling Video 2.6.
Narration à plusieurs plans
Kuaishou a conçu Video 3.0 pour interpréter des instructions multi-scènes et multi-plans, y compris les changements d'angles de caméra, les dialogues en champ-contrechamp, le montage alterné et la voix off. APIXO expose des segments de prompt chronométrés facultatifs pour la génération à partir de texte et d'image.
Cohérence des éléments renforcée
L'amélioration de la cohérence aide les personnages, objets, environnements et éléments de marque à rester plus uniformes d'une image à l'autre. Les mouvements complexes et les séquences plus longues peuvent encore introduire une dérive visuelle et nécessiter une vérification.
Audio natif multilingue
Upstream Video 3.0 prend en charge la parole générée en anglais, chinois, japonais, coréen et espagnol, ainsi que les accents anglais et les dialectes chinois. APIXO expose l'audio généré via le contrôle du son pour les modes basés sur le texte et l'image.
Meilleure préservation du texte
Kuaishou signale une meilleure rétention et génération du texte visible comme les enseignes, les légendes, les logos et les vêtements de marque. L'orthographe et l'emplacement exacts doivent tout de même être vérifiés avant toute utilisation commerciale.
Performance photoréaliste
Video 3.0 améliore le rendu photoréaliste pour des personnages expressifs et des performances dynamiques. Des prompts détaillés peuvent coordonner le comportement du sujet, la direction de la caméra, la progression de la scène et le son au sein d'une même séquence générée.
Générez une nouvelle scène ou transférez un mouvement existant
Génération de texte et d'image
Créez à partir d'un prompt ou animez une à deux images pendant 3 à 15 secondes. Choisissez un son généré ou une sortie silencieuse, et divisez éventuellement le clip en segments de prompts chronométrés pour une direction au niveau du plan.
Contrôle de mouvement de personnage
Combinez exactement une image de personnage avec une vidéo de mouvement de référence. Choisissez si l'orientation suit l'image ou la vidéo ; la durée provient du clip de référence, et le paramètre de son détermine si son audio d'origine est conservé.
Kling 3.0 Standard sur APIXO
Contrôles spécifiques au workflow pour la génération et le transfert de mouvement.
1:1 / 9:16 / 16:9
Formats d'image Texte-vers-Vidéo
1 à 2 images
Image vers vidéo
1 image + 1 vidéo
Contrôle du mouvement
Jusqu'à 30 secondes
Référence de mouvement
JPG / JPEG / PNG
Formats d'image
1 URL MP4
Sortie APIXO
Développez des histoires, des performances et des contenus animés de marque
Prototypes de scènes multi-plans
Structurez un clip généré plus long avec des segments de prompt synchronisés pour les plans d'ensemble, les gros plans, les réactions et les transitions. Utilisez le résultat pour tester le rythme narratif, les changements de caméra, la fluidité des dialogues et la logique de la scène avant la production.
Transfert de performance de référence
Appliquez le mouvement d'une courte vidéo de référence à l'image d'un personnage pour des études de performance, des tests de chorégraphie ou une animation stylisée. Sélectionnez l'orientation selon que la direction du corps doit suivre l'image source ou la séquence de mouvement.
Campagnes audiovisuelles de marque
Créez des présentations de produits, des publicités narrées et de courtes campagnes sociales avec voix, musique, ambiance et effets natifs en option. Vérifiez la géométrie du produit, le texte visible, les logos, le phrasé vocal et la synchronisation avant de publier.
Concepts de conversation multilingue
Prototypez des conversations, des interviews et des scènes multilingues en utilisant les capacités vocales natives de Kling Video 3.0. Spécifiez clairement chaque locuteur, langue, ordre, ton et action, puis vérifiez l'attribution, la prononciation, le mouvement des lèvres et la continuité.
Appliquer les règles de son et de durée correctes
Contraintes APIXO
Le texte vers vidéo et l'image vers vidéo acceptent une durée de 3 à 15 secondes ; le contrôle de mouvement ignore ce champ.
L'image vers vidéo accepte une image de départ et une seconde image facultative qui peut guider l'image finale.
Le contrôle de mouvement nécessite exactement une image de personnage et une vidéo de référence publique ne dépassant pas 30 secondes.
La sélection du format d'image s'applique uniquement à la génération de vidéo par APIXO.
APIXO n'expose ici aucun mode distinct pour l'audio importé, l'extension vidéo, le montage vidéo ou les multi-références arbitraires.
Les intégrations de production peuvent récupérer des résultats asynchrones par interrogation (polling) ou via un rappel (callback) HTTPS public.
Questions sur Kling 3.0 Standard
Le texte vers vidéo et l'image vers vidéo coûtent $0.084 par seconde générée sans son activé, ou $0.13 par seconde avec son activé. Leur durée facturable est la valeur sélectionnée entre 3 et 15 secondes.
APIXO facture le contrôle de mouvement à $0.13 par seconde de vidéo de référence détectée, avec un minimum de trois secondes facturables. Le champ de durée soumis est ignoré, et les vidéos de référence de plus de 30 secondes sont rejetées.
Pour le texte vers vidéo et l'image vers vidéo, sound: true demande un audio généré par le modèle et false produit un résultat silencieux. Dans le contrôle de mouvement, ce même champ détermine si l'audio original de la vidéo de référence est conservé plutôt que de demander un audio nouvellement généré.
Vérifiez l'identité, l'anatomie, les mains, le contact avec les objets, le texte intégré, la logique de transition, les mouvements rapides, l'attribution du locuteur, la précision des dialogues, la prononciation et la synchronisation labiale. Les scènes plus longues ou à plusieurs plans créent davantage d'opportunités de dérive temporelle et de personnage.
Explorer d'autres modèles
Découvrez d'autres modèles d'IA pour votre prochain workflow créatif