Il prend en charge text-to-video, image-to-video et reference-to-video. Les 3 modes proposent tous des sorties en 480p / 720p / 1080p.
Wan 3.0 Video LoRA
Wan 3.0 Video LoRA génère des vidéos à partir de texte, de premières et dernières images, ou d'un mélange de références image, vidéo et audio. Choisissez une sortie 480p, 720p, 1080p, définissez une durée de clip explicite ou laissez smart duration décider.
Modes
Texte / Image / Référence
Prix APIXO
À partir de $0.0525 / seconde
Durée
Intelligente ou 2–30 secondes
Types de référence
Image / Vidéo / Audio
Résolution
480p / 720p / 1080p
Créer avec Wan 3.0 Video LoRA
Chargement de l'espace de travail...
Une boîte à outils de référence pour les briefs créatifs guidés par LoRA
Trois canaux de référence
Guidez une requête reference-to-video avec des images, des vidéos ou de l'audio au lieu de condenser toutes les instructions dans le seul prompt.
Images de la première et de la dernière trame
Le mode image-to-video accepte jusqu'à 2 images — l'image de départ, plus une image de fin optionnelle. Le mode référence accepte jusqu'à 10 images.
Guidage par référence vidéo
Ajoutez jusqu'à 5 vidéos de référence de 1 à 15 secondes chacune, avec un maximum de 15 secondes de vidéo de référence au total. Leur durée réelle en secondes est facturée au tarif de la résolution sélectionnée.
Références audio sans supplément
Ajoutez jusqu'à 5 références audio de 1 à 15 secondes chacune en mode référence. Les références audio permettent d'orienter le brief sans ajouter de frais d'entrée audio supplémentaires.
Prompt facultatif hors du mode texte
Un prompt est requis uniquement pour le text-to-video. Les modes image-to-video et reference-to-video acceptent un prompt vide lorsque le média fourni contient déjà les instructions.
Durée intelligente
Activez Smart Duration lorsque le modèle doit déterminer la durée du résultat, ou choisissez un nombre entier de 2 à 30 secondes pour une durée de clip explicite.
Paramètres d'API publiés pour Wan 3.0 Video LoRA
3 modes de génération
Modes
480p / 720p / 1080p
Résolution
Intelligente ou 2–30 secondes
Durée
Jusqu'à 10 images
Références d'image
Jusqu'à 5 vidéos
Références vidéo
Activé par défaut
Son
Quand un contexte de référence plus riche améliore le brief de production
Développement de scène guidé par référence
Combinez des références d'images avec de courts clips vidéo pour communiquer les sujets, la direction visuelle et les indications de mouvement au sein d'une seule requête de référence vers vidéo.
Mouvement de la première à la dernière trame
Fournissez une image de début et une image de fin optionnelle lorsque le clip désiré doit passer entre deux états visuels connus.
Contexte de référence piloté par l'audio
Enrichissez un brief visuel avec des références audio lorsque le rythme, l'ambiance ou une piste vocale doivent influencer le clip généré.
Exploration créative à durée intelligente
Utilisez la durée intelligente lorsque la longueur du clip doit s'adapter au résultat généré, puis passez à une durée fixe de 2 à 30 secondes pour des passes de production contrôlées.
Guide des entrées et de la facturation de Wan 3.0 Video LoRA
Remarques
Un prompt est requis uniquement pour le text-to-video. Les modes image-to-video et reference-to-video acceptent un prompt vide.
La durée intelligente utilise -1. Le backend réserve initialement le coût de 30 secondes, puis ajuste la facturation sur la base de la durée réelle de la vidéo générée et rembourse la différence.
Les secondes de vidéo de référence sont facturées au même tarif de résolution que les secondes de sortie. L'audio de référence ne fait l'objet d'aucun frais d'entrée distinct.
Pour une durée positive fixe, la somme des secondes de sortie et des secondes totales des vidéos de référence ne peut pas dépasser 30 secondes.
Le son est activé par défaut et ne modifie pas le prix. Définissez le paramètre sound sur false lorsqu'une requête doit générer un clip muet.
Le mode Référence-vers-vidéo accepte jusqu'à 10 images, 5 vidéos et 5 fichiers audio. Chaque fichier vidéo ou audio de référence doit durer 1–15 secondes, avec au maximum 15 secondes par type de média.
Foire Aux Questions
Les secondes de vidéo générées sont facturées de $0.0525 à $0.21 par seconde, en fonction uniquement de la résolution de sortie — la grille tarifaire détaille chaque palier. Les 3 modes de génération partagent le même tarif ; le mode reference-to-video facture en plus la durée réelle en secondes des vidéos de référence utilisées.
Lorsque duration est -1, le backend réserve le coût de 30 secondes car la durée finale n'est pas encore connue. Une fois le résultat généré avec succès, la facturation est régularisée sur la base de la durée réelle et la différence est remboursée.
Le mode reference-to-video accepte les images, les vidéos et l'audio. Il prend en charge jusqu'à 10 images, 5 vidéos et 5 références audio, chaque fichier vidéo ou audio de référence durant de 1 à 15 secondes.
Non. Chaque seconde de vidéo de référence est facturée au tarif de la résolution sélectionnée, tandis que l'audio de référence ne génère aucun frais d'entrée supplémentaire.
Les deux modèles partagent les mêmes paramètres et modes. Ce modèle génère le format 480p, 720p, 1080p, tandis que le modèle Pro permet d'atteindre 1080p, 2K, 4K avec ses propres tarifs à la seconde.
Explorer d'autres modèles
Découvrez d'autres modèles d'IA pour votre prochain workflow créatif
