Non. Seedance 1.5 Pro est le modèle de génération audio-vidéo conjointe de ByteDance datant de décembre 2025. APIXO expose ses flux de travail par prompt et par images clés séparément de Seedance 2.0, Seedance 2.0 Fast et de leurs capacités de référence plus larges.
Seedance 1.5 Pro sur APIXO correspond au modèle audio-vidéo conjoint public de ByteDance Seed. Il crée de courtes vidéos à partir de texte ou d'une à deux images clés, avec un son synchronisé en option, un contrôle de durée de 4 à 12 secondes et un comportement de caméra sélectionnable. La route se concentre sur la génération directe plutôt que sur les flux de travail de référence multimodaux plus larges de Seedance 2.0.
Workflows
Texte / Image vers Vidéo
Prix APIXO
$0.0108-$0.1044 / s
Résolution
480p / 720p / 1080p
Durée
4 à 12 secondes
Publié le
16 décembre 2025
Créer avec Seedance 1.5 Pro
Chargement de l'espace de travail...
Coordonnez la performance, le son, la caméra et l'intention narrative
Génération audio-vidéo conjointe
Générez le mouvement visuel et le son ensemble afin que les voix, le timing des performances, l'ambiance et les effets spatiaux puissent répondre à la même description de scène. APIXO permet également une sortie silencieuse.
Alignement Audio-Visuel
Coordonnez les mouvements des lèvres, l'intonation vocale, le rythme de l'action et le son ambiant plus étroitement qu'un pipeline de vidéo et de doublage séparé, tout en laissant une marge pour les erreurs de synchronisation génératives.
Gamme de langues et de dialectes
ByteDance documente la prise en charge de plusieurs langues et dialectes régionaux, y compris leur prosodie vocale et leur rendu émotionnel. La prononciation et la synchronisation doivent être vérifiées pour chaque langue de production.
Cinématographie dirigée
Interprétez les instructions de caméra et de mise en scène pour les gros plans, les mouvements continus, les travellings compensés, les transitions de scène, l'éclairage et le traitement des couleurs dans une courte séquence générée.
Coordination narrative
Connectez le dialogue, l'expression, l'action du personnage et le développement du plan autour de l'intention narrative du prompt, permettant des scènes courtes plus cohérentes que la génération de mouvements isolés.
Animation pilotée par l'image
Animez une image de départ fournie ou guidez une transition entre des images de début et de fin définies tout en conservant la composition et l'apparence de la source lorsque la génération le permet.
Générez librement à partir d'un texte ou animez des images clés contrôlées
Génération de texte vers vidéo
Soumettez un prompt de 3 à 2 500 caractères décrivant la scène, l'action, la direction de la caméra, l'éclairage et les indices audio. Sélectionnez la durée, la résolution, le cadrage, le son et le comportement de la caméra pour créer un nouveau clip sans image d'entrée.
Génération image vers vidéo
Fournissez une URL d'image publique comme image de départ ou deux URL comme images de début et de fin ordonnées. Ajoutez un prompt obligatoire pour diriger le mouvement, la transition, le traitement de la caméra et la bande sonore générée optionnelle entre ces points d'ancrage visuels.
Contrôles de génération vérifiés
Les options de production exposées par l'API Seedance 1.5 Pro actuelle d'APIXO.
3–2 500 caractères
Longueur du prompt
1–2 URL
Images en entrée
Début / Fin
Rôles de trame
6 formats + auto
Formats d'image
Activé / Désactivé
Son généré
Activé / Désactivé
Caméra fixe
Créez de courtes scènes audiovisuelles à partir de briefs et d'images clés
Moments de produit avec son
Transformez un brief de campagne ou une image de produit approuvée en une courte vidéo de présentation avec des mouvements, une ambiance et des effets coordonnés. Utilisez le mode caméra fixe pour des compositions maîtrisées et inspectez la forme du produit, les étiquettes, les matériaux et le texte intégré avant publication.
Performances basées sur le dialogue
Créez des scènes concises de présentateur, de personnage ou dramatiques où la diction, l'expression faciale et le mouvement du corps partagent un seul prompt. Examinez l'identité du locuteur, la prononciation, le mouvement de la bouche, les mains et la synchronisation émotionnelle plutôt que de considérer la synchronisation comme garantie.
Planifier des plans pilotés par caméra
Explorez les plans continus, le recadrage, les mouvements de type travelling et les transitions avant de vous engager dans une production en prise de vues réelle ou en animation. Les images de début et de fin fournissent des repères visuels utiles pour les transitions et le développement du storyboard.
Produire des clips narratifs compacts
Générez des scènes de 4 à 12 secondes pour les flux verticaux, les placements en écran large, les teasers ou les concepts épisodiques. Le son natif peut créer une atmosphère et un rythme de performance sans nécessiter une étape de génération de bande-son séparée.
Limites opérationnelles pour Seedance 1.5 Pro
Notes d'implémentation
APIXO expose uniquement les modes texte vers vidéo et image vers vidéo ; aucun mode d'entrée vidéo, d'extension, de montage, de référence de mouvement ou de référence multi-images n'est documenté.
La génération image vers vidéo nécessite une ou deux URL ; avec deux images, la première est l'image de début et la seconde est l'image de fin.
APIXO accepte toutes les durées entières de 4 à 12 secondes.
L'option de son permet de choisir entre une sortie avec audio généré conjointement ou une sortie silencieuse ; elle ne préserve pas l'audio source car ce point de terminaison n'accepte ni vidéo ni audio en entrée.
Le traitement typique via APIXO varie d'environ 40 à 60 secondes pour un clip de 4 secondes à 90 à 120 secondes pour un clip de 12 secondes ; la latence réelle varie.
Les images de référence doivent utiliser des URL publiques au format JPG, PNG ou WebP et restent soumises aux contrôles de sécurité en amont.
Foire Aux Questions
ByteDance documente diverses voix et des effets sonores spatiaux coordonnés avec les visuels. Ses démonstrations incluent également la performance vocale et le son ambiant, mais APIXO expose uniquement une option pour activer ou désactiver le son, plutôt que des contrôles séparés pour le dialogue, la musique, l'ambiance ou les effets.
APIXO facture chaque seconde générée en fonction de la résolution et du paramètre audio. En 480p, une sortie sans son coûte $0.0108 par seconde et une sortie avec son coûte $0.0216. En 720p, les tarifs sont de $0.0234 et $0.0468. En 1080p, les tarifs sont de $0.0522 et $0.1044 par seconde.
Oui. Fournissez les URL de deux images en mode image vers vidéo : la première devient l'image de départ et la seconde l'image de fin. Une seule image agira comme l'image de départ.
Vérifiez l'anatomie, les mains, la stabilité de l'identité, le contact avec les objets, le texte incrusté, les transitions, la prononciation, la synchronisation labiale et l'interprétation du locuteur. Les scènes plus longues ou changeant rapidement peuvent nécessiter un affinement du prompt ou plusieurs générations.
Explorer d'autres modèles
Découvrez d'autres modèles d'IA pour votre prochain workflow créatif