Fast est une route APIXO distincte avec ses propres modes exposés, résolutions, limites de référence et tarification. Les documents publics de ByteDance n'identifient pas d'architecture Fast distincte ni ne quantifient de différence de vitesse ou de qualité, ces comparaisons ne doivent donc pas être supposées.
Seedance 2.0 Fast est la route d'APIXO orientée vitesse pour Seedance 2.0 de ByteDance, et non une variante de modèle amont de ByteDance documentée séparément. Elle expose la génération par prompt, l'animation par première et dernière image, et les flux de travail de référence multimodaux avec son généré et recherche web en option, une sortie de 4 à 15 secondes, et une livraison en 480p ou 720p.
Modes APIXO
3 workflows
Prix APIXO
$0.044–$0.16 / s
Résolution
480p / 720p
Durée
4 à 15 secondes
Lancement de Seedance 2.0
12 février 2026
Créer avec Seedance 2.0 Fast
Chargement de l'espace de travail...
Dirigez le mouvement avec des prompts, des images clés et des références mixtes
Conditionnement multimodal
Combinez du texte avec des références d'images, de vidéos et audio afin qu'une génération puisse s'inspirer de la composition visuelle, du mouvement, du traitement de la caméra, des effets ou du contexte lié au son.
Mouvement contraint par images clés
Ancrez le mouvement sur une première image fournie ou dirigez une transition entre une première et une dernière image explicites sans les traiter comme des images de référence générales.
Cohérence par référence
Transférez des sujets, des environnements, un traitement visuel et des indices de mouvement reconnaissables dans une nouvelle séquence. La fidélité reste générative et peut s'affaiblir lorsque les références sont contradictoires.
Sortie audiovisuelle conjointe
Générez du son avec la vidéo afin que les événements audibles puissent suivre le rythme et l'action visuelle de la scène. APIXO permet également une sortie silencieuse via son contrôle du son.
Gestion des mouvements complexes
Seedance 2.0 améliore la précision physique et la stabilité dans les interactions multi-sujets et les scènes de mouvement exigeantes par rapport à Seedance 1.5 Pro.
Contrôle de la caméra et du scénario
Interprétez les prompts et les séquences de référence pour le mouvement de la caméra, l'éclairage, la performance, les transitions et la structure narrative multi-plans dans la durée de sortie sélectionnée.
Limites de production spécifiques au mode
Contrôles vérifiés disponibles via le point de terminaison Seedance 2.0 Fast.
3
Modes de génération
4 à 15 secondes
Durée de la sortie
6 formats + auto
Formats d'image
1–9 images
Entrées d'images Omni
1–3 vidéos
Références vidéo
1–3 fichiers audio
Références audio
Créez de courtes vidéos à partir de différents niveaux de direction créative
Exploration de scène par prompt
Convertissez un brief écrit en concepts courts horizontaux, verticaux, carrés ou ultra-larges avec son en option. Ce workflow est adapté au développement précoce de campagnes, aux alternatives de storyboard, aux pitchs visuels et à l'idéation de contenu social sans nécessiter de médias sources.
Animer les images clés approuvées
Animez une image fixe ou créez une transition entre une image de début et une image de fin fournies. Utilisez cette méthode pour les révélations de produits, les transitions de storyboard, les séquences de titres, les moments de personnage et les clips créatifs où les points de départ et d'arrivée sont essentiels.
Combiner les références de campagne
Fournissez des photos de produits, des images d'environnement, des séquences de mouvement et des indices audio optionnels pour diriger une publicité ou un concept de lancement. Examinez le branding, l'identité, la géométrie des objets, le contact et les conflits de référence avant l'utilisation en production.
Traduire le mouvement et le rythme
Utilisez une séquence vidéo et un audio de référence pour conditionner le langage de la caméra, le rythme de l'action, la cadence de la performance ou les effets visuels dans un nouveau clip généré. Ce point de terminaison ne documente pas l'édition directe de la vidéo source ni ne garantit la conservation de l'audio.
Choisissez le workflow avant d'assembler les médias sources
Chaque mode APIXO accepte une structure de référence différente et rejette les combinaisons non prises en charge.
Partir du texte ou d'images clés
Utilisez le texte-vers-vidéo lorsque le prompt doit définir l'ensemble de la scène. Choisissez les images de début et de fin lorsqu'une seule image doit établir le début, ou que deux images ordonnées doivent ancrer les deux extrémités du mouvement généré.
Assembler les Références Omni
Pour un conditionnement plus large, combinez jusqu'à neuf images, trois vidéos et trois fichiers audio. Chaque fichier vidéo ou audio doit durer entre 2 et 15 secondes, sans dépasser 15 secondes par catégorie de média de référence.
Configurer la sortie et la livraison
Sélectionnez 480p ou 720p, une durée entière de 4 à 15 secondes, le cadrage, le son généré et un contexte web optionnel. Soumettez la requête de manière asynchrone, puis récupérez le MP4 résultant par polling ou via un callback.
Identité de la route, facturation et contraintes de référence
Notes d'implémentation
ByteDance documente publiquement Seedance 2.0, mais aucun modèle ou ID de modèle Seedance 2.0 Fast distinct n'est publiquement identifié en amont.
Le mode "images de début et de fin" accepte une ou deux images ; la première est l'image de départ et la seconde, facultative, est l'image de fin.
La référence multiple accepte des médias mixtes, mais les requêtes audio uniquement sont rejetées ; au moins une image ou une vidéo de référence est requise.
APIXO active le son généré par défaut et autorise une sortie silencieuse ; l'audio importé sert de conditionnement plutôt que de préservation documentée de l'audio source.
APIXO documente un traitement typique d'environ 3 à 6 minutes pour les trois flux de travail ; cette estimation est variable et ne constitue pas une garantie de latence.
Les URL des résultats peuvent être temporaires, les vidéos finalisées doivent donc être téléchargées et stockées rapidement.
Foire Aux Questions
Le texte vers vidéo, les images de début/fin et la référence omnidirectionnelle sans vidéo en entrée coûtent $0.08 par seconde de sortie à 480p ou $0.16 par seconde de sortie à 720p. Les références d'images et audio n'ajoutent pas de secondes facturables.
À 480p, le tarif est de $0.044 par seconde ; à 720p, il est de $0.0953. APIXO applique ce tarif à la durée générée plus la durée totale de toutes les vidéos de référence.
APIXO ne documente pas la préservation de l'audio source. Les fichiers vidéo et audio fournissent un contexte de génération, tandis que le paramètre de son contrôle si la sortie inclut un audio généré par le modèle.
Inspectez l'anatomie, les mains, l'identité, le contact avec les objets, les mouvements rapides, le texte incrusté, la fidélité aux références, les transitions, l'interprétation des dialogues, la prononciation et la synchronisation labiale. Les références complexes ou conflictuelles peuvent nécessiter une simplification et une nouvelle génération.
Explorer d'autres modèles
Découvrez d'autres modèles d'IA pour votre prochain workflow créatif