No. Seedance 1.5 Pro es el modelo conjunto de audio y vídeo de ByteDance de diciembre de 2025. APIXO expone sus flujos de trabajo de prompt y fotogramas clave por separado de Seedance 2.0, Seedance 2.0 Fast y sus capacidades de referencia más amplias.
Seedance 1.5 Pro en APIXO se corresponde con el modelo conjunto de audio y vídeo de lanzamiento público de ByteDance Seed. Crea vídeos cortos a partir de texto o de uno a dos fotogramas clave, con sonido sincronizado opcional, control de duración de 4 a 12 segundos y comportamiento de cámara seleccionable. La ruta se centra en la generación directa en lugar de en los flujos de trabajo de referencia multimodal más amplios de Seedance 2.0.
Flujos de trabajo
Texto / Imagen a Vídeo
Precio de APIXO
$0.0108-$0.1044 / seg
Resolución
480p / 720p/ 1080p
Duración
4–12 segundos
Lanzado
16 de diciembre de 2025
Crear con Seedance 1.5 Pro
Cargando espacio de trabajo...
Coordine interpretación, sonido, cámara e intención narrativa
Generación conjunta de audio y vídeo
Genere movimiento visual y sonido juntos para que las voces, el ritmo de la interpretación, el ambiente y los efectos espaciales puedan responder a la misma descripción de escena. APIXO también permite la salida de vídeo sin sonido.
Alineación audiovisual
Coordine el movimiento de los labios, la entonación vocal, el ritmo de la acción y el sonido ambiental con más precisión que un proceso separado de vídeo y doblaje, aunque dejando margen para errores de sincronización generativos.
Rango de idiomas y dialectos
ByteDance documenta la compatibilidad con múltiples idiomas y dialectos regionales, incluyendo su prosodia vocal y expresión emocional. La pronunciación y la sincronización deben revisarse para cada idioma de producción.
Cinematografía dirigida
Interprete instrucciones de cámara y puesta en escena para primeros planos, movimiento continuo, dolly zooms, transiciones de escena, iluminación y tratamiento de color dentro de una secuencia corta generada.
Coordinación narrativa
Conecte el diálogo, la expresión, la acción del personaje y el desarrollo de la toma en torno a la intención narrativa del prompt, permitiendo escenas cortas más cohesivas que la generación de movimiento aislado.
Animación guiada por imagen
Anime una imagen de inicio proporcionada o guíe una transición entre fotogramas de inicio y fin definidos, conservando la composición y apariencia de origen donde la generación lo permita.
Genere libremente a partir de texto o anime fotogramas clave controlados
Generación de texto a vídeo
Envíe un prompt de 3 a 2,500 caracteres que describa la escena, la acción, la dirección de la cámara, la iluminación y las señales de audio. Seleccione la duración, resolución, encuadre, sonido y comportamiento de la cámara para crear un nuevo clip sin una imagen de entrada.
Generación de imagen a vídeo
Proporcione una URL de imagen pública como fotograma de inicio, o dos URL como fotogramas de inicio y fin ordenados. Añada un prompt obligatorio para dirigir el movimiento, la transición, el tratamiento de cámara y la banda sonora opcional generada entre esos anclajes visuales.
Controles de generación verificados
Las opciones de producción expuestas por la API actual de Seedance 1.5 Pro de APIXO.
3–2.500 caracteres
Longitud del prompt
1–2 URL
Imágenes de entrada
Inicio / Fin
Roles de fotograma
6 relaciones + automático
Relaciones de aspecto
Activado / Desactivado
Sonido generado
Activado / Desactivado
Cámara fija
Cree escenas audiovisuales cortas a partir de resúmenes y fotogramas clave
Momentos de Producto con Sonido
Convierta el brief de una campaña o un fotograma de producto aprobado en un breve vídeo de revelación con movimiento, ambiente y efectos coordinados. Use el modo de cámara fija para composiciones controladas e inspeccione la forma del producto, las etiquetas, los materiales y el texto incrustado antes de su publicación.
Interpretaciones guiadas por diálogos
Cree escenas compactas de presentadores, personajes o dramáticas donde la declamación, la expresión facial y el movimiento corporal compartan un único prompt. Revise la identidad del hablante, la pronunciación, el movimiento de la boca, las manos y el tempo emocional en lugar de dar por garantizada la sincronización.
Planificar Tomas Impulsadas por Cámara
Explore tomas continuas, reencuadres, movimientos de estilo dolly y transiciones antes de comprometerse con la producción de acción real o animación. Los fotogramas de inicio y fin proporcionan límites visuales útiles para transiciones y desarrollo de guiones gráficos.
Producir Clips Narrativos Compactos
Genere escenas de 4 a 12 segundos para feeds verticales, emplazamientos panorámicos, teasers o conceptos episódicos. El sonido nativo puede establecer la atmósfera y el ritmo de la interpretación sin necesidad de un paso separado para la generación de la banda sonora.
Límites operativos para Seedance 1.5 Pro
Notas de implementación
APIXO expone solo texto a vídeo e imagen a vídeo; no se documenta ningún modo de entrada de vídeo, extensión, edición, referencia de movimiento o referencia de múltiples imágenes.
La generación de imagen a vídeo requiere una o dos URL; con dos imágenes, la primera es el fotograma de inicio y la segunda es el fotograma final.
APIXO acepta cualquier duración en números enteros de 4 a 12 segundos.
El interruptor de sonido selecciona la generación conjunta de audio o una salida silenciosa; no conserva el audio de origen porque la ruta no acepta vídeo ni audio de origen.
El procesamiento típico de APIXO oscila entre aproximadamente 40-60 segundos para un clip de 4 segundos y 90-120 segundos para un clip de 12 segundos; la latencia real varía.
Las imágenes de referencia deben usar URL públicas en formato JPG, PNG o WebP y quedan sujetas a las comprobaciones de seguridad del proveedor.
Preguntas frecuentes
ByteDance documenta diversas voces y efectos de sonido espaciales coordinados con los visuales. Sus demostraciones también incluyen interpretación vocal y sonido ambiental, pero APIXO expone solo un interruptor de sonido en lugar de controles separados para diálogo, música, ambiente o efectos.
APIXO factura cada segundo generado según la resolución y la configuración de sonido. A 480p, el resultado sin sonido cuesta $0.0108 por segundo y con sonido cuesta $0.0216. A 720p, las tarifas son $0.0234 y $0.0468. A 1080p, las tarifas son $0.0522 y $0.1044 por segundo.
Sí. Proporcione dos URL de imagen en el modo de imagen a vídeo: la primera se convierte en el fotograma de inicio y la segunda en el fotograma final. Una sola imagen actúa como el fotograma de inicio.
Revise la anatomía, manos, estabilidad de identidad, contacto con objetos, texto incrustado, transiciones, pronunciación, sincronización labial e interpretación del hablante. Las escenas más largas o que cambian rápidamente pueden requerir refinar el prompt o generar múltiples veces.
Explorar otros modelos
Descubra más modelos de IA para su próximo flujo de trabajo creativo