Nie. Seedance 1.5 Pro to model do wspólnego generowania audio-wideo od ByteDance z grudnia 2025 roku. APIXO udostępnia jego procesy oparte na promptach i klatkach kluczowych oddzielnie od Seedance 2.0, Seedance 2.0 Fast i ich szerszych możliwości referencyjnych.
Seedance 1.5 Pro w APIXO odpowiada publicznie udostępnionemu, połączonemu modelowi audio-wideo firmy ByteDance Seed. Tworzy krótkie filmy z tekstu lub jednej do dwóch klatek kluczowych, z opcjonalnym zsynchronizowanym dźwiękiem, kontrolą czasu trwania od 4 do 12 sekund i możliwością wyboru zachowania kamery. Ta trasa koncentruje się na bezpośrednim generowaniu, a nie na szerszych, multimodalnych przepływach pracy opartych na referencjach z Seedance 2.0.
Przepływy pracy
Tekst / Obraz na wideo
Cena APIXO
$0.0108-$0.1044 / sek
Rozdzielczość
480p / 720p / 1080p
Czas trwania
4–12 sekund
Wydany
16 grudnia 2025
Twórz z Seedance 1.5 Pro
Ładowanie przestrzeni roboczej...
Koordynuj grę aktorską, dźwięk, ujęcia i intencję narracyjną
Wspólne generowanie audio i wideo
Generuj ruch wizualny i dźwięk jednocześnie, aby głosy, synchronizacja, atmosfera i efekty przestrzenne mogły odpowiadać na ten sam opis sceny. APIXO pozwala również na generowanie bez dźwięku.
Dopasowanie audio-wizualne
Koordynuj ruch warg, intonację głosu, rytm akcji i dźwięk otoczenia dokładniej niż w przypadku oddzielnego procesu tworzenia wideo i dubbingu, pozostawiając margines na generatywne błędy w synchronizacji.
Zakres języków i dialektów
ByteDance dokumentuje wsparcie dla wielu języków i regionalnych dialektów, włączając ich prozodię wokalną i emocjonalne wykonanie. Wymowa i synchronizacja powinny być sprawdzane dla każdego języka produkcji.
Reżyseria zdjęć
Interpretuj instrukcje dotyczące kamery i inscenizacji dla zbliżeń, płynnego ruchu, dolly zoom, przejść między scenami, oświetlenia i obróbki kolorów w krótkiej wygenerowanej sekwencji.
Koordynacja narracji
Łącz dialog, ekspresję, akcję postaci i rozwój ujęcia wokół narracyjnej intencji promptu, wspierając tworzenie bardziej spójnych krótkich scen niż w przypadku izolowanego generowania ruchu.
Animacja na podstawie obrazu
Animuj dostarczony obraz początkowy lub steruj przejściem między zdefiniowanymi klatkami początkową i końcową, zachowując kompozycję i wygląd źródła, na ile pozwala na to generowanie.
Generuj swobodnie na podstawie tekstu lub animuj kontrolowane klatki kluczowe
Generowanie tekstu na wideo
Prześlij prompt o długości 3–2500 znaków opisujący scenę, akcję, kierunek kamery, oświetlenie i sygnały dźwiękowe. Wybierz czas trwania, rozdzielczość, kadrowanie, dźwięk i zachowanie kamery, aby utworzyć nowy klip bez obrazu wejściowego.
Generowanie obraz na wideo
Podaj jeden publiczny adres URL obrazu jako klatkę początkową lub dwa adresy URL jako uporządkowane klatki początkową i końcową. Dodaj wymagany prompt, aby sterować ruchem, przejściem, pracą kamery i opcjonalną generowaną ścieżką dźwiękową między tymi wizualnymi punktami odniesienia.
Zweryfikowane opcje generowania
Opcje produkcyjne udostępniane przez obecne API Seedance 1.5 Pro w APIXO.
3–2500 znaków
Długość promptu
1–2 adresy URL
Wejścia obrazu
Początek / Koniec
Role klatek
6 proporcji + auto
Proporcje
Włącz / Wyłącz
Wygenerowany dźwięk
Włącz / Wyłącz
Stała kamera
Twórz krótkie sceny audiowizualne na podstawie briefów i klatek kluczowych
Momenty produktowe z dźwiękiem
Przekształć brief kampanii lub zatwierdzoną klatkę produktu w krótką zapowiedź ze skoordynowanym ruchem, atmosferą i efektami. Użyj trybu kamery stacjonarnej, aby uzyskać kontrolowane kompozycje i sprawdzić kształt produktu, etykiety, materiały oraz osadzony tekst przed publikacją.
Występy oparte na dialogu
Twórz zwięzłe sceny z prezenterem, postacią lub sceny dramatyczne, w których wypowiedź, mimika i ruch ciała są zawarte w jednym prompcie. Sprawdzaj tożsamość mówcy, wymowę, ruch ust, dłonie i synchronizację emocjonalną, zamiast traktować synchronizację jako gwarantowaną.
Planuj ujęcia sterowane kamerą
Eksploruj ciągłe ujęcia, zmiany kadru, ruchy w stylu dolly i przejścia przed zaangażowaniem się w produkcję live-action lub animację. Klatki początkowa i końcowa stanowią użyteczne granice wizualne dla przejść i tworzenia scenorysów.
Produkuj zwięzłe klipy narracyjne
Generuj 4–12 sekundowe sceny dla pionowych kanałów, szerokoekranowych umiejscowień, zwiastunów lub koncepcji epizodycznych. Dźwięk natywny może budować atmosferę i rytm bez konieczności oddzielnego generowania ścieżki dźwiękowej.
Ograniczenia operacyjne dla Seedance 1.5 Pro
Uwagi implementacyjne
APIXO udostępnia tylko tryby tekst na wideo i obraz na wideo; nie udokumentowano żadnego trybu wejścia wideo, rozszerzania, edycji, referencji ruchu ani referencji wielu obrazów.
Generowanie obraz na wideo wymaga jednego lub dwóch adresów URL; przy dwóch obrazach pierwszy jest klatką początkową, a drugi końcową.
APIXO akceptuje każdą całkowitą wartość czasu trwania od 4 do 12 sekund.
Przełącznik dźwięku pozwala wybrać wspólnie generowane audio lub nieme wideo; nie zachowuje on dźwięku źródłowego, ponieważ ten punkt końcowy nie akceptuje źródłowego wideo ani audio.
Typowy czas przetwarzania w APIXO waha się od około 40–60 sekund dla 4-sekundowego klipu do 90–120 sekund dla 12-sekundowego klipu; rzeczywiste opóźnienie jest zmienne.
Obrazy referencyjne muszą używać publicznie dostępnych adresów URL w formacie JPG, PNG lub WebP i podlegają kontrolom bezpieczeństwa dostawcy.
Często zadawane pytania
ByteDance dokumentuje zróżnicowane głosy i przestrzenne efekty dźwiękowe skoordynowane z wizualizacjami. Jego demonstracje obejmują również wykonania wokalne i dźwięki otoczenia, ale APIXO udostępnia tylko jeden przełącznik dźwięku, zamiast oddzielnych kontrolek dla dialogów, muzyki, tła czy efektów.
APIXO nalicza opłaty za każdą wygenerowaną sekundę zgodnie z rozdzielczością i ustawieniami dźwięku. W rozdzielczości 480p wideo bez dźwięku kosztuje $0.0108 za sekundę, a z dźwiękiem $0.0216. W rozdzielczości 720p stawki wynoszą odpowiednio $0.0234 i $0.0468. W rozdzielczości 1080p stawki to $0.0522 i $0.1044 za sekundę.
Tak. W trybie obraz na wideo podaj dwa adresy URL obrazów: pierwszy stanie się klatką początkową, a drugi klatką końcową. Pojedynczy obraz działa jako klatka początkowa.
Sprawdź anatomię, dłonie, spójność tożsamości, kontakt z obiektami, osadzony tekst, przejścia, wymowę, synchronizację ruchu warg i interpretację mówcy. Dłuższe lub dynamicznie zmieniające się sceny mogą wymagać dopracowania promptu lub wielokrotnego generowania.
Odkryj inne modele
Odkryj więcej modeli AI dla swojego kolejnego kreatywnego przepływu pracy