Es unterstützt text-to-video, image-to-video und reference-to-video. Alle 3 Modi bieten eine Ausgabe in 480p / 720p / 1080p.
Wan 3.0 Video LoRA
Wan 3.0 Video LoRA generiert Videos aus Text, aus ersten und letzten Frames oder einer Kombination aus Bild-, Video- und Audioreferenzen. Wählen Sie eine 480p, 720p, 1080p-Ausgabe, legen Sie eine explizite Cliplänge fest oder lassen Sie Smart Duration entscheiden.
Modi
Text / Bild / Referenz
APIXO Preis
Ab $0.0525 / Sekunde
Dauer
Smart oder 2–30 Sekunden
Referenztypen
Bild / Video / Audio
Auflösung
480p / 720p / 1080p
Mit Wan 3.0 Video LoRA erstellen
Arbeitsbereich wird geladen...
Ein Referenz-Toolkit für LoRA-gesteuerte Creative Briefs
Drei Referenzkanäle
Steuern Sie eine Reference-to-Video-Anfrage mit Bildern, Videos oder Audio, anstatt jede Anweisung allein in den Prompt zu komprimieren.
Bilder für ersten und letzten Frame
Image-to-Video akzeptiert bis zu 2 Bilder – das Start-Frame plus ein optionales End-Frame. Der Reference-Modus akzeptiert bis zu 10 Bilder.
Video-Referenzführung
Fügen Sie bis zu 5 Referenzvideos von jeweils 1–15 Sekunden hinzu, mit insgesamt maximal 15 Sekunden an Referenzvideo. Die tatsächliche Sekundenzahl wird zum Tarif der ausgewählten Auflösung abgerechnet.
Audio-Referenzen ohne Aufpreis
Fügen Sie im Referenzmodus bis zu 5 Audioreferenzen von jeweils 1–15 Sekunden hinzu. Audioreferenzen können das Briefing mitgestalten, ohne dass eine zusätzliche Audio-Input-Gebühr anfällt.
Prompt optional außerhalb des Textmodus
Ein Prompt ist nur für Text-to-Video erforderlich. Image-to-Video und Reference-to-Video akzeptieren einen leeren Prompt, wenn das bereitgestellte Medium das Briefing bereits enthält.
Intelligente Dauer
Aktivieren Sie Smart Duration, wenn das Modell die Ausgabelänge bestimmen soll, oder wählen Sie eine beliebige ganze Zahl von 2 bis 30 Sekunden für eine explizite Clip-Dauer.
Veröffentlichte API-Parameter für Wan 3.0 Video LoRA
3 Generierungsmodi
Modi
480p / 720p / 1080p
Auflösung
Smart oder 2–30 Sekunden
Dauer
Bis zu 10 Bilder
Bildreferenzen
Bis zu 5 Videos
Video-Referenzen
Standardmäßig aktiviert
Sound
Wenn ein reichhaltigerer Referenzkontext das Produktionsbriefing verbessert
Referenzgestützte Szenenentwicklung
Kombinieren Sie Bildreferenzen mit kurzen Videoclips, um Motive, visuelle Ausrichtung und Bewegungshinweise innerhalb einer einzigen Referenz-zu-Video-Anfrage zu übermitteln.
Bewegung vom ersten zum letzten Frame
Geben Sie ein Startbild und optional ein Endbild an, wenn sich der gewünschte Clip zwischen zwei bekannten visuellen Zuständen bewegen soll.
Audio-gesteuerter Referenzkontext
Erweitern Sie ein visuelles Briefing um Audioreferenzen, wenn Tempo, Stimmung oder eine gesprochene Tonspur den generierten Clip beeinflussen sollen.
Kreative Exploration mit intelligenter Länge
Verwenden Sie Smart Duration, wenn sich die passende Cliplänge nach dem generierten Ergebnis richten soll, und wechseln Sie anschließend für kontrollierte Produktionsdurchläufe zu einer festen Dauer von 2–30 Sekunden.
Wan 3.0 Video LoRA: Hinweise zu Eingabe und Abrechnung
Anmerkungen
Ein Prompt ist nur für Text-to-Video erforderlich. Image-to-Video und Reference-to-Video akzeptieren einen leeren Prompt.
Smart Duration verwendet -1. Das Backend reserviert zunächst die Kosten für 30 Sekunden, rechnet dann mit der tatsächlichen Dauer des erfolgreichen Videos ab und erstattet die Differenz.
Referenz-Videosekunden werden zum gleichen auflösungsabhängigen Tarif abgerechnet wie Ausgabesekunden. Für Referenz-Audio fallen keine separaten Eingabegebühren an.
Bei einer festen positiven Dauer dürfen die Ausgabesekunden plus die gesamten Referenzvideosekunden 30 Sekunden nicht überschreiten.
Ton ist standardmäßig aktiviert und hat keinen Einfluss auf den Preis. Setzen Sie den Parameter sound auf false, wenn ein Request einen stummen Clip generieren soll.
Reference-to-video akzeptiert bis zu 10 Bilder, 5 Videos und 5 Audiodateien. Jede Referenz-Video- oder -Audiodatei muss 1–15 Sekunden lang sein, mit maximal 15 Sekunden pro Medientyp.
Häufig gestellte Fragen
Ausgabesekunden werden mit $0.0525 bis $0.21 pro Sekunde abgerechnet, ausschließlich abhängig von der Ausgabeauflösung – die Tariftabelle listet alle Stufen auf. Alle 3 Generierungsmodi nutzen denselben Tarif; bei Reference-to-Video werden zusätzlich die tatsächlichen Sekunden der Referenzvideos abgerechnet.
Wenn duration -1 ist, reserviert das Backend die Kosten für 30 Sekunden, da die endgültige Dauer noch nicht bekannt ist. Nach einem erfolgreichen Ergebnis wird die Abrechnung auf Basis der tatsächlichen Dauer durchgeführt und die Differenz erstattet.
Reference-to-video akzeptiert Bilder, Videos und Audio. Es werden bis zu 10 Bilder, 5 Videos und 5 Audioreferenzen unterstützt, wobei jede Referenz-Video- oder -Audiodatei eine Dauer von 1–15 Sekunden aufweisen muss.
Nein. Jede Sekunde des Referenzvideos wird zum Tarif der gewählten Auflösung abgerechnet, während für Referenzaudio keine zusätzliche Eingabegebühr anfällt.
Beide nutzen dieselben Parameter und Modi. Dieses Modell gibt 480p, 720p, 1080p aus, während das Pro-Modell die Obergrenze zu eigenen Sekundentarifen auf 1080p, 2K, 4K anhebt.
Weitere Modelle entdecken
Entdecken Sie weitere KI-Modelle für Ihren nächsten kreativen Workflow
