Supporta text-to-video, image-to-video e reference-to-video. Tutte le 3 modalità offrono output in 480p / 720p / 1080p.
Wan 3.0 Video LoRA
Wan 3.0 Video LoRA genera video da testo, dal primo e dall'ultimo fotogramma o da un mix di riferimenti di immagini, video e audio. Scegli l'output 480p, 720p, 1080p, imposta una lunghezza esplicita della clip o lascia decidere alla durata smart.
Modalità
Testo / Immagine / Riferimento
Prezzo APIXO
Da $0.0525 / secondo
Durata
Smart o 2–30 secondi
Tipi di riferimento
Immagine / Video / Audio
Risoluzione
480p / 720p / 1080p
Crea con Wan 3.0 Video LoRA
Caricamento dell'area di lavoro...
Un toolkit di riferimento per brief creativi guidati da LoRA
Tre canali di riferimento
Guida una richiesta reference-to-video con immagini, video o audio, invece di condensare ogni istruzione unicamente nel prompt.
Immagini del Primo e Ultimo Fotogramma
La modalità Image-to-video accetta fino a 2 immagini — il fotogramma iniziale più un fotogramma finale opzionale. La modalità Reference accetta fino a 10 immagini.
Guida con riferimento video
È possibile allegare fino a 5 video di riferimento di 1–15 secondi ciascuno, per un massimo di 15 secondi totali di video di riferimento. I secondi effettivi saranno fatturati alla tariffa della risoluzione selezionata.
Riferimenti Audio Senza Sovrapprezzo
Aggiungi fino a 5 riferimenti audio da 1–15 secondi ciascuno in modalità di riferimento. I riferimenti audio possono guidare il brief senza aggiungere una tariffa separata per l'input audio.
Prompt opzionale al di fuori della modalità testo
Un prompt è richiesto solo per il text-to-video. Image-to-video e reference-to-video accettano un prompt vuoto quando i contenuti multimediali forniti contengono già il brief.
Durata intelligente
Attiva la durata smart quando il modello deve determinare la lunghezza dell'output, oppure scegli un qualsiasi numero intero da 2 a 30 secondi per impostare una durata esplicita della clip.
Parametri API pubblicati per Wan 3.0 Video LoRA
3 modalità di generazione
Modalità
480p / 720p / 1080p
Risoluzione
Smart o 2–30 secondi
Durata
Fino a 10 immagini
Riferimenti immagine
Fino a 5 video
Riferimenti video
Abilitato per impostazione predefinita
Suono
Quando un contesto di riferimento più ricco migliora il brief di produzione
Sviluppo di scene guidato da riferimenti
Combina riferimenti di immagini con brevi clip video per comunicare soggetti, direzione visiva e spunti di movimento all'interno di un'unica richiesta da riferimento a video.
Movimento dal Primo all'Ultimo Fotogramma
Fornire un'immagine iniziale e un'immagine finale opzionale quando la clip desiderata deve passare tra due stati visivi noti.
Contesto di riferimento guidato dall'audio
Estenda un brief visivo con riferimenti audio quando il ritmo, l'atmosfera o una traccia parlata devono influenzare la clip generata.
Esplorazione creativa a durata intelligente
Utilizzate la Smart Duration quando la lunghezza ideale della clip deve basarsi sul risultato generato, quindi passate a una durata fissa di 2–30 secondi per passaggi di produzione controllati.
Guida all'input e alla fatturazione di Wan 3.0 Video LoRA
Note
Un prompt è richiesto solo per il text-to-video. Image-to-video e reference-to-video accettano un prompt vuoto.
La durata Smart utilizza -1. Il backend riserva inizialmente il costo di 30 secondi, quindi effettua il saldo in base alla durata effettiva del video generato con successo e rimborsa la differenza.
I secondi di video di riferimento sono fatturati alla stessa tariffa di risoluzione dei secondi di output. L'audio di riferimento non comporta costi di input separati.
Per una durata positiva fissa, la somma dei secondi di output e dei secondi totali dei video di riferimento non può superare 30 secondi.
L'audio è abilitato per impostazione predefinita e non modifica il prezzo. Imposta il parametro sound su false quando una richiesta deve generare una clip senza audio.
La funzionalità Reference-to-video accetta fino a 10 immagini, 5 video e 5 file audio. Ciascun video o file audio di riferimento deve avere una durata compresa tra 1 e 15 secondi, con un massimo di 15 secondi per tipo di media.
Domande Frequenti
I secondi di output vengono addebitati da $0.0525 a $0.21 al secondo, a seconda esclusivamente della risoluzione di output — la tabella delle tariffe riporta ciascun livello. Tutte le 3 modalità di generazione condividono la stessa tariffa; la modalità reference-to-video addebita in aggiunta i secondi effettivi di qualsiasi video di riferimento.
Quando duration è -1, il backend riserva il costo di 30 secondi poiché la durata finale non è ancora nota. In seguito a un risultato positivo, la fatturazione viene regolata in base alla durata effettiva e la differenza viene rimborsata.
La modalità reference-to-video accetta immagini, video e audio. Supporta fino a 10 immagini, 5 video e 5 riferimenti audio, con ciascun file video o audio di riferimento di durata compresa tra 1 e 15 secondi.
No. Ciascun secondo di video di riferimento viene addebitato alla tariffa della risoluzione selezionata, mentre l'audio di riferimento non comporta un costo di input aggiuntivo.
Entrambi condividono gli stessi parametri e modalità. Questo modello genera 480p, 720p, 1080p, mentre il modello Pro innalza la soglia massima a 1080p, 2K, 4K con le proprie tariffe al secondo.
Esplora altri modelli
Scopri altri modelli AI per il tuo prossimo workflow creativo
