Wan 2.6 Video è l'endpoint operativo di APIXO per cinque workflow di generazione video di Alibaba. Consente di creare clip audiovisive da testo, animare un'immagine di origine o guidare i personaggi con riferimenti di immagini e video ordinati. Le modalità Standard e Flash offrono output a 720p o 1080p, controllo multi-inquadratura, audio personalizzato, e durate e prezzi specifici per ciascuna modalità.
Flussi di lavoro
Testo / Immagine / Riferimenti
Prezzo APIXO
$0.025–$0.30 / secRoute Standard e Flash con prezzi backend
Risoluzione
720p / 1080p
Durata
2–15 s · Riferimenti ≤10 s
Limite di Riferimento
Fino a 5 file
Crea con Wan 2.6
Caricamento dell'area di lavoro...
Route Operativa dell'API
Un singolo endpoint Wan 2.6 per la guida tramite prompt, fotogrammi e personaggi
Integri la generazione testo a video, l'animazione di immagini Standard o Flash e la generazione di riferimenti Standard o Flash tramite un'unica route APIXO. Ogni modalità richiede un prompt, mentre gli input multimediali ordinati, la selezione multi-shot, l'audio personalizzato e il controllo audio solo per Flash supportano strategie di produzione distinte.
Funzionalità del modello
Controlli come ogni scena di Wan 2.6 inizia e si sviluppa
Generazione Guidata da Testo
Crei un video senza immagini di origine da un prompt obbligatorio in cinese o inglese che descriva soggetti, azione, ambientazione, movimenti della telecamera, dialoghi e suoni.
Animazione dal primo fotogramma
Le modalità immagine Standard e Flash animano esattamente una immagine sorgente. Il prompt rimane obbligatorio e dirige il movimento, il comportamento della telecamera e lo sviluppo della scena dallo stato visivo iniziale.
Riferimenti Multimediali Ordinati
Le modalità di riferimento accettano URL di immagini e video ordinati che corrispondono a character1, character2 e ruoli successivi per guidare l'aspetto, il movimento, la scena o la voce disponibile.
Struttura Multi-Scena
Scegliere 'singolo' per un'inquadratura continua o 'multi' per una sequenza di inquadrature variabili. L'impostazione esplicita ha la priorità su istruzioni di ripresa contrastanti nel prompt.
Guida audiovisiva
Invia un file MP3 o WAV opzionale per la sincronizzazione personalizzata, oppure lascia che la generazione con audio abilitato produca un output audiovisivo senza garantire dialoghi, pronuncia o sincronizzazione labiale esatti.
Controlli di Prompt e Seed
Affina l'output con un prompt negativo, l'espansione del prompt e un seed numerico. I seed fissi aiutano l'iterazione controllata ma non possono rendere deterministica una generazione probabilistica.
Profili di routing
Seleziona workflow Standard o la generazione Flash con audio configurabile
Workflow Video Standard
Il routing standard copre testo a video, immagine a video e da riferimento a video. La generazione da testo e immagine supporta 2-15 secondi, mentre la generazione da riferimento supporta 2-10 secondi. Il campo audio non è valido in queste modalità.
Standard
Flussi di lavoro video Flash
L'instradamento flash è disponibile solo per immagine-a-video-flash e riferimento-a-video-flash. Il suo controllo del suono è predefinito su 'true'; disabilitandolo si produce un output silenzioso, si ignora l'audio fornito e si applica la tariffa Flash inferiore.
Flash
Specifiche API
Controlli verificati per il percorso operativo
Input e limiti specifici per modalità esposti tramite APIXO.
5
Modalità di generazione
1–1.500
Caratteri del prompt
1 immagine
Input modalità immagine
1–5 file
Input di Riferimento
1 MP3 / WAV
Audio personalizzato
Polling / Callback
Consegna del Risultato
Applicazioni di produzione
Abbina ogni strategia di input a un workflow video pratico
Sviluppo di concept
Previsualizza Sequenze di Campagna
Usa le modalità testo-a-video e il controllo multi-inquadratura per esplorare brevi narrazioni di campagna, cambi di telecamera e progressioni di scena prima di passare alle riprese o alla post-produzione dettagliata. Verifica l'anatomia, il contatto tra oggetti, i loghi e il testo incorporato.
Animazione di asset
Animare key art di prodotto
Trasforma un'immagine di prodotto, un'illustrazione o un visual di campagna approvato in un video utilizzando il percorso Standard o Flash. Confronta il risultato con la fonte per geometria, proporzioni, composizione e fedeltà al brand.
Direzione del personaggio
Metti in Scena Interazioni Guidate da Riferimenti
Assegni riferimenti ordinati di immagini o video a ruoli di personaggi per brevi conversazioni e scene con più personaggi. Convalidi l'identità, il posizionamento, la deriva vocale, l'attribuzione dei dialoghi, la pronuncia e il movimento della bocca in ogni risultato.
Creatività audio-first
Creare promo con audio personalizzato
Fornisci narrazione, musica o sound design per guidare una breve clip promozionale. Controlla tempistica e sincronizzazione prima della pubblicazione, oppure disabilita l'audio Flash quando è richiesta solo una bozza visiva a basso costo.
Guida all'integrazione
Vincoli di modalità, regole sui media e fatturazione
Note operative
01
APIXO espone cinque modalità di prodotto ma non identifica pubblicamente il checkpoint o lo snapshot upstream preciso selezionato dietro ogni route.
02
Ogni modalità richiede un prompt non vuoto fino a 1.500 caratteri; il prompt negativo opzionale supporta fino a 500 caratteri.
03
Le modalità immagine richiedono un URL pubblico di un file JPEG, JPG, PNG senza canale alfa, BMP o WebP, di dimensioni fino a 20 MB e con dimensioni comprese tra 240 e 8.000 pixel.
04
Le modalità di riferimento accettano da uno a cinque file ordinati: fino a cinque immagini, fino a tre video MP4 o MOV e non più di cinque file in totale.
05
L'audio personalizzato accetta un URL pubblico MP3 o WAV, di durata compresa tra 3 e 30 secondi e fino a 15 MB; l'audio in eccesso viene troncato, mentre un input breve lascia in silenzio la parte rimanente.
06
APIXO non pubblica un periodo di conservazione dell'URL dei risultati per questa route. Esegua il polling delle modalità testo o immagine dopo 30 secondi e delle modalità di riferimento dopo 45 secondi, oppure utilizzi la consegna tramite callback per i risultati finali; memorizzi tempestivamente gli output richiesti dopo il completamento.
Domande frequenti
Le modalità testo a immagine e immagine a video costano $0.10 al secondo a 720p o $0.15 a 1080p. La modalità da riferimento a video costa $0.20 al secondo a 720p o $0.30 a 1080p. Il costo totale è la durata selezionata moltiplicata per la tariffa applicabile.
Image Flash costa 0,025 $/0,0375 $ al secondo a 720p/1080p senza audio e 0,05 $/0,075 $ con audio. Reference Flash costa 0,05 $/0,08 $ senza audio e 0,10 $/0,16 $ con audio.
Solo image-to-video-flash e reference-to-video-flash accettano l'audio. L'impostazione predefinita è true. Quando è false, il video generato è silenzioso e qualsiasi valore audio_urls fornito viene ignorato.
Imposta shot_type su multi e mantieni prompt_extend abilitato in modo che Wan 2.6 possa riscrivere e ottimizzare la descrizione dell'inquadratura. Usa single quando la scena deve rimanere un'unica inquadratura continua.
Le attività utilizzano gli stati pending, processing, success e failed. Gli URL dei video generati con successo compaiono in resultJson.resultUrls; i fallimenti espongono failCode e failMsg. La consegna tramite callback richiede un endpoint di callback pubblico raggiungibile.
Esplora altri modelli
Scopri altri modelli AI per il tuo prossimo workflow creativo