No. Questa pagina di APIXO descrive il flusso di lavoro video di Gemini Omni di Google, non i modelli Gemini per chat, coding, analisi di documenti o agenti. Gli output pubblicati sono ID riutilizzabili di asset audio o personaggi e URL di video generati, a seconda della modalità APIXO selezionata.
Gemini Omni Flash è il modello multimodale in anteprima di Google per la generazione e la modifica di video. APIXO espone la generazione video insieme a flussi di lavoro per asset audio e personaggi riutilizzabili, con riferimenti a testo, immagini, video e asset salvati. Crea o trasforma video con elementi visivi e sonori coordinati, una logica di scena coerente con il contesto e opzioni di output APIXO fino a 4K.
Input
Asset di testo / immagini / video / audio
Prezzo APIXO
$0.10 / secondLe modifiche al video di origine hanno un prezzo per operazione
Risoluzione APIXO
720p / 1080p / 4K
Durata
4 / 6 / 8 / 10 secondiSenza input video di origine
Rilasciato
30 maggio 2026
Crea con Gemini Omni
Caricamento dell'area di lavoro...
Combini Riferimenti Creativi in un Output Video Coerente
Generazione con Riferimenti Misti
La modalità video di APIXO accetta prompt insieme a immagini, un video sorgente, ID di personaggi riutilizzabili e ID audio. Questi riferimenti possono guidare l'aspetto, il movimento, la struttura della scena e il suono all'interno di una singola richiesta di generazione video.
Trasformazione di Video Sorgente
Fornisca un video e descriva la trasformazione, come la modifica dell'ambiente, del trattamento visivo, dell'azione o di elementi selezionati della scena. APIXO espone anche le posizioni di inizio e fine per scegliere la porzione rilevante dell'input.
Asset Personaggio Riutilizzabili
Crei un asset di personaggio da esattamente un'immagine, associata facoltativamente a un asset audio preparato. L'ID del personaggio restituito può quindi essere riutilizzato nelle richieste video, con APIXO che supporta fino a tre ID di personaggio per generazione.
Asset Audio Riutilizzabili
Crei un asset audio da una voce di base supportata da APIXO, una descrizione vocale opzionale e un dialogo di anteprima. Salvi l'ID audio risultante per successive richieste di personaggi o video; la modalità video accetta fino a tre ID audio.
Logica di scena consapevole del mondo
Google posiziona Gemini Omni Flash attorno alla conoscenza del mondo e alla comprensione del comportamento fisico. Questo lo aiuta a costruire scene basate su storia, scienza, contesto culturale, gravità, movimento, materiali e altre relazioni del mondo reale.
Coordinamento tra Immagini e Suono
Gemini Omni Flash genera video con una traccia audio di accompagnamento e può rispondere a istruzioni di temporizzazione per dialoghi, musica, effetti, tagli ed eventi sullo schermo. La precisione del prompt rimane importante quando è richiesta una sincronizzazione esatta o una tempistica del testo.
Configurazione Gemini Omni su APIXO
Modalità di asset verificate, permessi per i riferimenti, impostazioni di output e quote pubblicate per la route APIXO.
Asset Audio / Asset Personaggio / Video
Modalità
16:9 / 9:16
Rapporti d'aspetto
Fino a 3 ID
Asset Audio
Fino a 3 ID
Asset Personaggio
Fino a 1 URL
Video di origine
7 unità
Quota di Riferimento
Costruisca Sistemi di Produzione Video Basati su Riferimenti
Video con Presentatore Coerente
Prepari un personaggio riutilizzabile da un ritratto approvato e lo associ a un asset audio selezionato. Le applicazioni possono quindi generare brevi video di campagna con un presentatore in diverse scene, riutilizzando gli stessi riferimenti di personaggio e voce.
Storie di Prodotto Multimodali
Combini immagini di prodotto, asset di personaggi, direttive audio e un brief di scena scritto per creare clip di lancio o concept pubblicitari. Utilizzi inquadrature orizzontali o verticali per preparare varianti per vetrine, pagine di campagne e canali mobile.
Restyling di Filmati Sorgente
Invii una clip esistente e richieda un nuovo ambiente, stile visivo, trattamento degli oggetti o effetto narrativo. I controlli di inizio e fine consentono agli sviluppatori di selezionare il segmento sorgente pertinente prima di applicare la trasformazione tramite APIXO.
Spiegazioni visive e storyboard
Utilizzi la conoscenza del mondo e il ragionamento fisico di Gemini Omni per sviluppare brevi video esplicativi su scienza, storia, processi o concetti con narrazione e movimento coordinati. Tratti l'output fattuale come materiale di bozza e verifichi i dettagli importanti prima della pubblicazione.
Prepara Input Riutilizzabili Prima di Generare il Video
APIXO separa la preparazione facoltativa di audio e personaggi dalla generazione video asincrona di Gemini Omni.
Crea un Asset Audio
Selezioni una voce di base supportata da APIXO, nomini l'asset e, facoltativamente, fornisca indicazioni vocali e un dialogo di anteprima. Salvi l'ID audio restituito per utilizzarlo in seguito con un personaggio o direttamente in una richiesta video.
Prepara un Asset Personaggio
Fornisca esattamente un'immagine pubblica del personaggio con un prompt descrittivo e, quando utile, un ID audio salvato. Memorizzi l'ID del personaggio risultante in modo che possa essere referenziato in futuri task video di Gemini Omni.
Genera il Video Finale
Combini il prompt con immagini idonee, ID audio, ID personaggio o un video sorgente. Scelga una risoluzione e un'opzione di inquadratura supportate da APIXO, quindi recuperi il video completato tramite polling asincrono o notifica webhook.
Disponibilità e Vincoli di Gemini Omni
Note Operative
Questa pagina illustra le attuali modalità video, audio-asset e character-asset di Gemini Omni su APIXO. Non riguarda le API di chat, generazione di immagini, analisi di documenti o sintesi vocale standalone di Gemini.
Il Playground di APIXO nel browser è impostato sulla modalità video; la preparazione di asset audio e personaggi è documentata per l'uso tramite API.
APIXO non documenta il caricamento diretto di file audio per questa rotta; le richieste video utilizzano ID audio creati tramite la sua modalità per asset audio.
La quota combinata di immagini, video sorgente e personaggi è di sette unità; un video consuma due unità, mentre ogni immagine o personaggio ne consuma una.
APIXO non espone su questo endpoint il flusso di lavoro stateful di Gemini `previous_interaction_id`, le sessioni in tempo reale, l'analisi di documenti o l'uso di tool.
L'inglese è pienamente supportato a monte; altre lingue non sono state valutate e potrebbero produrre risultati meno prevedibili.
Domande Frequenti
APIXO espone tre modalità: creazione di asset audio, creazione di asset personaggio e generazione video asincrona. Le modalità per gli asset preparano ID riutilizzabili per le richieste video; non sono endpoint autonomi per la generazione di musica, la trascrizione vocale, la generazione di immagini o le risposte conversazionali.
Senza un video di origine in input, il costo per la generazione a 720p e 1080p è di $0.10 al secondo, mentre per il 4K è di $0.20 al secondo. Con un video di origine, APIXO addebita $1.20 per richiesta a 720p o 1080p e $1.80 in 4K.
I video generati da prompt e da riferimento senza un video sorgente supportano 4, 6, 8 o 10 secondi. Quando viene fornito un URL di video sorgente, APIXO ignora l'impostazione della durata e utilizza invece il segmento di input selezionato e una tariffazione fissa per richiesta.
APIXO documenta la trasformazione basata su prompt di un video sorgente caricato, ma non pubblica il parametro di interazione multi-turno stateful di Google su questo endpoint. Tratti ogni attività di APIXO come una richiesta indipendente, a meno che lo schema live non documenti in futuro uno stato conversazionale.
Esplora altri modelli
Scopri altri modelli AI per il tuo prossimo workflow creativo