No. Esta página de APIXO cubre el flujo de trabajo de vídeo de Gemini Omni de Google, no los modelos de chat, codificación, análisis de documentos o agentes de Gemini. Sus resultados publicados son ID de recursos de audio o personaje reutilizables y URL de vídeo generado, dependiendo del modo de APIXO seleccionado.
Gemini Omni Flash es el modelo multimodal de Google en versión preliminar para la generación y edición de vídeo. APIXO expone la generación de vídeo junto con flujos de trabajo reutilizables para recursos de audio y personajes, con referencias de texto, imagen, vídeo y recursos guardados. Crea o transforma vídeos con elementos visuales y sonido coordinados, una lógica de escena coherente con el entorno y opciones de salida de APIXO de hasta 4K.
Entradas
Texto / Imagen / Vídeo / Recursos de audio
Precio de APIXO
$0.10 / secondLas ediciones de vídeo de origen utilizan precios por operación
Resolución APIXO
720p / 1080p / 4K
Duración
4 / 6 / 8 / 10 SegundosSin vídeo de origen como entrada
Lanzado
30 de mayo de 2026
Crear con Gemini Omni
Cargando espacio de trabajo...
Combine referencias creativas en una salida de vídeo coherente
Generación con referencias mixtas
El modo de vídeo de APIXO acepta prompts junto con imágenes, un vídeo de origen, ID de personaje reutilizables e ID de audio. Estas referencias pueden guiar la apariencia, el movimiento, la estructura de la escena y el sonido dentro de una única solicitud de generación de vídeo.
Transformación de vídeo fuente
Proporcione un vídeo y describa la transformación, como cambiar el entorno, el tratamiento visual, la acción o elementos seleccionados de la escena. APIXO también expone posiciones de inicio y fin para elegir la porción relevante de la entrada.
Recursos de personaje reutilizables
Cree un recurso de personaje a partir de una sola imagen, asociada opcionalmente a un recurso de audio preparado. El ID de personaje devuelto puede reutilizarse en solicitudes de vídeo, y APIXO admite hasta tres ID de personaje por generación.
Recursos de audio reutilizables
Cree un recurso de audio a partir de una voz base compatible con APIXO, una descripción de voz opcional y un diálogo de vista previa. Guarde el ID de audio resultante para futuras solicitudes de personaje o vídeo; el modo de vídeo acepta hasta tres ID de audio.
Lógica de escena con reconocimiento del entorno
Google posiciona a Gemini Omni Flash en torno al conocimiento del mundo y la comprensión del comportamiento físico. Esto le ayuda a construir escenas basadas en historia, ciencia, contexto cultural, gravedad, movimiento, materiales y otras relaciones del mundo real.
Visuales y sonido coordinados
Gemini Omni Flash genera vídeo con una pista de audio de acompañamiento y puede responder a instrucciones de sincronización para diálogos, música, efectos, cortes y eventos en pantalla. La precisión del prompt sigue siendo importante cuando se requiere una sincronización exacta o una temporización de texto precisa.
Configuración de Gemini Omni en APIXO
Modos de activos verificados, permisos de referencia, ajustes de salida y cuotas publicadas para la ruta de APIXO.
Recurso de audio / Recurso de personaje / Vídeo
Modos
16:9 / 9:16
Relaciones de aspecto
Hasta 3 ID
Recursos de audio
Hasta 3 ID
Recursos de personaje
Hasta 1 URL
Vídeo de origen
7 unidades
Cuota de referencia
Construya sistemas de producción de vídeo basados en referencias
Vídeos con presentador consistente
Prepare un personaje reutilizable a partir de un retrato aprobado y combínelo con un recurso de audio seleccionado. Las aplicaciones pueden entonces generar vídeos de campaña cortos dirigidos por un presentador en diferentes escenas mientras reutilizan las mismas referencias de personaje y voz.
Historias de producto multimodales
Combine imágenes de productos, recursos de personaje, dirección de audio y un resumen de escena escrito para crear clips de lanzamiento o conceptos publicitarios. Utilice encuadres horizontales o verticales para preparar variaciones para escaparates, páginas de campaña y canales móviles.
Reestilización de metraje fuente
Envíe un clip existente y solicite un nuevo entorno, estilo visual, tratamiento de objetos o efecto narrativo. Los controles de inicio y fin permiten a los desarrolladores seleccionar el segmento fuente relevante antes de aplicar la transformación a través de APIXO.
Explicaciones visuales y guiones gráficos
Use el conocimiento del mundo y el razonamiento físico de Gemini Omni para desarrollar vídeos explicativos breves sobre ciencia, historia, procesos o conceptos, con narración y movimiento coordinados. Trate el resultado fáctico como material preliminar y verifique los detalles importantes antes de su publicación.
Prepare Entradas Reutilizables Antes de Generar el Vídeo
APIXO separa la preparación opcional de audio y personaje de la generación de vídeo asíncrona de Gemini Omni.
Crear un Recurso de Audio
Seleccione una voz base compatible con APIXO, asigne un nombre al recurso y, opcionalmente, proporcione indicaciones de voz y un diálogo de vista previa. Guarde el ID de audio devuelto para usarlo más tarde con un personaje o directamente en una solicitud de vídeo.
Preparar un Recurso de Personaje
Envía exactamente una imagen de personaje pública con un prompt descriptivo y, si es útil, un ID de audio guardado. Almacena el ID de personaje resultante para poder referenciarlo en futuras tareas de vídeo de Gemini Omni.
Generar el Vídeo Final
Combine el prompt con imágenes elegibles, ID de audio, ID de personaje o un vídeo fuente. Elija una resolución y una opción de encuadre compatibles con APIXO, luego recupere el vídeo completado mediante sondeo asíncrono o entrega por webhook.
Disponibilidad y Restricciones de Gemini Omni
Notas operativas
Esta página cubre los modos actuales de vídeo, activos de audio y activos de personaje de Gemini Omni en APIXO. No representa las API de chat, generación de imágenes, análisis de documentos o voz independientes de Gemini.
El Playground de APIXO en el navegador está fijado en el modo de vídeo; la preparación de recursos de audio y personaje está documentada para el uso de la API.
APIXO no documenta la carga directa de archivos de audio para esta ruta; las solicitudes de vídeo utilizan ID de audio creados a través de su modo de recurso de audio.
La cuota combinada para imágenes, vídeo fuente y personajes es de siete unidades; un vídeo consume dos unidades, mientras que cada imagen o personaje consume una.
APIXO no expone el flujo de trabajo con estado de Gemini `previous_interaction_id`, sesiones en tiempo real, análisis de documentos o uso de herramientas en este punto de acceso.
El inglés es totalmente compatible en el origen; otros idiomas no han sido evaluados y pueden producir resultados menos predecibles.
Preguntas frecuentes
APIXO expone tres modos: creación de recursos de audio, creación de recursos de personaje y generación de vídeo asíncrona. Los modos de recursos preparan ID reutilizables para las solicitudes de vídeo; no son puntos de acceso independientes para música, transcripción de voz, generación de imágenes o respuestas conversacionales.
Sin vídeo de origen, 720p y 1080p cuestan $0.10 por segundo generado, mientras que 4K cuesta $0.20 por segundo. Con un vídeo de origen, APIXO cobra $1.20 por solicitud en 720p o 1080p y $1.80 en 4K.
Los vídeos generados a partir de un prompt y una referencia (sin vídeo de origen) soportan 4, 6, 8 o 10 segundos. Cuando se proporciona una URL de vídeo de origen, APIXO ignora la configuración de duración y en su lugar utiliza el segmento de entrada seleccionado con una facturación fija por solicitud.
APIXO documenta la transformación basada en prompts de un vídeo fuente cargado, pero no publica el parámetro de interacción de múltiples turnos con estado de Google en este punto de acceso. Trate cada tarea de APIXO como una solicitud independiente, a menos que el esquema en vivo documente posteriormente un estado conversacional.
Explorar otros modelos
Descubra más modelos de IA para su próximo flujo de trabajo creativo