APIXO
Генерация видеоМультимодальный вводПредпросмотр

Gemini Omni Flash — это предварительная мультимодальная модель от Google для генерации и редактирования видео. APIXO предоставляет доступ к генерации видео, а также к процессам работы с многократно используемыми аудио- и персонажными ассетами, с референсами в виде текста, изображений, видео и сохранённых ассетов. Создавайте или преобразуйте видео с согласованными визуальными эффектами и звуком, логикой сцен, учитывающей контекст, и опциями вывода APIXO вплоть до 4K.

Входные данные

Текст / Изображение / Видео / Аудио-ассеты

Цена APIXO

$0.10 / secondРедактирование исходного видео оплачивается за операцию

Разрешение APIXO

720p / 1080p / 4K

Длительность

4 / 6 / 8 / 10 секундБез исходного видео

Выпущен

30 мая 2026

Создать с Gemini Omni

Загрузка рабочего пространства...

Доступно на APIXO

Создавайте мультимодальные видео-процессы с помощью Gemini Omni

Создавайте короткие видео из промптов и смешанных референсов или преобразуйте исходное видео с помощью команд на естественном языке. APIXO добавляет режимы многократно используемых аудио- и персонажных ассетов к своему маршруту Gemini Omni, позволяя приложениям подготавливать голоса и объекты перед их объединением с изображениями, видео, кадрированием, длительностью и настройками разрешения.

Возможности

Объединение креативных референсов в целостное видео

Генерация по смешанным референсам

Видеорежим APIXO принимает промпты вместе с изображениями, одним исходным видео, многократно используемыми ID персонажей и ID аудио. Эти референсы могут управлять внешним видом, движением, структурой сцены и звуком в рамках одного запроса на генерацию видео.

Трансформация исходного видео

Предоставьте одно видео и опишите трансформацию, такую как изменение окружения, визуальной обработки, действия или выбранных элементов сцены. APIXO также предоставляет доступ к начальной и конечной позициям для выбора нужной части входного видео.

Многоразовые ресурсы персонажей

Создайте ресурс персонажа из одного изображения, опционально связанного с одним подготовленным аудиоресурсом. Полученный ID персонажа затем можно многократно использовать в запросах на видео, при этом APIXO поддерживает до трех ID персонажей на одну генерацию.

Многоразовые аудиоресурсы

Создайте аудиоресурс на основе базового голоса, поддерживаемого APIXO, опционального описания голоса и тестового диалога. Сохраните полученный ID аудио для последующих запросов персонажей или видео; видеорежим принимает до трех ID аудио.

Логика сцены с учётом окружения

Google позиционирует Gemini Omni Flash как модель с обширными знаниями о мире и пониманием физического поведения. Это помогает ей создавать сцены с учётом истории, науки, культурного контекста, гравитации, движения, материалов и других реальных взаимосвязей.

Скоординированные визуальные эффекты и звук

Gemini Omni Flash генерирует видео с сопутствующей аудиодорожкой и может реагировать на временные инструкции для диалогов, музыки, эффектов, монтажных склеек и событий на экране. Точность промпта остаётся важной, когда требуется точная синхронизация или тайминг текста.

Детали API

Конфигурация Gemini Omni на APIXO

Проверенные режимы ассетов, допустимые референсы, настройки вывода и квоты, опубликованные для маршрута APIXO.

Аудиоресурс / Ресурс персонажа / Видео

Режимы

16:9 / 9:16

Соотношения сторон

До 3 ID

Аудиоресурсы

До 3 ID

Ресурсы персонажей

До 1 URL

Исходное видео

7 единиц

Квота на референсы

Применение в продакшене

Создание систем видеопроизводства на основе референсов

Брендовые кампании

Видео с постоянным ведущим

Подготовьте многократно используемого персонажа из утвержденного портрета и свяжите его с выбранным аудиоресурсом. Затем приложения смогут генерировать короткие видеоролики кампаний с ведущим в различных сценах, повторно используя те же референсы персонажа и голоса.

Креативы для продуктов

Мультимодальные истории о продуктах

Объедините изображения продуктов, ресурсы персонажей, аудиоинструкции и письменное описание сцены для создания роликов для запуска или рекламных концепций. Используйте горизонтальную или вертикальную ориентацию для подготовки вариантов для витрин, страниц кампаний и мобильных каналов.

Адаптация видео

Стилизация исходного видеоматериала

Отправьте существующий клип и запросите новое окружение, визуальный стиль, обработку объектов или повествовательный эффект. Элементы управления началом и концом позволяют разработчикам выбрать нужный сегмент исходного видео перед применением трансформации через APIXO.

Образовательные медиа

Визуальные объяснения и раскадровки

Используйте знания о мире и физическое моделирование Gemini Omni для создания коротких объясняющих роликов по науке, истории, процессам или концепциям со скоординированным повествованием и движением. Рассматривайте фактический результат как черновик и проверяйте важные детали перед публикацией.

Рабочий процесс с ресурсами

Подготовьте ресурсы для повторного использования перед генерацией видео

APIXO разделяет необязательную подготовку аудио и персонажей от асинхронной генерации видео с помощью Gemini Omni.

Создать аудиоресурс

Выберите базовый голос, поддерживаемый APIXO, назовите ресурс и при желании укажите интонацию и текст для предпросмотра. Сохраните полученный ID аудио для последующего использования с персонажем или непосредственно в запросе на создание видео.

Подготовить ресурс персонажа

Отправьте ровно одно общедоступное изображение персонажа с описательным промптом и, при необходимости, один сохранённый ID аудио. Сохраните полученный ID персонажа, чтобы на него можно было ссылаться в будущих задачах по созданию видео с помощью Gemini Omni.

Сгенерировать финальное видео

Объедините промпт с подходящими изображениями, ID аудио, ID персонажей или одним исходным видео. Выберите поддерживаемое APIXO разрешение и кадрирование, затем получите готовое видео через асинхронный опрос или доставку по вебхуку.

Примечания и FAQ

Доступность и ограничения Gemini Omni

Примечания по эксплуатации

01

Эта страница описывает текущие режимы APIXO для видео, аудиоассетов и ассетов персонажей в Gemini Omni. Она не относится к API Gemini для чата, генерации изображений, анализа документов или отдельного синтеза речи.

02

Playground в браузере APIXO работает только в режиме видео; подготовка аудио- и персонажных ресурсов задокументирована для использования через API.

03

APIXO не документирует прямую загрузку аудиофайлов для этого маршрута; в запросах на создание видео используются ID аудио, созданные в режиме аудиоресурсов.

04

Совокупная квота на изображения, исходные видео и персонажей составляет семь единиц; одно видео потребляет две единицы, а каждое изображение или персонаж — одну.

05

APIXO не предоставляет доступ к рабочему процессу Gemini с отслеживанием состояния через previous_interaction_id, сессиям в реальном времени, анализу документов или использованию инструментов на этой конечной точке.

06

Английский язык полностью поддерживается на стороне провайдера; другие языки не были протестированы и могут давать менее предсказуемые результаты.

Часто задаваемые вопросы

Нет. Эта страница APIXO описывает рабочий процесс с видео через Gemini Omni от Google, а не модели Gemini для чатов, написания кода, анализа документов или агентов. Публикуемым результатом являются ID аудио- или персонажных ресурсов для повторного использования и URL сгенерированных видео, в зависимости от выбранного режима APIXO.

APIXO предлагает три режима: создание аудиоресурса, создание ресурса персонажа и асинхронная генерация видео. Режимы ресурсов подготавливают ID для повторного использования в видеозапросах; они не являются самостоятельными конечными точками для создания музыки, распознавания речи, генерации изображений или диалоговых ответов.

Без исходного видео генерация в 720p и 1080p стоит $0.10 за секунду, а в 4K — $0.20 за секунду. При наличии одного исходного видео APIXO взимает $1.20 за запрос в 720p или 1080p и $1.80 за запрос в 4K.

Видео, сгенерированные по промпту и референсу без исходного видео, поддерживают длительность 4, 6, 8 или 10 секунд. При предоставлении URL исходного видео APIXO игнорирует настройку длительности и вместо этого использует выбранный сегмент видеовхода и фиксированную оплату за запрос.

APIXO документирует преобразование одного загруженного исходного видео на основе промпта, но не публикует параметр stateful multi-turn interaction от Google для этой конечной точки. Рассматривайте каждую задачу APIXO как независимый запрос, если только в текущей схеме позже не будет задокументировано состояние диалога.

Другие модели

Откройте для себя больше AI-моделей для вашего следующего творческого процесса