Нет. Эта страница APIXO описывает рабочий процесс с видео через Gemini Omni от Google, а не модели Gemini для чатов, написания кода, анализа документов или агентов. Публикуемым результатом являются ID аудио- или персонажных ресурсов для повторного использования и URL сгенерированных видео, в зависимости от выбранного режима APIXO.
Gemini Omni Flash — это предварительная мультимодальная модель от Google для генерации и редактирования видео. APIXO предоставляет доступ к генерации видео, а также к процессам работы с многократно используемыми аудио- и персонажными ассетами, с референсами в виде текста, изображений, видео и сохранённых ассетов. Создавайте или преобразуйте видео с согласованными визуальными эффектами и звуком, логикой сцен, учитывающей контекст, и опциями вывода APIXO вплоть до 4K.
Входные данные
Текст / Изображение / Видео / Аудио-ассеты
Цена APIXO
$0.10 / secondРедактирование исходного видео оплачивается за операцию
Разрешение APIXO
720p / 1080p / 4K
Длительность
4 / 6 / 8 / 10 секундБез исходного видео
Выпущен
30 мая 2026
Создать с Gemini Omni
Загрузка рабочего пространства...
Объединение креативных референсов в целостное видео
Генерация по смешанным референсам
Видеорежим APIXO принимает промпты вместе с изображениями, одним исходным видео, многократно используемыми ID персонажей и ID аудио. Эти референсы могут управлять внешним видом, движением, структурой сцены и звуком в рамках одного запроса на генерацию видео.
Трансформация исходного видео
Предоставьте одно видео и опишите трансформацию, такую как изменение окружения, визуальной обработки, действия или выбранных элементов сцены. APIXO также предоставляет доступ к начальной и конечной позициям для выбора нужной части входного видео.
Многоразовые ресурсы персонажей
Создайте ресурс персонажа из одного изображения, опционально связанного с одним подготовленным аудиоресурсом. Полученный ID персонажа затем можно многократно использовать в запросах на видео, при этом APIXO поддерживает до трех ID персонажей на одну генерацию.
Многоразовые аудиоресурсы
Создайте аудиоресурс на основе базового голоса, поддерживаемого APIXO, опционального описания голоса и тестового диалога. Сохраните полученный ID аудио для последующих запросов персонажей или видео; видеорежим принимает до трех ID аудио.
Логика сцены с учётом окружения
Google позиционирует Gemini Omni Flash как модель с обширными знаниями о мире и пониманием физического поведения. Это помогает ей создавать сцены с учётом истории, науки, культурного контекста, гравитации, движения, материалов и других реальных взаимосвязей.
Скоординированные визуальные эффекты и звук
Gemini Omni Flash генерирует видео с сопутствующей аудиодорожкой и может реагировать на временные инструкции для диалогов, музыки, эффектов, монтажных склеек и событий на экране. Точность промпта остаётся важной, когда требуется точная синхронизация или тайминг текста.
Конфигурация Gemini Omni на APIXO
Проверенные режимы ассетов, допустимые референсы, настройки вывода и квоты, опубликованные для маршрута APIXO.
Аудиоресурс / Ресурс персонажа / Видео
Режимы
16:9 / 9:16
Соотношения сторон
До 3 ID
Аудиоресурсы
До 3 ID
Ресурсы персонажей
До 1 URL
Исходное видео
7 единиц
Квота на референсы
Создание систем видеопроизводства на основе референсов
Видео с постоянным ведущим
Подготовьте многократно используемого персонажа из утвержденного портрета и свяжите его с выбранным аудиоресурсом. Затем приложения смогут генерировать короткие видеоролики кампаний с ведущим в различных сценах, повторно используя те же референсы персонажа и голоса.
Мультимодальные истории о продуктах
Объедините изображения продуктов, ресурсы персонажей, аудиоинструкции и письменное описание сцены для создания роликов для запуска или рекламных концепций. Используйте горизонтальную или вертикальную ориентацию для подготовки вариантов для витрин, страниц кампаний и мобильных каналов.
Стилизация исходного видеоматериала
Отправьте существующий клип и запросите новое окружение, визуальный стиль, обработку объектов или повествовательный эффект. Элементы управления началом и концом позволяют разработчикам выбрать нужный сегмент исходного видео перед применением трансформации через APIXO.
Визуальные объяснения и раскадровки
Используйте знания о мире и физическое моделирование Gemini Omni для создания коротких объясняющих роликов по науке, истории, процессам или концепциям со скоординированным повествованием и движением. Рассматривайте фактический результат как черновик и проверяйте важные детали перед публикацией.
Подготовьте ресурсы для повторного использования перед генерацией видео
APIXO разделяет необязательную подготовку аудио и персонажей от асинхронной генерации видео с помощью Gemini Omni.
Создать аудиоресурс
Выберите базовый голос, поддерживаемый APIXO, назовите ресурс и при желании укажите интонацию и текст для предпросмотра. Сохраните полученный ID аудио для последующего использования с персонажем или непосредственно в запросе на создание видео.
Подготовить ресурс персонажа
Отправьте ровно одно общедоступное изображение персонажа с описательным промптом и, при необходимости, один сохранённый ID аудио. Сохраните полученный ID персонажа, чтобы на него можно было ссылаться в будущих задачах по созданию видео с помощью Gemini Omni.
Сгенерировать финальное видео
Объедините промпт с подходящими изображениями, ID аудио, ID персонажей или одним исходным видео. Выберите поддерживаемое APIXO разрешение и кадрирование, затем получите готовое видео через асинхронный опрос или доставку по вебхуку.
Доступность и ограничения Gemini Omni
Примечания по эксплуатации
Эта страница описывает текущие режимы APIXO для видео, аудиоассетов и ассетов персонажей в Gemini Omni. Она не относится к API Gemini для чата, генерации изображений, анализа документов или отдельного синтеза речи.
Playground в браузере APIXO работает только в режиме видео; подготовка аудио- и персонажных ресурсов задокументирована для использования через API.
APIXO не документирует прямую загрузку аудиофайлов для этого маршрута; в запросах на создание видео используются ID аудио, созданные в режиме аудиоресурсов.
Совокупная квота на изображения, исходные видео и персонажей составляет семь единиц; одно видео потребляет две единицы, а каждое изображение или персонаж — одну.
APIXO не предоставляет доступ к рабочему процессу Gemini с отслеживанием состояния через previous_interaction_id, сессиям в реальном времени, анализу документов или использованию инструментов на этой конечной точке.
Английский язык полностью поддерживается на стороне провайдера; другие языки не были протестированы и могут давать менее предсказуемые результаты.
Часто задаваемые вопросы
APIXO предлагает три режима: создание аудиоресурса, создание ресурса персонажа и асинхронная генерация видео. Режимы ресурсов подготавливают ID для повторного использования в видеозапросах; они не являются самостоятельными конечными точками для создания музыки, распознавания речи, генерации изображений или диалоговых ответов.
Без исходного видео генерация в 720p и 1080p стоит $0.10 за секунду, а в 4K — $0.20 за секунду. При наличии одного исходного видео APIXO взимает $1.20 за запрос в 720p или 1080p и $1.80 за запрос в 4K.
Видео, сгенерированные по промпту и референсу без исходного видео, поддерживают длительность 4, 6, 8 или 10 секунд. При предоставлении URL исходного видео APIXO игнорирует настройку длительности и вместо этого использует выбранный сегмент видеовхода и фиксированную оплату за запрос.
APIXO документирует преобразование одного загруженного исходного видео на основе промпта, но не публикует параметр stateful multi-turn interaction от Google для этой конечной точки. Рассматривайте каждую задачу APIXO как независимый запрос, если только в текущей схеме позже не будет задокументировано состояние диалога.
Другие модели
Откройте для себя больше AI-моделей для вашего следующего творческого процесса