APIXO

Каталог моделей

Новые и популярные модели

Начните с моделей, которые пробуют в первую очередь, а затем ищите и фильтруйте полный каталог по типу результата или рабочему процессу.

Рабочий процесс

Моделей: 67

Показан полный каталог

Seedance 2.0

bytedance

Seedance 2.0

Seedance 2.0 is ByteDance's multimodal video model supporting text-to-video, first-and-last-frames, and omni-reference modes. APIXO exclusive: unlimited concurrency, real-person portrait support, and hidden capabilities.

ВидеоНовоеПопулярныеТекст в видеоИзображение в видео
от $0.0573/секПросмотреть
Seedance 2.0 Fast

bytedance

Seedance 2.0 Fast

Seedance 2.0 Fast is the speed-optimized variant of ByteDance's multimodal video model. It supports text-to-video, first-and-last-frames, and omni-reference modes with lower per-second pricing and the same APIXO-exclusive capabilities.

ВидеоНовоеПопулярныеТекст в видеоИзображение в видео
от $0.044/секПросмотреть
GPT-Image-2

OpenAI

GPT-Image-2

GPT-Image-2 is OpenAI's next-generation image model for stronger photorealism, cleaner image editing, and sharper in-image text rendering.

ИзображениеНовоеПопулярныеТекст в изображениеИзображение в изображение
от $0.03/изображениеПросмотреть
HappyHorse

Alibaba

HappyHorse

HappyHorse is Alibaba's video generation and editing model for text-to-video, image-to-video, reference-guided generation, and video-edit workflows with 720p/1080p output.

ВидеоНовоеПопулярныеТекст в видеоИзображение в видео
от $0.375/секПросмотреть
Flux 2

Black Forest Labs

Flux 2

BFL’s latest Pro & Flex pipelines for text-to-image and image-to-image with unified 1K/2K pricing and ~30s generation.

ИзображениеНовоеПопулярныеТекст в изображениеИзображение в изображение
от $0.04/изображениеПросмотреть
Nano Banana Pro

Google

Nano Banana Pro

Nano Banana Pro is Google's AGI-level image generation model with reasoning capabilities, native 4K output, Search Grounding for real-time data integration, near-perfect text rendering, and superior spatial awareness.

ИзображениеПопулярныеТекст в изображениеИзображение в изображение
от $0.14/изображениеПросмотреть
Midjourney

midjourney

Midjourney

Midjourney is an advanced AI image generation model known for artistic, high-quality outputs. It supports text-to-image, image-to-image, image-edit, Vary, and Upscale workflows.

ИзображениеПопулярныеТекст в изображениеИзображение в изображение
от $0.1/изображениеПросмотреть
Flux Kontext

Black Forest Labs

Flux Kontext

Professional-grade image generation with enhanced prompt understanding and superior quality output.

ИзображениеПопулярныеТекст в изображениеИзображение в изображение
от $0.04/изображениеПросмотреть
GPT-Image-1

OpenAI

GPT-Image-1

GPT-Image-1 is OpenAI's advanced multimodal model for high-quality image generation with natural language understanding.

ИзображениеПопулярныеТекст в изображениеИзображение в изображение
от $0.35/изображениеПросмотреть
Nano Banana

Google

Nano Banana

Gemini 2.5 Flash Image Preview (aka Nano Banana) is an advanced AI model excelling in natural language-driven image generation and editing. It produces hyper-realistic, physics-aware visuals with seamless style transformations.

ИзображениеПопулярныеТекст в изображениеИзображение в изображение
от $0.03/изображениеПросмотреть
Seedream 5.0 Pro

seedream

Seedream 5.0 Pro

Seedream 5.0 Pro is ByteDance's premium single-image model for text-to-image and image-to-image generation, supporting 1K/2K resolution, eight aspect ratios, up to 10 reference images, and strict custom-size control.

ИзображениеНовоеТекст в изображениеИзображение в изображение
от $0.045/изображениеПросмотреть

bytedance

Seedance 1.5 Pro

Seedance 1.5 Pro is ByteDance's per-second video model for fast text-to-video and image-to-video generation with 480p/720p/1080p output, optional sound, aspect ratio control, and fixed-lens camera stability.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.0108/секПросмотреть

Google

Gemini Omni

Gemini Omni is Google's multimodal video generation model for creating videos from text, image references, source video, reusable audio assets, and character asset IDs.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.1/секПросмотреть

Alibaba

Wan 2.7 Image

Wan 2.7 Image is Alibaba's omni-image API for text-to-image, reference-guided image generation, image editing, sequential images, and high-resolution Omni Image Pro workflows.

ИзображениеНовоеТекст в изображениеИзображение в изображение
от $0.03/изображениеПросмотреть
Wan 2.7

Alibaba

Wan 2.7

Wan 2.7 is Alibaba's video generation and editing model for text-to-video, image-to-video, reference-guided generation, and video-edit workflows with optional audio input and 720p/1080p output.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.1/секПросмотреть
Wan 2.6

Alibaba

Wan 2.6

Wan 2.6 is Alibaba's multi-mode video generation model for text, image, flash image, reference, and flash reference workflows, with optional audio input and 720p/1080p output.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.025/секПросмотреть

seedream

Seedream 5.0

Seedream 5.0 is ByteDance's next-generation AI image model with real-time web search, controllable editing, and logical reasoning. It supports text-to-image and image-to-image with 2K/3K resolution, multiple aspect ratios, and up to 14 reference images.

ИзображениеНовоеТекст в изображениеИзображение в изображение
от $0.035/изображениеПросмотреть
Sora 2 Pro

OpenAI

Sora 2 Pro

Sora 2 Pro is OpenAI’s premium video generation model with higher quality output, supporting text-to-video and image-to-video at 720p and 1080p resolutions with flexible durations of 4, 8, or 12 seconds.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.3/секПросмотреть

bytedance

Seedance 2.0 Mini

Seedance 2.0 Mini is ByteDance's lightweight multimodal video model for text-to-video, first-and-last-frames, and omni-reference workflows with 480p/720p output.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.028/секПросмотреть

Alibaba

Wan 2.6 Image

Wan 2.6 Image is Alibaba's text-to-image and image-to-image model with prompt, negative prompt, aspect ratio, batch count, and optional seed control.

ИзображениеНовоеТекст в изображениеИзображение в изображение
от $0.04/изображениеПросмотреть

Alibaba

Wan 2.5 Image

Wan 2.5 Image is Alibaba's batch-friendly image generation model for text-to-image and image-to-image workflows, defaulting to four generated images per request.

ИзображениеНовоеТекст в изображениеИзображение в изображение
от $0.03/изображениеПросмотреть

APIXO

Image Upscaler

Image Upscaler is APIXO's single-image enhancement API for 2K, 4K, and 8K upscaling with JPG, PNG, and WEBP output format control.

ИзображениеНовоеИзображение в изображение
от $0.01/изображениеПросмотреть

APIXO

Image Watermark Remover

Image Watermark Remover is APIXO's authorized single-image cleanup API for removing sample marks or overlays from images you own or have permission to process.

ИзображениеНовоеИзображение в изображение
от $0.015/изображениеПросмотреть

kling

Kling 3.0 Turbo

Kling 3.0 Turbo is Kuaishou's fast video generation model for text-to-video and single-image image-to-video workflows with 720p/1080p output and 3-15 second clips.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.112/секПросмотреть

MiniMax

MiniMax Image 01

MiniMax Image 01 is MiniMax’s text-to-image and image-to-image model with prompt optimization, flexible size control, 1K/2K presets, and up to 9 generated images per task.

ИзображениеНовоеТекст в изображениеИзображение в изображение
от $0.0035/изображениеПросмотреть

MiniMax

MiniMax Speech 2.8

MiniMax Speech 2.8 is an async text-to-speech API with HD and turbo quality modes, preset voices, custom MiniMax voice_id support, emotion control, pronunciation dictionaries, and multilingual output settings.

АудиоНовоеСинтез речиТекст в аудио
от $0.06/трекПросмотреть

MiniMax

MiniMax Voice

MiniMax Voice creates reusable custom voice IDs from text-described voice design or a single public reference audio clip, then returns preview audio for validation.

АудиоНовоеТекст в аудио
от $0.5/трекПросмотреть

hailuo

Hailuo 2.3

Hailuo 2.3 is Miniax's async video model with standard and pro modes for text-to-video and image-to-video generation. Standard mode supports 6s/10s at 768p, while pro mode returns fixed 5s at 1080p.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.336/секПросмотреть

hailuo

Hailuo 2.3 Fast

Hailuo 2.3 Fast is Miniax's speed-optimized image-to-video model with standard and pro modes. Standard supports 6s/10s at 768p, while pro returns fixed 6s output at 1080p.

ВидеоНовоеИзображение в видео
от $0.192/секПросмотреть

xai

Grok Image

Grok Image is xAI's image generation model for text-to-image and image-to-image workflows with simple aspect-ratio control and async task delivery. Text-to-image returns 6 images per request on APIXO.

ИзображениеНовоеТекст в изображениеИзображение в изображение
от $0.02/изображениеПросмотреть

Alibaba

Wan 2.2 Animate

Wan 2.2 Animate API is Alibaba's character animation model that combines one source image and one motion video to generate stylized animated outputs with animate/replace behavior.

ВидеоНовоеВидеоэффекты
от $0.04/секПросмотреть

xai

Grok Video

Grok Video is xAI's async video generation model for text-to-video and image-to-video workflows, with optional continuation via task_id + index and style control.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.015/секПросмотреть

kling

Kling 3.0 Std

Kling 3.0 Std is Kuaishou's standard-quality video generation model with text-to-video, image-to-video, and motion-control modes. It supports clips up to 15 seconds with optional sound generation and flexible aspect ratios.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.42/секПросмотреть

MeiGen

InfiniteTalk

InfiniteTalk converts one photo plus audio into audio-driven talking or singing avatar videos with precise lip synchronization. Supports up to 10 minutes at 480p or 720p resolution.

ВидеоНовоеИзображение в видео
от $0.03/секПросмотреть

Google

Nano Banana 2

Nano Banana 2 is Google’s high-resolution image generation model with 1K/2K/4K output control, 20,000-character prompts, optional Google Search context, and support for up to 14 reference images.

ИзображениеНовоеТекст в изображениеИзображение в изображение
от $0.072/изображениеПросмотреть

vidu

Vidu Q3

Vidu Q3 is a per-second video generation model that combines standard and Turbo text-to-video plus image-to-video workflows in one API. It supports single-image animation, first-and-last-frame transitions, optional sound and BGM, and output up to 1080p.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.04/секПросмотреть

kling

Kling 2.5 Turbo Pro

Kling 2.5 Turbo Pro is Kuaishou's high-speed video model for text-to-video and image-to-video creation. It supports 5-10 second clips, optional tail-frame images, aspect ratio control for text-to-video, plus negative prompts and CFG scale guidance.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.3/секПросмотреть

Lightricks

LTX-2 19B

LTX-2 19B is Lightricks' open-source 19B diffusion transformer for cinematic video generation. It supports text-to-video and image-to-video workflows, LoRA conditioning, and high-fidelity outputs up to 1080p in the API.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.012/секПросмотреть

kling

Kling 2.1

Kling 2.1 is Kuaishou's multi-tier video model with Standard, Pro, and Master modes for image-to-video and text-to-video creation. It supports 5-10 second clips, optional tail images for Pro, and aspect ratio control for Master text-to-video.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.2/секПросмотреть

kling

Kling 2.6

Kling 2.6 is Kuaishou's native audio-visual video model that generates video, speech, sound effects, and ambience in one pass. It supports text-to-audio-visual and image-to-audio-visual creation with Chinese and English voice generation and up to 10-second clips.

ВидеоНовоеТекст в видеоИзображение в видео
от $0.3/секПросмотреть
Suno V5

suno

Suno V5

Latest Suno text-to-music model that returns two polished songs per call with faster queues and richer vocals.

АудиоНовоеТекст в аудио
от $0.12/трекПросмотреть

Claude

Claude Opus 4.8

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $3/1M входных данныхПросмотреть

Claude

Claude Opus 4.7

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $3/1M входных данныхПросмотреть

Claude

Claude Opus 4.6

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $3/1M входных данныхПросмотреть

Claude

Claude Opus 4.5 20251101

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $3/1M входных данныхПросмотреть

Claude

Claude Sonnet 4.6

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $1.8/1M входных данныхПросмотреть

Claude

Claude Sonnet 4.5

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $1.8/1M входных данныхПросмотреть

Claude

Claude Sonnet 4.5 20250929

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $1.8/1M входных данныхПросмотреть

Claude

Claude Haiku 4.5 20251001

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $0.6/1M входных данныхПросмотреть

OpenAI

GPT-5.5

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $3/1M входных данныхПросмотреть

OpenAI

GPT-5.4

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $1.5/1M входных данныхПросмотреть

OpenAI

GPT-5.4 Mini

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $0.45/1M входных данныхПросмотреть

OpenAI

GPT-5.3-Codex

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $1.05/1M входных данныхПросмотреть

OpenAI

GPT-5.2

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $1.05/1M входных данныхПросмотреть

OpenAI

GPT-5.2-Codex

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $1.05/1M входных данныхПросмотреть

OpenAI

GPT-5 Mini

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $0.15/1M входных данныхПросмотреть

Gemini

Gemini 3.5 Flash

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $0.9/1M входных данныхПросмотреть

Gemini

Gemini 3.1 Pro Preview

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $1.2/1M входных данныхПросмотреть

Gemini

Gemini 3.1 Flash Lite Preview

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $0.15/1M входных данныхПросмотреть

Gemini

Gemini 3 Flash Preview

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $0.3/1M входных данныхПросмотреть

Gemini

Gemini 2.5 Pro

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $0.75/1M входных данныхПросмотреть

Gemini

Gemini 2.5 Flash

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $0.18/1M входных данныхПросмотреть

Gemini

Gemini 2.5 Flash Lite

Совместимый с OpenAI шлюз для чатов, агентов, логических выводов и структурированной генерации.

LLM API
из $0.06/1M входных данныхПросмотреть
Veo 3.1

Google

Veo 3.1

Google DeepMind’s upgraded AI video model with lite, fast, and quality routes, 4/6/8 second duration control, 720p/1080p/4k output, and multi-image reference workflows.

ВидеоТекст в видеоИзображение в видео
от $0.15/секПросмотреть
Wan 2.5

Alibaba

Wan 2.5

Wan 2.5 is Alibaba's video generation model for text-to-video and image-to-video workflows, with optional audio input, 480p/720p/1080p output, 5 or 10 second clips, and prompt expansion.

ВидеоТекст в видеоИзображение в видео
от $0.05/секПросмотреть
Sora 2

OpenAI

Sora 2

Sora 2 is OpenAI’s latest AI video generation model, supporting both text-to-video and image-to-video. It delivers realistic motion, physics consistency, with improved control over style, scene, and aspect ratio—ideal for creative apps and social media content.

ВидеоТекст в видеоИзображение в видео
от $0.1/секПросмотреть

seedream

Seedream 4.5

Seedream 4.5 is a powerful text-to-image and image-to-image AI model delivering high-quality image generation with support for 2K and 4K resolutions.

ИзображениеТекст в изображениеИзображение в изображение
от $0.035/изображениеПросмотреть