APIXO
视频生成同步音频两种输出层级

Sora 2 Pro 是 OpenAI 更高质量的 Sora 2 音视频模型,用于生成包含同步声音的精细短场景。APIXO 将其路由直接映射到 sora-2-pro,提供两种输出级别的文生视频和单图生视频功能,时长可选 4 秒、8 秒或 12 秒。

工作流

文/图生视频

APIXO 价格

$0.30–$0.50 / 秒

APIXO 输出层级

720p / 1080p

时长

4 / 8 / 12 秒

推出时间

2025年9月30日

使用 Sora 2 Pro 创作

正在加载工作区...

APIXO 上的 Sora 2 Pro

更高保真度的 Sora 生成,带有同步场景音频

OpenAI 将 Sora 2 Pro 定位为其更先进、更高质量的 Sora 2 模型。APIXO 将其封装为异步 API,提供独立的文生视频尺寸和图生视频分辨率控制,支持以两种定价级别制作纵向或横向视频。

能力

为指定的短场景生成精细的视听内容

更高保真度的输出

OpenAI 通过更高质量的生成效果来区分 Sora 2 Pro,而 APIXO 则同时开放了 720p 和更高分辨率的输出级别,以满足需要额外视觉细节的工作流。

同步场景音频

Sora 2 系列模型可同步生成视频与音频,包括与屏幕画面动作相匹配的语音、环境氛围音和音效。

物理场景处理

Sora 2 在物理行为模拟上比早期系统有所改进,有助于使动作、碰撞和环境反应看起来更合理,但并不能保证完美的物理或解剖学表现。

时序场景连续性

改进了世界状态处理,支持在整个视频片段中保持更持久的对象和场景条件,但复杂的交互和快速变化仍可能引入连续性错误。

多镜头指导

详细的提示词可以描述多个镜头、动作、镜头切换和过渡,让创作者对紧凑的叙事序列和视觉节奏有更多控制。

广泛的视觉范围

Sora 2 Pro 能够生成写实、电影感、动漫及其他风格化场景,同时能理解关于构图、氛围、镜头运动和整体视觉处理的指令。

生成模式

两种工作流,提供特定模式的输出控制

指定维度的文生视频

提交提示词、时长和尺寸。APIXO 将 720*1280 和 1280*720 尺寸归为 720p 等级,而 1024*1792 和 1792*1024 则使用价格更高的 1080p 等级。

文生视频

带分辨率选择的图生视频

提交一个提示词和一个可公开访问的参考图 URL,然后选择 720p 或 1080p 分辨率。该图像提供视觉条件,但不能保证其作为第一帧且完全不变。

图生视频
API 详情

Sora 2 Pro 接口规格

经 APIXO 实现验证并记录的字段和输出。

1–5,000 个字符

提示词

异步 / 回调

交付

4 种纵向/横向尺寸

文本输出

720p / 1080p

图像输出

1 个公开 URL

图片输入

resultJson 中的 MP4 URL

结果

应用场景

适用于 Sora 2 Pro 的生产工作流

营销活动制作

精细的广告场景

生成简短的营销活动概念,结合指定的动作、镜头移动、对话、环境声和音效。更高分辨率的输出级别可支持需要额外图像细节的审阅资产。

视觉开发

高分辨率预可视化

在拍摄或制作动画前,探索镜头构图、场面调度、灯光、物理动作和镜头路径。请将输出视为需要审核的创意研究,而非精确的生产模拟。

静态图片动画化

为优质关键艺术作品生成动画

根据一张产品图片、海报、插画或概念图生成新视频。请允许模型进行解读,因为无法保证精确还原身份、排版、构图和产品几何形状。

叙事性媒体

风格化视听短片

构建简洁的现实、电影、动漫或插画风格序列,其中场景指导和生成的声音源自同一提示词主导的工作流。

说明与常见问题

Sora 2 Pro 操作指南

集成说明

01

APIXO 将此路由直接映射到 OpenAI 模型 ID sora-2-pro,与标准的 sora-2 分开。

02

OpenAI 目前将 Sora 2 Pro 标记为“Legacy”(旧版)并列为“Deprecated”(已弃用)。OpenAI 表示 Sora API 将于 2026 年 9 月 24 日停止服务,而 APIXO 目前仍继续为该接口提供文档支持。

03

APIXO 将 1024×1792 和 1792×1024 分辨率标记为 1080p 计费层级。这些确切的尺寸不同于 OpenAI 官方 API 所暴露的 1080×1920 和 1920×1080 层级。

04

APIXO 支持异步轮询或回调交付,并通过 resultJson 返回最终的 MP4 URL。APIXO 未为此接口提供音频切换或去水印的字段。

05

APIXO 的典型处理时间:4 秒或 8 秒视频为 2-5 分钟,12 秒视频为 3-6 分钟;建议在 120 秒后进行首次轮询,之后每 5-10 秒轮询一次。

06

APIXO 未说明此接口的结果保留期限或生成失败的退款政策,因此请及时保存成功输出,不要假设会获得补偿。

常见问题解答

OpenAI 将 Sora 2 Pro 定位为其更先进、更高质量的同步音频视频模型。APIXO 也为 Pro 接口提供了两个输出级别,包括其标准版 Sora 2 接口中没有的更大尺寸。

APIXO 的详细文档列出 720p 每秒 $0.30,1080p 每秒 $0.50。成本等于所选费率乘以时长:4 秒为 $1.20–$2.00,8 秒为 $2.40–$4.00,或 12 秒为 $3.6–$6.00。

APIXO 未提供音频设置。该模型会生成同步的场景音频,但此接口文档未提供禁用声音、上传音频输入、对话框、发音控制或保留源音频的选项。

APIXO 仅提供文生视频和单张图生视频功能。此接口不提供故事板、混音、重新剪辑、循环、融合、续写、扩展、编辑、视频生视频、角色客串或多张参考图功能。

Sora 2 Pro 没有提供去水印字段的文档说明。应用程序不应假定可见的水印或 C2PA 溯源元数据可以通过此接口移除。APIXO 同样未开放种子值、负向提示词、相机预设、安全级别或输出数量等字段。

探索其他模型

探索更多 AI 模型,赋能您的创意工作流