APIXO
视频生成多模态参考低成本路由

Seedance 2.0 Mini 是 APIXO 为字节跳动 Seedance 2.0 提供的低成本路由,并非一个独立记录的上游字节跳动模型。它支持提示词生成、首尾帧动画和混合媒体参考工作流,可选生成声音和网络搜索,输出分辨率为 480p 或 720p,视频片段时长记录在 4-15 秒范围内。

APIXO 模式

3 个工作流

APIXO 价格

$0.012–$0.041 / 秒

分辨率

480p / 720p

时长

4–15 秒

Seedance 2.0 发布

2026年2月12日

使用 Seedance 2.0 Mini 创作

由 APIXO 路由

以 Mini 专属定价访问 Seedance 2.0 的特定工作流

字节跳动官方发布的 Seedance 2.0 是一个统一的多模态音视频模型,并未单独发布 Mini 架构或模型 ID。APIXO 使用的 Mini 名称旨在标识该特定路由所验证的分辨率上限、工作流控制、参考限制以及更低的每秒费率,而非指代一个有独立文档的上游模型版本。

能力

通过提示词、关键帧和混合媒体引导短视频

多模态条件

将书面指令与图像、视频和音频相结合,使输出能够借鉴视觉构图、主体、动态、镜头处理、效果或与声音相关的上下文。

关键帧约束的动态生成

为单个开场图像生成动画,或在指定的首尾帧之间生成过渡,让序列拥有明确定义的起始帧和结束帧,而不是仅依赖宽泛的参考指导。

由参考主导的连续性

将可识别的主体、环境、风格和运动线索带入新片段中。结果仍为生成式,当输入包含冲突指令时可能会出现偏差。

音视频同步输出

利用 Seedance 2.0 的音视频生成能力,在创作视觉效果的同时生成声音。APIXO 也通过其声音控制选项提供静音生成功能。

复杂动态理解

借助底层 Seedance 2.0 模型增强的可控性,可以更好地遵循涉及物理动作、镜头移动、主体互动、光照和场景变化的提示词。

网页信息增强上下文

使用一到三个音频参考,并结合图像或视频上下文,以引导节奏、人声质感、环境音或事件时机。APIXO 不保证保留原音轨不变,因此上传的音频应被视为生成内容的上下文参考。

APIXO 配置

Mini 路由的生成限制

通过 APIXO 可用的已验证输出和参考选项。

3

生成模式

4–15 秒

时长范围

6 个选项 + 自动

宽高比

最多 9 个

图像参考

最多 3 个

视频参考

最多 3 个

音频参考

生产应用

通过选择性参考控制来开发短视频

概念开发

探索由提示词引导的场景

将文字简报转化为横向、纵向、方形或超宽画幅的紧凑视频概念,并可选择生成声音。Mini 路由适用于故事板创作、活动构思、社交媒体创意以及 480p 或 720p 分辨率即可满足需求的早期视觉测试。

关键帧动画

用首尾帧生成视频

为审核通过的开场帧生成动画,或连接提供的起始和结束图像。此工作流适用于产品展示、故事板转场、标题处理、角色特写,以及需要精确控制首尾帧的设计导向型动态影像。

营销活动创建

结合品牌参考

混合产品图像、环境、动态素材和可选的音频线索来指导广告创意。在投入生产使用前,请检查 logo、包装、品牌标识、材质、物体几何形状以及参考素材之间的冲突。

运动方向

运动节奏与镜头构思

提供视频素材和音频作为条件,用于控制新生成内容中的动作节奏、镜头语言、表演时机或特效。APIXO 文档未包含直接对源视频进行编辑或保留参考视频音轨的功能。

参考规划

将每个源素材匹配到正确的工作流

APIXO 为提示词生成、关键帧生成和多模态参考生成验证了不同的媒体结构。

选择提示词或关键帧控制

当提示词能完整定义整个场景时,请使用文生视频。当需要一张图像确定开场,或需要两张有序图像锁定运动的起点和终点时,请选择首尾帧动画。

组合 Omni 参考

最多可结合九张图片、三个视频和三个音频文件。每个视频或音频文件的时长必须在 2-15 秒之间,且每种媒体类型的总时长限制为 15 秒。

配置与获取输出

选择分辨率、时长、画幅、是否生成声音,以及可选的生成声音和网页搜索。异步提交任务后,通过状态轮询或 Webhook 推送获取生成的 MP4 URL。

说明与常见问题

路由标识、时长和计费边界

实现说明

01

字节跳动公开了 Seedance 2.0 的文档,但没有公开独立的上游 Seedance 2.0 Mini 架构、检查点或模型 ID。

02

APIXO 的可见创作选择器列出了 4、5、10 和 15 秒的选项,同时描述其支持的输出范围为 4–15 秒。

03

“首尾帧”模式接受一张起始图像,或代表起始和结束帧的两张有序图像。

04

不支持仅包含音频的多模态参考请求;上传的音频必须至少附带一个图像或视频参考。

05

可禁用生成声音;上传的音频仅提供生成上下文,并未被记录为将原样复制的音轨。

06

APIXO 建议在首次查询状态前等待大约 180-300 秒;实际完成时间可能会有变化。

常见问题解答

在字节跳动的公开 Seedance 资料中,并未指明有单独的 Mini 模型。Mini 是 APIXO 的一个路由标签,有明确的 480p 和 720p 输出、特定定价,并专注于提供对三种 Seedance 2.0 工作流的访问。

文生视频、首尾帧生成以及无视频输入的综合参考模式,生成 480p 视频每秒费用为 $0.019,720p 视频每秒费用为 $0.041。使用图片和音频作为参考不增加计费时长。

480p 视频费率为每秒 $0.012,720p 视频费率为每秒 $0.025。APIXO 将根据生成视频的时长加上所有参考视频的总时长来计算费用。

APIXO 未说明是否保留源音频。上传的视频和音频提供多模态条件,而独立的音场字段则控制输出是否包含模型生成的音频。

请检查解剖结构、手部、人物身份、物体接触、快速运动、嵌入文本、参考保真度、转场、音频解读、发音和口型同步。多角色场景或存在冲突的参考素材可能需要简化并重新生成。

探索其他模型

探索更多 AI 模型,赋能您的创意工作流