它可输出 1080p, 2K, 4K。全部 3 种生成模式(text-to-video、image-to-video 和 reference-to-video)均提供相同的分辨率档位。
Wan 3.0 Video Pro LoRA
Wan 3.0 Video Pro LoRA 将文生视频、图生视频和参考视频生成的输出上限提升至 4K。您可以融合图像、视频和音频参考,设置明确的视频长度,或由智能时长自动决定。
模式
文本 / 图像 / 参考
APIXO 价格
$0.189 / 秒 起
时长
智能或 2–30 秒
参考类型
图片 / 视频 / 音频
分辨率
1080p / 2K / 4K
使用 Wan 3.0 Video Pro LoRA 创作
正在加载工作区...
专为需要交付级分辨率的项目简报打造
1080p, 2K, 4K 输出
每次请求均可选择交付分辨率。每秒费率随分辨率而定,且在所有 3 种生成模式下完全一致。
三种参考通道
通过图像、视频或音频引导“参考至视频”请求,无需将所有指令都压缩到提示词中。
首尾帧图像
图生视频最多支持 2 张图片(即起始帧及可选的结束帧)。参考模式最多支持 10 张图片。
视频参考引导
最多可附加 5 个参考视频,每个视频的时长在 1–15 秒之间,且参考视频的总时长最多不超过 15 秒。参考视频的实际时长将按所选分辨率的费率计费。
音频参考,无额外费用
在参考模式下,最多可添加 5 个音频参考,每个时长为 1–15 秒。使用音频参考可引导生成方向,且无需支付额外的音频输入费用。
智能时长
开启“智能时长”以让模型决定输出长度,或选择 2 至 30 秒之间的任意整数来显式指定片段时长。
已发布的 Wan 3.0 Video Pro LoRA API 参数
3 种生成模式
模式
1080p / 2K / 4K
分辨率
智能或 2–30 秒
时长
最多 10 张图片
图像参考
最多 5 个视频
视频参考
默认启用
声音
当交付作品需要在全分辨率下依然经得起检验时
4K 主打视频
当视频片段在后续流程中需要进行放映、裁剪或重新构图,且 1080p 的母片无法满足后期剪辑要求时,请使用 4K 渲染最终成片。
参考引导式场景开发
在单次图/视频生视频请求中,您可以结合使用参考图和简短的视频片段,以明确传达主体、视觉风格和运动轨迹。
首尾帧动态
当所需视频片段需要在两个已知的视觉状态之间转换时,可提供一张起始图像和一张可选的结束图像。
低清草稿,高清交付
先在 1080p 档位探索构图与节奏,然后仅针对需要交付的镜头,使用更高的档位(最高可达 4K)重新运行已确认的方案。
Wan 3.0 Video Pro LoRA 输入与计费指南
备注
仅 text-to-video 模式需要提示词,image-to-video 和 reference-to-video 模式支持空提示词。
智能时长使用 -1。后端将首先预扣 30 秒的费用,随后根据生成成功的视频实际时长进行结算并退还差额。
参考视频时长按与输出视频相同的分辨率费率计费。参考音频不单独收取输入费用。
对于固定的正数时长,输出秒数加上参考视频总秒数不能超过 30 秒。
默认启用声音,且不改变价格。如果请求需要生成无声片段,请显式设置该字段。
视频参考支持最多 10 张图片、5 个视频和 5 个音频文件。每个参考视频或音频文件时长须在 1–15 秒之间,且每种媒体类型的总时长最多为 15 秒。
常见问题解答
输出时长按秒计费,单价为每秒 $0.189 至 $0.322,具体仅取决于输出分辨率 —— 费率表列出了所有档位。所有 3 种生成模式共享相同的费率;视频参考生成(reference-to-video)会额外按参考视频的实际时长计费。
当 duration 为 -1 时,由于最终时长尚不可知,后台会预扣 30 秒的费用。生成成功后,将根据实际时长进行结算并退还差额。
参考转视频支持图片、视频和音频。最高支持 10 张图片、5 个视频和 5 个音频参考,每个参考视频或音频文件的时长为 1–15 秒。
两款模型支持相同的参数和模式。标准模型输出 480p, 720p, 1080p,而此 Pro 模型输出 1080p, 2K, 4K。两款模型对共有的 1080p 档位定价不同,请在选择前对比费率表。
探索其他模型
探索更多 AI 模型,赋能您的创意工作流
