APIXO 会检测动作视频的时长,并应用 5 秒最低和 120 秒计费上限。480p 分辨率的费率为每计费秒 $0.04,720p 为 $0.08。例如,5 计费秒的 480p 视频费用为 $0.20;10 计费秒的 720p 视频费用为 $0.80。
APIXO 上的 Wan 2.2 Animate 可将一张源图片与一个动作视频精确结合,用于角色动画或替换。您可以将身体动作和表情迁移到一张图片上,或替换现有影片中的主要表演者。该模型以标准模式输出 480p 或 720p 分辨率,并采用基于时长的异步处理方式。
工作流
动画生成 / 替换
APIXO 价格
$0.04–$0.08 / 秒
分辨率
480p / 720p
必需输入
1 张图片 + 1 个视频
计费时长
最低 5 秒 / 上限 120 秒
正在加载工作区...
选择 `animate` 将动作视频中的身体动作和面部表情迁移到源图片所示的角色上。源图片引导角色外观,而视频提供动作和表演时机;背景和精细的身份细节仍需审核。
选择 `replace` 将动作视频中的主要角色替换为源图片中的角色。模型会尝试在更换表演者的同时,保留原始的动作、表情、场景、光照和色调。
录制表演中的面部表情可以与身体动作一同引导动画角色。但精细的面部特征和唇部动作在不同帧之间仍可能存在差异。
源图片定义了目标角色的视觉外观,而 Wan AI 则负责重建其表演动作。在复杂的动作中,服装、发型、身体比例和精细的身份细节可能会发生变化。
替换模式会将图像中的角色嵌入到动态视频中,同时尝试保留原视频的动作、表情、场景、光照和色调。但边缘、被遮挡区域及周围细节可能仍会发生变化。
APIXO 接受可选的提示词,用于指定风格、行为或保留优先级。但动作仍来自必需的视频,而非独立根据文本生成。
选择 animate 将动作视频中的身体动作和面部表情迁移到源图片所示的角色上。工作流会遵循所提供的表演,同时重建图片中的角色及其周围场景。
选择“替换”选项,将运动视频中的主角替换为源图像中的角色。模型会尝试在更换表演者的同时,保留原有的运动、表情、场景、镜头、光照和色调。
通过 APIXO 开放的已验证字段和交付行为。
仅限标准模式
服务模式
仅限 1 个 URL
源图片
仅限 1 个 URL
动作视频
MP4 / MOV / M4V
视频输入
MP4 URL
结果
轮询 / 回调
交付
将录制的舞蹈、手势序列或物理表演应用于角色图片,无需构建传统的动作捕捉流程。请仔细检查手部、四肢、遮挡、快速运动和身体比例的效果。
使用真人表演作为动作指导,为动漫、卡通、游戏或插画角色概念生成动画。清晰的画面构图和相近的身体比例通常能提供更好的初始效果。
将测试片段中的主要角色替换为不同的角色设计,同时保留原有的动作和场景编排。请检查背景边缘、光照连续性、头发、服装和身份稳定性。
在进行全面制作前,可用于探索数字主持人、广告概念、社交短片、电影走位或游戏过场动画。请确保使用的每个源图片、角色和表演者均已获得授权。
APIXO 的统一路由在概念上对应于阿里巴巴的 Animate 框架和云端 move and mix 行为,但仅开放 mode: "standard"。
两种工作流类型都需要提供一个源图片 URL 和一个可直接访问的 HTTP 或 HTTPS 动作视频 URL。
APIXO 接受 MP4、MOV 或 M4V 格式的动作视频 URL,该 URL 必须保持可访问,并支持通过范围读取或完整下载进行探测。
APIXO 未公布关于源图像格式、文件大小限制、尺寸限制、宽高比要求、编解码器规则、帧率限制或可变帧率支持的信息。
生成时间取决于动态视频的时长、输出分辨率、队列负载和路由健康状况。针对此路由,APIXO 不会公布固定的首次轮询延迟或轮询间隔。
APIXO 未公布此路由的结果保留期限,因此应用程序应在成功生成 MP4 输出后立即下载并存储。
APIXO 会检测动作视频的时长,并应用 5 秒最低和 120 秒计费上限。480p 分辨率的费率为每计费秒 $0.04,720p 为 $0.08。例如,5 计费秒的 480p 视频费用为 $0.20;10 计费秒的 720p 视频费用为 $0.80。
文档仅说明计费上限为 120 秒,并未确认是否接受、截断或完全处理任意长度的视频。因此,计费上限不应被视为对输入或输出时长的保证。
APIXO 未对任何工作流的输出音频行为做出文档说明。在用代表性素材测试当前路由之前,请勿假定源音频会被保留、重新生成或移除。
为获得最佳效果,请确保图像中有一个清晰可见的角色,且该角色与动态视频中的角色在画面比例和身体比例上相似,遮挡物最少,且源素材为高清。多人、肢体被裁剪、剪辑切换、镜头快速移动或模糊的素材都可能降低生成结果的可靠性。
APIXO 未提供专业模式、负向提示词、相机预设、动作强度控制、遮罩、边界框、姿态关键点、多参考图、参考权重、降噪设置、输出数量控制或明确的音频参数。使用种子值的尝试不具有确定性。
探索更多 AI 模型,赋能您的创意工作流