APIXO
動画生成リファレンスガイド動画編集

AlibabaのHappyHorse 1.0は、動画生成、リファレンスベースの作成、指示ベースの編集を単一のAPIXOルートに統合します。テキストや画像から3〜15秒の動画を生成したり、複数のビジュアルリファレンスで新しいシーンを誘導したり、既存の動画を変換したりできます。その際、720pまたは1080pの出力と、ワークフロー固有のオーディオ動作を選択可能です。

APIXOワークフロー

生成 / リファレンス / 編集

APIXO価格

$0.125/秒から720p単価

APIXO 解像度

720p / 1080p

生成時間

3~15秒

オーディオ

デフォルトで含まれる

HappyHorseで作成

ワークスペースを読み込み中...

1つのルート、4つのワークフロー

短編動画の作成、誘導、アニメーション化、または変換

HappyHorseは、単一のプロンプトから動画を生成するだけではありません。テキストから始めたり、アップロードした画像を最初のフレームとして固定したり、最大9枚の画像を視覚的なガイドとして使用したり、既存のクリップを編集したりできます。APIXOは、これらのワークフローを互換性のあるモードとして扱うのではなく、それぞれに適した入力を持つ個別のワークフローとして提供します。

機能

動画をディレクションする4つの異なる方法

テキストからの動画生成

被写体、アクション、カメラワーク、雰囲気、スタイル、オーディオキューを記述した必須のプロンプトから新しいクリップを生成します。APIXOはこのワークフローに対して、横長、縦長、正方形、4:3のフレーミングを含む5つのアスペクト比を提供します。

固定フレームアニメーション

「画像から動画」モードでは、1枚のソース画像を受け取り、それを最初のフレームとして使用します。プロンプトは任意で、自由なアニメーションを生成するか、動きやカメラワーク、サウンドに対してより明確な指示を与えることができます。

複数リファレンスによるガイダンス

「リファレンスから動画」モードでは、必須のプロンプトと1枚から9枚の画像を組み合わせます。これらのアセットは、新しく生成されるシーン内の被写体やビジュアルをガイドするものであり、固定された開始フレームや終了フレームではありません。

指示ベースの編集

動画編集は、必須の指示に従って既存の動画1本を変換します。被写体、物体、環境、またはスタイルに関する視覚的なガイダンスが編集に必要な場合は、最大5枚の参照画像を任意で追加します。

統合された音声出力

APIXO経由でのHappyHorseの出力には、デフォルトで音声が含まれます。生成モードには音声を無効にするスイッチはありませんが、動画編集モードでは自動音声を使用するか、ソース動画の元の音声を保持するかを選択できます。

Seed値と透かしの制御

APIXOでは、720pと1080pの出力、オプションのランダムシード、透かし設定を利用できます。解像度は請求レートに影響し、シード制御は関連するリクエスト間でのより体系的な実験をサポートします。

ワークフローグループ

新規生成かソースベースの変換かを選択

新しい動画を生成

プロンプトのみで生成する場合は「テキストから動画」、1枚の画像を最初のフレームにする必要がある場合は「画像から動画」、複数の画像で新しい構図をガイドする場合は「参照から動画」を使用します。APIXOはこれら3つのワークフローに3〜15秒の再生時間制御を適用します。

テキストと画像

既存の動画を編集

必須の編集指示に加え、入力動画を1本、およびオプションで最大5枚の参照画像を指定します。動画編集ではAPIXOの公開されている生成再生時間フィールドは使用されません。出力動画の長さと請求額は、ソース動画に基づいて決定されます。

動画変換
API仕様

APIXO経由のHappyHorseコントロール

生成に関する制限はワークフローによって異なり、ドキュメントに記載されている場合にのみ適用されるべきです。

最大2,500文字

プロンプトの長さ

16:9 / 9:16 / 1:1 / 4:3 / 3:4

生成アスペクト比

最初の1フレームを固定

画像から動画

画像1~9枚

リファレンスガイダンス

動画1本 + 画像0~5枚

編集入力

MP4動画URL

APIXOの結果

本番環境での利用

適応性の高い短編動画パイプラインを構築

Eコマース

製品広告のバリエーション

テキストから製品デモやキャンペーンコンセプトを生成したり、承認された製品の静止画をオープニングフレームとしてアニメーション化したり、複数のリファレンスビューを使用して新しいシーンを誘導したりできます。公開前に、製品の形状、ラベル、主張内容を確認してください。

デジタルプレゼンター

プレゼンターと対話のコンセプト

統合された音声出力で、プレゼンター、スポークスパーソン、対話主導のコンセプトを短時間で開発できます。リファレンス画像で外見を誘導できますが、正確なアイデンティティ、発話内容、発音、リップシンクは、制作に使用する言語と被写体ごとに検証する必要があります。

ブランドプロダクション

リファレンスガイド付きキャンペーンシーン

キャラクター、製品、服装、環境、スタイルのリファレンスを単一の生成リクエストに組み合わせます。最初のフレームをアニメーション化する場合とは異なり、指定された画像は視覚的なガイダンスとして機能し、開始時の構図を規定するものではありません。

ポストプロダクション

ガイド付き動画リスタイリング

既存のクリップ1本を、外見、環境、または視覚的処理に関する指示に従って変換します。連続性が重要な場合は元のサウンドトラックを維持し、編集結果がHappyHorseのデフォルト処理に従うべき場合は、音声の自動処理を選択します。

ワークフローに関する注記

各モードに正しいルールを適用

APIXOの制約

01

テキストから動画、参照から動画、動画編集ではプロンプトが必須です。画像から動画ではプロンプトを省略できます。

02

生成モードでは3秒から15秒の再生時間が指定可能です。動画編集モードでは、公開されている再生時間パラメータはありません。

03

アスペクト比の選択は、APIXOを通じたテキストから動画、および参照からの動画生成にのみ適用されます。

04

公開されているAPIXOスキーマでは、生成される音声を完全に無効にすることはできません。

05

APIXOは非同期ポーリングまたはWebhook配信をサポートし、生成された動画のURLを1つ返します。

06

入力と出力はプロバイダーの安全性レビューの対象となります。重要な結果は速やかに保存してください。

HappyHorseに関するよくある質問

記載されているワークフローは、Alibaba Cloud Model StudioのHappyHorse 1.0ファミリー(happyhorse-1.0-t2v、happyhorse-1.0-i2v、happyhorse-1.0-r2v、happyhorse-1.0-video-edit)に対応しています。APIXOはこれらのワークフローをhappyHorseルートでグループ化しています。

「画像から動画」モードのみです。このモードでは1枚の画像が必須で、それが最初のフレームとして使用されます。「リファレンスから動画」モードでは、1枚から9枚の画像を新しいシーンの視覚的ガイドとして受け入れますが、それらを動画フレームとして固定するわけではありません。

APIXOは、720pで1秒あたり$0.125、1080pで1秒あたり$0.225を請求します。テキストから動画、画像から動画、リファレンスから動画の料金は、選択された再生時間と解像度のレートに基づいて請求されます。

APIXOの動画編集における請求額は、入力動画の秒数と生成された出力動画の秒数の合計に、選択した解像度のレートを乗じて算出されます。請求対象となる入力動画の秒数は最大15秒で、生成された動画側も同じく最大15秒で請求されます。

はい。video-editモードで、APIXOのaudio_settingをoriginに設定すると、入力ビデオの元の音声が保持されます。もう一つの設定であるautoは、ルートの自動オーディオ動作を使用します。完全に無音にする設定は公開されていません。

他のモデルを見る

次のクリエイティブワークフローのために、さらに多くのAIモデルを発見しましょう