APIXO
動画生成マルチモーダルリファレンス低コストルート

Seedance 2.0 Miniは、ByteDance Seedance 2.0向けのAPIXOの低コストルートであり、別途文書化された上位のByteDanceモデルではありません。プロンプトによる生成、最初と最後のフレームからのアニメーション、複合メディアリファレンスワークフローを公開しており、オプションで音声生成とウェブ検索、480pまたは720pの出力、4〜15秒の範囲で文書化されたクリップに対応しています。

APIXOモード

3つのワークフロー

APIXO価格

$0.012~$0.041 / 秒

解像度

480p / 720p

再生時間

4~15秒

Seedance 2.0ローンチ

2026年2月12日

Seedance 2.0 Miniで作成

APIXOによるルーティング

Mini専用の価格設定で、Seedance 2.0の特定のワークフローにアクセス

ByteDanceは、Seedance 2.0を単一の統合されたマルチモーダルオーディオビデオモデルとして公式に発表しており、個別のMiniアーキテクチャやモデルIDは公開していません。APIXOのMiniという名称は、独立して文書化されたアップストリームのチェックポイントではなく、このルートで検証済みの解像度の上限、ワークフロー制御、参照制限、およびより低い秒単価のレートを示すものです。

機能

プロンプト、キーフレーム、複合メディアでショート動画をガイド

マルチモーダル条件付け

文章による指示を画像、動画、音声と組み合わせることで、出力が視覚的な構図、被写体、動き、カメラワーク、エフェクト、または音関連のコンテキストから情報を引き出せるようにします。

キーフレーム制約付きモーション

1枚の開始画像をアニメーション化するか、指定した最初と最後のフレーム間のトランジションを生成し、一般的な参照ガイダンスではなく、シーケンスの開始フレームと終了フレームを明確に定義します。

リファレンス主導の連続性

認識可能な被写体、環境、スタイル、動きのヒントを新しいクリップに引き継ぎます。入力に矛盾する指示が含まれている場合、結果は生成的なものとなり、逸脱する可能性があります。

オーディオビジュアル統合出力

Seedance 2.0の音声付き動画生成機能を使用して、映像と同時に音声を作成します。APIXOは、サウンド制御を通じて無音での生成も提供しています。

複雑な動きの解釈

物理的なアクション、カメラの動き、相互作用する被写体、ライティング、シーンの変更を含むプロンプトは、基盤となるSeedance 2.0モデルの向上した制御性で追従します。

ウェブ情報を活用したコンテキスト

画像または動画のコンテキストと並行して1〜3つの音声リファレンスを使用し、リズム、声の質感、雰囲気、またはイベントのタイミングをガイドします。APIXOはサウンドトラックの無変更での保持を文書化していないため、アップロードされた音声は生成のコンテキストとして扱われるべきです。

APIXO設定

Miniルートの生成制限

APIXOを通じて利用可能な、検証済みの出力およびリファレンスオプション。

3

生成モード

4~15秒

再生時間の範囲

6つのオプション + 自動

アスペクト比

最大9つ

参照画像

最大3つ

動画リファレンス

最大3つ

音声リファレンス

本番環境での利用

選択的なリファレンス制御で短尺動画を開発

コンセプト開発

プロンプト主導のシーンを探す

文章の指示書を、オプションの音声付きで、コンパクトな横長、縦長、正方形、またはウルトラワイドの動画コンセプトに変換します。Miniルートは、480pまたは720pで十分な場合の、絵コンテ作成、キャンペーンのアイデア出し、ソーシャルメディア用コンセプト、初期のビジュアルテストに適しています。

キーフレームアニメーション

最初と最後のフレームから動画を生成

承認済みの開始フレームをアニメーション化するか、指定された開始画像と終了画像を繋ぎ合わせます。製品紹介、絵コンテのトランジション、タイトル処理、キャラクターの印象的なシーン、最初と最後のフレームを厳密に制御したいデザイン主導のモーションにこのワークフローを使用します。

キャンペーン作成

ブランド参照を組み合わせる

製品画像、環境、モーション映像、およびオプションの音声キューを組み合わせて、広告コンセプトを指示します。制作に使用する前に、ロゴ、パッケージ、アイデンティティ、素材、オブジェクトの形状、およびリファレンス間の矛盾を確認してください。

モーション方向

トランジションのペースとカメラワークのアイデア

新しい生成において、アクションのリズム、カメラワーク、パフォーマンスのタイミング、またはエフェクトの条件付けとして、映像と音声を提供してください。APIXOは、直接的なソースビデオの編集や参照ビデオのサウンドトラックの保持についてはドキュメント化していません。

リファレンスプランニング

各ソースアセットを正しいワークフローに合致させます

APIXOは、プロンプト、キーフレーム、およびオムニリファレンス生成のために、さまざまなメディア構造を検証します。

プロンプトまたはキーフレーム制御を選択

プロンプトがシーン全体を定義する場合は「テキストから動画」を使用します。1枚の画像で開始シーンを確立するか、2枚の順序付けられた画像で動きの始点と終点を固定する必要がある場合は「開始・終了フレーム」を選択します。

Omniリファレンスの組み立て

最大9枚の画像、3つの動画、3つの音声ファイルを組み合わせることができます。各動画または音声ファイルの再生時間は2〜15秒で、メディアタイプごとの合計再生時間は15秒に制限されます。

出力の設定と取得

解像度、再生時間、フレーミング、生成されるサウンド、およびオプションの生成サウンドとウェブ検索を選択します。タスクを非同期で送信し、ステータスのポーリングまたはWebhookの配信を通じて、結果のMP4 URLを取得します。

注記 & FAQ

ルートの識別、再生時間、および課金の境界

実装に関する注記

01

ByteDanceはSeedance 2.0を文書化していますが、独立したアップストリームのSeedance 2.0 Miniアーキテクチャ、チェックポイント、またはモデルIDは公に特定されていません。

02

APIXOの生成セレクターには4、5、10、15秒のオプションが表示されていますが、サポートされる出力範囲は4~15秒と説明されています。

03

「開始・終了フレーム」は、1枚の開始画像、または開始フレームと終了フレームを表す2枚の順序付けられた画像を受け付けます。

04

音声のみのオムニリファレンスリクエストはサポートされていません。アップロードする音声には、少なくとも1つの画像または動画のリファレンスを添付する必要があります。

05

生成される音声は無効にできます。アップロードされた音声は生成のコンテキストを提供するためのものであり、変更されずにコピーされるサウンドトラックとして文書化されていません。

06

APIXOでは、最初のステータスポーリングまで約180~300秒待つことを推奨しています。実際の完了時間は変動する可能性があります。

よくある質問

ByteDanceの公式なSeedance資料では、個別のMiniモデルは確認されていません。MiniはAPIXOのルートラベルであり、文書化された480pおよび720p出力、特定の価格設定、そして3つのSeedance 2.0ワークフローへの限定的なアクセスを提供します。

テキストから動画、最初と最後のフレーム指定、ビデオ入力なしのオムニリファレンスは、480pで出力1秒あたり$0.019、720pで出力1秒あたり$0.041の費用がかかります。画像および音声リファレンスは、課金対象の秒数には加算されません。

料金は480pで1秒あたり$0.012、720pで$0.025です。APIXOでは、生成された動画の再生時間と、すべての参照ビデオの合計再生時間を加算した時間に対してこの料金が適用されます。

APIXOは、ソース音声の保持についてドキュメント化していません。アップロードされた動画と音声はマルチモーダルな条件付けを提供しますが、出力にモデルが生成した音声が含まれるかどうかは、別のサウンドフィールドで制御します。

人体構造、手、アイデンティティ、オブジェクトの接触、高速な動き、埋め込みテキスト、リファレンスの忠実度、トランジション、音声の解釈、発音、リップシンクを確認してください。複数キャラクターのシーンや矛盾するリファレンスがある場合は、単純化して再生成する必要がある場合があります。

他のモデルを見る

次のクリエイティブワークフローのために、さらに多くのAIモデルを発見しましょう