APIXO
動画生成ネイティブ音声キーフレーム制御

APIXOのSeedance 1.5 Proは、ByteDance Seedが公開している音声・動画統合モデルに対応しています。テキストまたは1〜2つのキーフレームから短い動画を生成し、オプションで同期した音声、4〜12秒の再生時間制御、選択可能なカメラ挙動を備えています。このルートは、Seedance 2.0の広範なマルチモーダルリファレンスワークフローではなく、直接的な生成に焦点を当てています。

ワークフロー

テキスト・画像から動画へ

APIXO価格

$0.0108~$0.1044 / 秒

解像度

480p / 720p / 1080p

再生時間

4~12秒

リリース日

2025年12月16日

Seedance 1.5 Proで作成

ワークスペースを読み込み中...

Powered by ByteDance

短編動画のワークフロー内で、音声と動きを連携させて生成

Seedance 1.5 Proは、Seedance 1.0のビジュアルのみに焦点を当てたモデルから進化し、動画と音声を同時に生成します。APIXOを通じて、チームはプロンプトやキーフレームからサイレントクリップまたは音と映像が連動したシーンを作成でき、フレーミング、再生時間、解像度、カメラの安定性を指定できます。

機能

パフォーマンス、音声、カメラ、物語の意図を連携させる

オーディオ・ビデオ統合生成

視覚的な動きと音声を同時に生成することで、声、演技のタイミング、環境音、空間エフェクトが同じシーン描写に反応するようにできます。APIXOでは、音声なしの出力も可能です。

視聴覚アライメント

別々のビデオと吹き替えのパイプラインよりも、唇の動き、声のイントネーション、アクションのリズム、環境音をより密接に連携させますが、生成タイミングのエラーの余地は残ります。

言語と方言の範囲

ByteDanceのドキュメントには、複数の言語と地域の方言のサポートが記載されており、それには声の韻律や感情表現も含まれます。発音と同期は、各制作言語でレビューする必要があります。

ディレクションに基づいた撮影技術

クローズアップ、連続的な動き、ドリーズーム、シーンのトランジション、ライティング、色彩処理など、カメラワークや演出に関する指示を解釈し、短い生成シーケンスに反映します。

物語の連携

プロンプトの物語的な意図に沿って、対話、表情、キャラクターのアクション、ショットの展開を結びつけ、単独のモーショングラフィックス生成よりもまとまりのある短いシーンをサポートします。

画像主導のアニメーション

提供された開始画像をアニメーション化するか、定義された開始フレームと終了フレーム間のトランジションをガイドします。その際、生成が許可する範囲で、ソースの構図と外観を維持します。

APIXOワークフロー

テキストから自由に生成、またはキーフレームを制御してアニメーション化

テキストから動画を生成

シーン、アクション、カメラの方向、照明、オーディオキューを説明する3〜2,500文字のプロンプトを送信します。再生時間、解像度、フレーミング、サウンド、カメラの動作を選択して、画像入力なしで新しいクリップを作成します。

プロンプト主導の制作

画像から動画の生成

開始フレームとして公開されている画像のURLを1つ、または開始フレームと終了フレームとして順序付けられたURLを2つ提供します。これらの視覚的なアンカーポイント間の動き、トランジション、カメラ処理、そしてオプションで生成されるサウンドトラックを指示するための必須プロンプトを追加してください。

キーフレーム主導のモーション
APIXO設定

検証済みの生成コントロール

APIXOの現行Seedance 1.5 Pro APIで利用可能な生成オプションです。

3~2,500文字

プロンプトの長さ

1~2つのURL

画像入力

開始 / 終了

フレームの役割

6つのアスペクト比 + 自動

アスペクト比

オン / オフ

生成された音声

オン / オフ

固定カメラ

本番環境での利用

企画書とキーフレームから短い視聴覚シーンを構築

ブランドストーリーテリング

サウンド付きのプロダクトモーメント

キャンペーンの企画書や承認済みの製品フレームを、動き、雰囲気、エフェクトが連動した短い紹介動画に変換します。固定カメラモードを使用して構図を制御し、公開前に製品の形状、ラベル、素材、埋め込みテキストを検査できます。

キャラクターコンテンツ

セリフ主導のパフォーマンス

声の表現、顔の表情、身体の動きを1つのプロンプトで共有する、コンパクトなプレゼンター、キャラクター、またはドラマチックなシーンを作成します。同期が保証されていると見なすのではなく、話者のアイデンティティ、発音、口の動き、手、感情のタイミングを確認してください。

プリビジュアライゼーション

カメラ主導のショットを計画する

実写またはアニメーション制作に着手する前に、連続撮影、リフレーミング、ドリー風の動き、トランジションを試します。開始フレームと終了フレームは、トランジションや絵コンテ開発のための有用な視覚的境界を提供します。

ソーシャルクリエイティブ

コンパクトな物語クリップを制作

縦型フィード、ワイドスクリーン広告、ティーザー、エピソード形式のコンセプトなどに最適な4~12秒のシーンを生成します。ネイティブサウンドにより、サウンドトラックを別途生成する手間なく、雰囲気やパフォーマンスのリズムを作り出すことができます。

注記 & FAQ

Seedance 1.5 Proの運用上の制約

実装に関する注記

01

APIXOはテキストから動画と画像から動画のみを公開しています。動画入力、拡張、編集、モーション参照、または複数画像参照モードは文書化されていません。

02

画像から動画の生成には、1つまたは2つのURLが必要です。2つの画像を使用する場合、最初の画像が開始フレーム、2番目の画像が終了フレームになります。

03

APIXOは4秒から12秒までのすべての整数値の再生時間を受け付けます。

04

音声切り替え機能は、音声と動画の同時生成かサイレント出力を選択します。このルートはソースとなる動画や音声を受け付けないため、元の音声は保持されません。

05

APIXOの標準的な処理時間は、4秒のクリップで約40~60秒、12秒のクリップで90~120秒です。実際のレイテンシは変動します。

06

参照画像は、公開アクセス可能なJPG、PNG、またはWebP形式のURLを使用する必要があり、上流プロバイダーの安全チェックの対象となります。

よくある質問

いいえ、異なります。Seedance 1.5 Proは、ByteDanceが2025年12月に発表した音声と動画を同時に生成するモデルです。APIXOでは、そのプロンプトとキーフレームのワークフローを、Seedance 2.0、Seedance 2.0 Fast、およびそれらのより広範な参照機能とは別に提供しています。

ByteDanceのドキュメントには、多様な声や映像と連動した空間音響効果が記載されています。デモンストレーションには歌声や環境音も含まれていますが、APIXOでは対話、音楽、環境音、効果音といった個別のコントロールではなく、単一の音声切り替え機能のみを提供しています。

APIXOでは、解像度と音声の有無に応じて、生成される動画1秒ごとに課金されます。480pの場合、音声なしは1秒あたり$0.0108、音声ありは$0.0216です。720pではそれぞれ$0.0234と$0.0468、1080pでは1秒あたり$0.0522と$0.1044が適用されます。

はい。画像から動画モードで2つの画像URLを指定します。最初の画像が開始フレーム、2番目の画像が終了フレームになります。画像が1つの場合は、開始フレームとして機能します。

人体の構造、手、アイデンティティの安定性、オブジェクトの接触、埋め込まれたテキスト、トランジション、発音、リップシンク、および話者の解釈を確認してください。長いシーンや急激に変化するシーンでは、プロンプトの調整や複数回の生成が必要になる場合があります。

他のモデルを見る

次のクリエイティブワークフローのために、さらに多くのAIモデルを発見しましょう