いいえ、異なります。Seedance 1.5 Proは、ByteDanceが2025年12月に発表した音声と動画を同時に生成するモデルです。APIXOでは、そのプロンプトとキーフレームのワークフローを、Seedance 2.0、Seedance 2.0 Fast、およびそれらのより広範な参照機能とは別に提供しています。
Seedance 1.5 Pro
APIXOのSeedance 1.5 Proは、ByteDance Seedが公開している音声・動画統合モデルに対応しています。テキストまたは1〜2つのキーフレームから短い動画を生成し、オプションで同期した音声、4〜12秒の再生時間制御、選択可能なカメラ挙動を備えています。このルートは、Seedance 2.0の広範なマルチモーダルリファレンスワークフローではなく、直接的な生成に焦点を当てています。
ワークフロー
テキスト・画像から動画へ
APIXO価格
$0.0108~$0.1044 / 秒
解像度
480p / 720p / 1080p
再生時間
4~12秒
リリース日
2025年12月16日
Seedance 1.5 Proで作成
ワークスペースを読み込み中...
パフォーマンス、音声、カメラ、物語の意図を連携させる
オーディオ・ビデオ統合生成
視覚的な動きと音声を同時に生成することで、声、演技のタイミング、環境音、空間エフェクトが同じシーン描写に反応するようにできます。APIXOでは、音声なしの出力も可能です。
視聴覚アライメント
別々のビデオと吹き替えのパイプラインよりも、唇の動き、声のイントネーション、アクションのリズム、環境音をより密接に連携させますが、生成タイミングのエラーの余地は残ります。
言語と方言の範囲
ByteDanceのドキュメントには、複数の言語と地域の方言のサポートが記載されており、それには声の韻律や感情表現も含まれます。発音と同期は、各制作言語でレビューする必要があります。
ディレクションに基づいた撮影技術
クローズアップ、連続的な動き、ドリーズーム、シーンのトランジション、ライティング、色彩処理など、カメラワークや演出に関する指示を解釈し、短い生成シーケンスに反映します。
物語の連携
プロンプトの物語的な意図に沿って、対話、表情、キャラクターのアクション、ショットの展開を結びつけ、単独のモーショングラフィックス生成よりもまとまりのある短いシーンをサポートします。
画像主導のアニメーション
提供された開始画像をアニメーション化するか、定義された開始フレームと終了フレーム間のトランジションをガイドします。その際、生成が許可する範囲で、ソースの構図と外観を維持します。
テキストから自由に生成、またはキーフレームを制御してアニメーション化
テキストから動画を生成
シーン、アクション、カメラの方向、照明、オーディオキューを説明する3〜2,500文字のプロンプトを送信します。再生時間、解像度、フレーミング、サウンド、カメラの動作を選択して、画像入力なしで新しいクリップを作成します。
画像から動画の生成
開始フレームとして公開されている画像のURLを1つ、または開始フレームと終了フレームとして順序付けられたURLを2つ提供します。これらの視覚的なアンカーポイント間の動き、トランジション、カメラ処理、そしてオプションで生成されるサウンドトラックを指示するための必須プロンプトを追加してください。
検証済みの生成コントロール
APIXOの現行Seedance 1.5 Pro APIで利用可能な生成オプションです。
3~2,500文字
プロンプトの長さ
1~2つのURL
画像入力
開始 / 終了
フレームの役割
6つのアスペクト比 + 自動
アスペクト比
オン / オフ
生成された音声
オン / オフ
固定カメラ
企画書とキーフレームから短い視聴覚シーンを構築
サウンド付きのプロダクトモーメント
キャンペーンの企画書や承認済みの製品フレームを、動き、雰囲気、エフェクトが連動した短い紹介動画に変換します。固定カメラモードを使用して構図を制御し、公開前に製品の形状、ラベル、素材、埋め込みテキストを検査できます。
セリフ主導のパフォーマンス
声の表現、顔の表情、身体の動きを1つのプロンプトで共有する、コンパクトなプレゼンター、キャラクター、またはドラマチックなシーンを作成します。同期が保証されていると見なすのではなく、話者のアイデンティティ、発音、口の動き、手、感情のタイミングを確認してください。
カメラ主導のショットを計画する
実写またはアニメーション制作に着手する前に、連続撮影、リフレーミング、ドリー風の動き、トランジションを試します。開始フレームと終了フレームは、トランジションや絵コンテ開発のための有用な視覚的境界を提供します。
コンパクトな物語クリップを制作
縦型フィード、ワイドスクリーン広告、ティーザー、エピソード形式のコンセプトなどに最適な4~12秒のシーンを生成します。ネイティブサウンドにより、サウンドトラックを別途生成する手間なく、雰囲気やパフォーマンスのリズムを作り出すことができます。
Seedance 1.5 Proの運用上の制約
実装に関する注記
APIXOはテキストから動画と画像から動画のみを公開しています。動画入力、拡張、編集、モーション参照、または複数画像参照モードは文書化されていません。
画像から動画の生成には、1つまたは2つのURLが必要です。2つの画像を使用する場合、最初の画像が開始フレーム、2番目の画像が終了フレームになります。
APIXOは4秒から12秒までのすべての整数値の再生時間を受け付けます。
音声切り替え機能は、音声と動画の同時生成かサイレント出力を選択します。このルートはソースとなる動画や音声を受け付けないため、元の音声は保持されません。
APIXOの標準的な処理時間は、4秒のクリップで約40~60秒、12秒のクリップで90~120秒です。実際のレイテンシは変動します。
参照画像は、公開アクセス可能なJPG、PNG、またはWebP形式のURLを使用する必要があり、上流プロバイダーの安全チェックの対象となります。
よくある質問
ByteDanceのドキュメントには、多様な声や映像と連動した空間音響効果が記載されています。デモンストレーションには歌声や環境音も含まれていますが、APIXOでは対話、音楽、環境音、効果音といった個別のコントロールではなく、単一の音声切り替え機能のみを提供しています。
APIXOでは、解像度と音声の有無に応じて、生成される動画1秒ごとに課金されます。480pの場合、音声なしは1秒あたり$0.0108、音声ありは$0.0216です。720pではそれぞれ$0.0234と$0.0468、1080pでは1秒あたり$0.0522と$0.1044が適用されます。
はい。画像から動画モードで2つの画像URLを指定します。最初の画像が開始フレーム、2番目の画像が終了フレームになります。画像が1つの場合は、開始フレームとして機能します。
人体の構造、手、アイデンティティの安定性、オブジェクトの接触、埋め込まれたテキスト、トランジション、発音、リップシンク、および話者の解釈を確認してください。長いシーンや急激に変化するシーンでは、プロンプトの調整や複数回の生成が必要になる場合があります。
他のモデルを見る
次のクリエイティブワークフローのために、さらに多くのAIモデルを発見しましょう