プロンプト、最初と最後のフレーム、またはビジュアルとオーディオのリファレンスの完全なセットから、接続されたビデオを作成します。 Seedance 2.5 AI ビデオ ジェネレーターは、テキストからビデオ AI、画像からビデオ AI、マルチショットのディレクション、および同期サウンドを 1 つの制作に焦点を当てたワークフローに組み合わせます。
Seedance 2.5 は、より長時間、より制御可能なオーディオビジュアル作成のための ByteDance のマルチモーダル ビデオ モデルです。テキストからビデオへの AI、オプションで最初と最後のフレームを使用した画像からビデオへの AI、画像、ビデオ クリップ、オーディオ トラックを使用したリファレンス主導の生成をサポートします。
1 つのリクエストで、論理的に接続された複数のショットを含む最大 30 秒の AI ビデオを生成できます。これにより、クリップ全体で 1 つの構成を維持するのではなく、オープニング、展開、トランジション、およびペイオフのための余地がシーンに与えられます。
モデルの発表ではネイティブの 4K 出力が強調されていますが、現在ここで利用可能な生成コントロールは 480p、720p、および 1080p 出力を提供します。この区別により、より広範な Seedance 2.5 モデル仕様を理解しながら、接続された API が受け入れる設定のみを選択できます。
最大 30 個の画像、10 個のビデオ クリップ、10 個のオーディオ トラックをマルチモーダル ビデオ生成ブリーフに結合します。各アセットに、キャラクターのアイデンティティ、製品の詳細、ビジュアル スタイル、シーン デザイン、カメラ言語、モーション、音声、雰囲気などの明確な役割を割り当てます。
1 回の実行で最大 30 秒を生成し、意図的なショットのシーケンスを説明します。タイミングを長くすると、製品発表、短い物語、ライフスタイル シーン、予告編、ソーシャル広告が明確な始まりと終わりでサポートされます。
書面による概要を構造化されたシーケンスに変換します。被写体、アクション、カメラの位置、レンズの動作、照明、ペース、トランジション、ダイアログ、サウンドを指定して、各ショットが同じ創造的なアイデアを発揮できるようにします。
開始と終了の構成が重要な場合は、最初のフレームをアニメーション化するか、最初と最後のフレームを一緒に使用します。フレーム ガイド モードはマルチモーダル基準生成とは独立しているため、意図した制御の種類が明確になります。
ビデオとサウンドを一緒に生成して、より正確なオーディオビジュアルのタイミングを実現します。プロンプトでは、目に見えるアクションとともにダイアログ、雰囲気、効果、音楽の意図を説明できます。また、無音のソースが優先される場合はオーディオ生成をオフにすることもできます。
製品画像、キャンペーン参照、モーションディレクションを使用して、明確な詳細と一貫した視覚的言語が重要となる製品ショーケース、ライフスタイルシーン、季節キャンペーン、マーケットプレイスアセット、ソーシャルクリエイティブを計画します。
生成モードをソース素材に合わせ、すべてのリファレンスに目的を与え、シーケンスを一連の意図的なショットとして説明します。
プロンプトのみのコンセプトにはテキストからビデオ AI を使用し、最初または最後の構成を固定する必要がある場合には画像からビデオ AI を使用し、画像、クリップ、オーディオが結果のさまざまな部分をガイドする必要がある場合にはマルチモーダル ビデオ生成を使用します。
主題、設定、アクション、撮影順序、カメラの動き、照明、素材、会話、雰囲気、結末について説明します。リファレンス モードでは、アップロードされた各アセットが何を制御する必要があるかを正確に説明します。
4 ~ 30 秒の長さ、サポートされているアスペクト比、480p、720p、または 1080p 解像度、およびオーディオを生成するかどうかを選択します。プロンプトを調整する前に、連続性、製品の詳細、モーション、サウンド、トランジションを確認してください。
視覚的な詳細の長いリストの代わりにショット シーケンスを説明する
すべての参照画像、ビデオ、オーディオ ファイルに単一の明確な目的を与える
どの顔、服装、製品、ロゴ、色が一貫性を保たなければならないかについて述べます
プロンプト内の個別のカメラの方向、被写体の動き、照明、ダイアログ、サウンド
正確なオープニングとエンディングの構成が最も重要な場合は、最初と最後のフレームを使用します
発行する前に、生成されたテキスト、製品の詳細、手、顔、動き、音声を確認します。
Seedance 2.5 は、テキスト、最初と最後のフレーム、または画像、ビデオ、オーディオ参照から接続されたビデオを生成するための ByteDance のマルチモーダル AI ビデオ モデルです。オプションの同期オーディオと、接続されたワークフローを介した最大 30 秒の出力をサポートします。
Seedance 2.5 と Seedance 2.0 の比較では、新しいモデルではビデオの長さ、マルチモーダル参照制御、生成前計画、編集制御、およびモデルの公開された出力機能が拡張されています。これらの変更により、Seedance 2.5 は、より長いシーン、ブランド アセット、制作中心の AI ビデオ ワークフローにより適したものになります。
リファレンス ワークフローは、最大 30 個の画像、10 個のビデオ クリップ、および 10 個のオーディオ トラックを受け入れます。参照ビデオは合計で最大 30 秒になる場合があり、プロンプトで各アセットに明確な役割を割り当てる必要があります。
はい。接続された API は、4 ~ 30 秒のビデオ時間をサポートします。詳細なショット シーケンスにより、モデルは 1 つの長引くシーンではなく、接続されたアクションやトランジションに余分な時間を費やすことができます。
はい。ビデオと一緒に音声も生成できます。プロンプト内でダイアログ、雰囲気、効果音、または音楽的意図を説明したり、後のポストプロダクションで無音のクリップが必要な場合はオーディオ生成を無効にしたりできます。
Seedance 2.5 モデルの発表では、ネイティブ 4K 出力について説明しています。現在接続されているジェネレーターは、480p、720p、および 1080p 設定を公開しているため、このページで行われたリクエストに対して使用可能な解像度から選択してください。
製品ショーケース、ライフスタイルシーン、キャンペーンコンセプト、マーケットプレイスアセット、ソーシャル広告をサポートできます。明確な製品参照を使用し、プロンプト内の重要なジオメトリとブランドを保持し、公開する前に正確な詳細についてすべての出力を確認します。
商用利用は、有効なサービス条件と、入力として使用されるすべてのプロンプト、画像、クリップ、オーディオ ファイル、ロゴ、人物、キャラクターに対するお客様の権利によって決まります。配布する前に、これらの権利と最終出力を確認してください。
プロンプト、フレーム ペア、またはマルチモーダル リファレンス セットを、オプションの同期オーディオを備えた接続された AI ビデオに変換します。
ショットを計画し、各リファレンスに目的を割り当て、利用可能な出力設定を選択して、最初の Seedance 2.5 ビデオを生成します。
Seedance 2.5 を使用して、テキストからビデオ、画像からビデオ、およびマルチモーダル AI ビデオを作成します。