ShortGenius
Seedance 2 Reference to Videoのご紹介

Seedance 2 Reference to Video

Blend up to 12 image, video, and audio references into one cinematic take

Cinematic video from references

ファッションフィルム制作

バイラルダンス映像

ASMR商品紹介

Seedance 2 Reference to Videoは、ByteDanceによる最先端のリファレンス駆動型動画モデルであり、テキストだけでなく実際の素材から生成を構築したいクリエイターのために設計されています。すべてを一から説明するのではなく、最大9枚の画像、3本の動画、3つの音声クリップ(合計最大12ファイル)を組み合わせてモデルに入力し、それをテキストプロンプトと共に組み合わせてストーリーを作り上げます。プロンプト内で@Image1、@Video1、@Audio1のようなシンプルなタグを使い、それぞれの素材を直接参照できるため、どの顔、環境、動き、音を尊重してほしいのかをモデルに正確に伝えることができます。結果として、リファレンスを忠実に反映しながら、周辺の世界がしっかり補完された連続的で映画的な動画クリップが生成されます。

最大の特徴はネイティブオーディオ対応です。一度の生成で映像と完全に同期した音声(環境音、効果音、音楽、リップシンク済みのセリフ)を同時にアウトプットします。後から別途サウンドを追加する手間はありません。これにより、賑やかな人混みシーンでは歓声やカメラのシャッター音、遠くのサイレンやエンジンのアイドリング音まで、映像の動きと完全に同期した状態で一斉に生成されます。音声生成をオンにすれば完成クリップが得られ、オフにすればご自身でサウンドを追加することも可能です。

クリエイティブコントロールも大きな強みです。映画的な表現でプロンプトを書くことで、ドリーズームやトラッキングショット、手持ち風のナチュラルな揺れ、POV切り替え、目線や俯瞰など多彩なカメラ演出を詳細に指定できます。モデルはまるで撮影監督のようにこれらの指示を解釈します。流体や布の動き、キャラクターの動作までリアルな物理演算で自然に表現。特に便利なのはマルチショット編集機能で、最長15秒の生成内で自然なカットやシーン遷移を作り出し、ワンショットに縛られず流れるような映像シーケンスを実現できます。

画像リファレンスが入力できるため、キャラクターや商品イメージの一貫性保持が得意です。キャラクターリファレンスを与えると、異なるビジュアルスタイルであっても同じ顔・衣装を全ショットで忠実に再現。例では、スタイライズド3Dキャラクターがフォトリアルな実写環境に違和感なく合成され、元画像の顔や服装を完全に維持したまま、リアルな光や反射、街灯のハイライトや影とも自然に馴染んでいます。反復するキャラクターや特定の商品・ブランドのビジュアルを一貫させなければならない場合に最適です。

出力オプションは幅広く用意。スピード重視の480p、バランス型の720p、高品質な1080pから選択可能。再生時間は4〜15秒で指定でき、またはプロンプト内容に応じて自動決定もOK。アスペクト比も柔軟で、16:9の横長、9:16の縦長ソーシャル、1:1の正方形、21:9のウルトラワイド、4:3、3:4、または自動を指定できます。さらに高品質エンコードモードや、シード値固定による再現も可能ですが、わずかなバリエーションは生じる場合があります。

リファレンス入力には適度な制限があります。画像はJPEG、PNG、WebPで各30MBまで、最大9枚。動画はMP4またはMOVで合計2〜15秒かつ50MB以下、1本あたり480p〜720p、最大3本。音声はMP3かWAVで最大3クリップ、合計15秒以内・各15MBまで。重要なルールとして、音声リファレンスを加える場合は必ず1点以上の画像または動画リファレンスも必要です。なお、種類を問わずリファレンスファイル数の合計は12点までです。

このモデルの恩恵を受けるのは?映像作家や監督なら、実際のカメラワークやサウンド付の短編シネマティックのプリビズや制作に。SNSコンテンツメーカーも1枚のキャラクター画像から一貫性のある縦長クリップを即生成。広告・プロダクト担当は製品画像をスタイル化したライティング環境&カメラで動画化。アニメーターやミックスメディアアーティストはスタイライズドキャラを実写世界に自然にブレンドし、例で示したハイブリッドワークフローにも活用。自分自身の画像・動画・音声を元に作れるため、ブランド一貫性やキャラ識別、特定ルックが重要な場面でテキスト主体モデルより有効です。

使い方のベストプラクティスは、モデルの仕組みに自然に従います。ディレクターのように、スタイルやライティング、環境設定、登場人物や動き、音の内容まで具体的にプロンプトで記述し、@タグで各リファレンスを明示してください。動画リファレンスは必ず制限内で提供すること、音声利用時は必ず画像または動画も最低1点添付することを忘れずに。最も完成度の高いクリップを得るには、アクションやカメラ指示を細かく指定するほどモデルのパフォーマンスが引き出せます(観客&車列の大規模シーケンス例参照)。リファレンスと演出を緻密に組み合わせることで、Seedance 2 Reference to Videoはあなたの素材に忠実なサウンド付き映画クリップを仕上げます。

最先端の動画モデルで生成

A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.

ステップ1

シナリオを書く

動き、カメラアングル、ムードを含めて動画のシーンを説明します

ステップ2

AIが生成

モデルが自然な物理とライティングでシネマティックな動きを生成します

ステップ3

シェアを始める

プロダクション品質の動画をダウンロードしてシェアしましょう

プロンプトの先へ:新次元のコントロール

シネマティック旅行ムービー

シネマティック旅行ムービー

複雑な段階的カメラ操作、大気や天候のシミュレーション、ダイナミックな広域シーン演出で、Seedance 2の映画撮影監督レベルのカメラ制御力を発揮。ワイドスクリーントラベル映像に最適。

ミュージックビデオ美学

ミュージックビデオ美学

高度なシーン切替、スタイライズド物理演算(ガラス破壊・浮遊デブリ)や演出重視のライティング制御で、Seedance 2によるミュージックビデオ向けカットシーン演出力を実証。

ドキュメンタリー自然映像

ドキュメンタリー自然映像

現実的な物理エンジンとネイティブ環境音声生成で、雪を踏む音・風・呼吸などのサウンドデザインを実現。Netflix品質の動物ドキュメンタリーにふさわしい精密な生態描写と大気演出。

類似モデルと比較する

Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.

待望のモデルがついに登場

Seedance 2 Reference to Videoで完璧な仕上がりを体験

今すぐ推論ガイド型の生成に切り替えましょう

よくある質問

画像は最大9枚、動画3本、音声クリップ3つまで組み合わせられますが、全タイプ合計で12ファイル以内となります。すべてプロンプト内で@Image1、@Video1、@Audio1などのタグで明示し、モデルにどの素材を参照すべきか指定します。