Wan 3.0:参照素材が豊富な動画制作のためのモデルウォッチ
Wan 3.0が、より長尺で参照駆動型の動画ワークフローにとって興味深い理由、そしてVisual Maker AIがまだ利用可能として表示していない理由

Wan 3.0は、より豊かなクリエイティブコンテキストを中心に設計された新興の動画モデルです。テキスト、画像、動画、音声、キーフレーム、その他のソース素材を1つの動画リクエストに反映できます。この方向性は、単発のクリップ以上のものを必要とするチーム、特に製品、キャラクター、キャンペーンシステムをシーン間で一貫させたいチームにとって有用です。
Wan 3.0は現在Visual Maker AIでは利用できません。 本記事はモデルウォッチであり、製品発表ではありません。利用できないモデルをジェネレーターに公開したり、発表された機能が本番ワークフローで利用可能であると示唆したりすることはありません。
解決を目指すワークフローの課題
シンプルなテキストプロンプトで魅力的なシーンを説明することはできますが、既知の製品、承認済みのキャラクターデザイン、既存の編集、サウンドの方向性を同時に保持するには必ずしも十分ではありません。参照情報を豊富に含む動画ワークフローは、すべての決定を1段落のテキストに押し込むのではなく、これらの入力を第一級の要素として扱うことを目指しています。
キャンペーンチームにとって、これは次のことを意味します:
- 画像参照が製品と照明を定義する。
- 短い動画参照がテンポやカメラの動きを伝える。
- 音声がリズムや雰囲気を確立する。
- キーフレームがシーンの開始と終了を定義する。
重要な問いは、モデルが何種類の入力を受け付けると主張するかではありません。各入力タイプが最終的なクリップに予測可能な影響を与えるかどうか、そしてモデルがそれらの間の競合を解決できるかどうかです。
今すぐ参照駆動のブリーフを準備する方法
新しいモデルが登場する前に、将来のマルチ参照ワークフローを改善できます。まず、各アセットに単一の役割を割り当てます。1つの画像をアイデンティティ参照、別の画像をマテリアル参照、クリップをモーション参照としてラベル付けします。次に、プロンプトで優先順位を説明します:どの要素を固定すべきか、どの要素が変更されてもよいか、カメラがどのように動作すべきか。
この準備は、現在Visual Maker AIで利用可能な参照対応モデルでも今日から機能します。これは、魅力的なアセットを複数アップロードしても、結果にどう影響させるかを説明しないという一般的な失敗モードを防ぎます。
現在の作業には利用可能なモデルを使用
今日の参照駆動の動画には、画像から動画へのジェネレーターから始め、マルチモーダル参照ワークフローにはSeedance 2.5を選択するか、画像主導のアニメーションがより良い出発点となる場合はMiniMax H3を選択してください。Wan 3.0が実際にVisual Maker AIで利用可能になった際には、この記事を更新します。