模型觀察2026/08/07

Wan 3.0:面向丰富參考素材視頻創作的模型觀察

了解 Wan 3.0 為何值得關注於長叙事和參考驱動的視頻工作流,以及為何 Visual Maker AI 目前不會將其標為可用。

Wan 3.0:面向丰富參考素材視頻創作的模型觀察

Wan 3.0 是一款值得關注的新兴視頻模型,其定位强调更丰富的創作上下文:文字、圖片、視頻、音頻、關键帧和其他來源素材都可以參與一次視頻请求。這一方向特別适合不止需要单條短片的团隊,例如需要在多場景中保持產品、角色或整套廣告視觉一致的工作。

Wan 3.0 目前尚未接入 Visual Maker AI。 本文是模型觀察,不是產品發布公告。我们不會在生成器中展示尚不可用的模型,也不會把已公布的能力描述為可立即投入生產的功能。

它试圖解决的工作流問題

一條文字提示詞可以描述精彩場景,却不一定能同時保留既有產品、已确認角色設計、已有畫面编辑和聲音方向。參考驱動的視頻工作流,试圖讓這些輸入成為一等信息,而不是把所有决定都压進一段文字裡。

對於廣告团隊,這可能意味着:

  • 一张圖片确定產品與光線。
  • 一段短視頻传达節奏或镜头运動。
  • 音頻确定節奏和情绪。
  • 關键帧定義畫面如何開始與结束。

真正需要判断的不是模型宣称能接受多少种輸入,而是每一种輸入是否會以可預测的方式影响最終視頻,以及模型能否處理它们之間的冲突。

現在就可以准備參考驱動的創意簡报

在新模型到來前,也可以提前改善多參考工作流。先為每個素材指定一個职责:一张圖是身份參考,另一张圖是材質參考,一段視頻是動作參考。然后在提示詞中明确優先級:哪些元素必须不變,哪些可以變化,镜头需要如何运動。

這种准備同樣适用於 Visual Maker AI 當前支持參考的模型。它能避免一种常見失败方式:上传多份好看的素材,却没有說明各自应该怎樣影响结果。

使用當前已可用的模型

今天要制作參考驱動視頻時,可从圖生視頻生成器開始,選擇 Seedance 2.5 的多模态參考工作流;如果从圖片開始動畫更适合,也可以選擇 MiniMax H3。Wan 3.0 在 Visual Maker AI 真正可用時,我们會更新本文。