マルチモーダル参照制御
最大10枚の画像、5本の動画、5本の音声、または1つの文書か公開ウェブページを使って生成をガイドできます。
素材だけでなく文書やウェブページも理解し、より豊かな創作コンテキストで動画を生成します。
Wan 3.0 AI動画生成
画像で画面を定め、動画で動きを示し、音声でリズムを伝え、文書やウェブページで背景を補うことで、より充実した生成コンテキストを構成します。
最大10枚の画像、5本の動画、5本の音声、または1つの文書か公開ウェブページを使って生成をガイドできます。
480P、720P、1080Pと、自動、16:9、4:3、1:1、3:4、9:16のアスペクト比に対応します。
最大20,000文字のプロンプト、開始・終了フレーム、同期音声、再利用可能なシードを設定できます。
商品画像と資料を組み合わせ、特徴、ポジショニング、ビジュアル方針を簡潔なプロモーション動画にします。
音声でリズムと雰囲気を導き、画像や動画で出演者、シーン、動きを定義します。
複数の画像とテキスト参照から、人物、場所、カメラ表現、物語の展開を構築します。
対応ファイルや公開ウェブページを、商品説明、要約、プレゼンテーション動画に変換します。
人物、商品、シーン、ビジュアルスタイルを定義します。
動き、カメラワーク、テンポを導きます。
音楽、声、リズム、雰囲気を提供します。
商品情報、台本、物語の背景を補います。
公開ページの内容と文脈を提供します。
メディアや文書をアップロードし、公開ページを追加するか、開始・終了フレームを選びます。
希望する結果を書き、Image1、Video1、Audio1で特定の素材を指定します。
生成モード、長さ、解像度、アスペクト比、音声を選び、生成を開始します。
高速モデル、より速く生成