多模态参考控制
最多使用 10 张图片、5 个视频、5 个音频,或 1 个文档或公开网页来指导生成。
看得懂素材,也读得懂文档与网页,让视频生成拥有更完整的创作上下文。
Wan 3.0 AI 视频生成器
让图片定义画面,视频提供动作,音频传递节奏,文档与网页补充背景,共同组成更完整的生成上下文。
最多使用 10 张图片、5 个视频、5 个音频,或 1 个文档或公开网页来指导生成。
可选 480P、720P 或 1080P,并支持自适应、16:9、4:3、1:1、3:4 和 9:16 画面比例。
提示词最长 20,000 字符,可使用首尾帧、开启同步音频,并通过随机种子复用相同设置。
结合产品图片与介绍文档,将卖点、定位和视觉方向转化为简洁的宣传视频。
使用音频控制节奏与氛围,通过图片或视频定义人物、场景和动作。
通过多种视觉与文字参考构建人物、地点、镜头语言和故事节奏。
将支持的文件或公开网页转化为产品解说、内容摘要或演示视频。
定义人物、产品、场景和视觉风格。
参考动作、镜头运动和画面节奏。
提供音乐、声音、节奏和氛围。
补充产品信息、脚本和故事背景。
提供公开页面的内容与上下文。
上传媒体或文档、添加公开网页,或者选择首帧与尾帧。
写明希望生成的内容,并用 Image1、Video1 或 Audio1 指向指定素材。
选择生成模式、时长、分辨率、画面比例与音频,然后开始生成。
生成更快,适合缩短等待时间