WAN Video 3.0

可根据文本和图像生成电影级视频的下一代模型。凭借出色的镜头运用、音画同步以及多镜头的叙事构建,为专业制作场景提供支持。

文本友好
音频支持
商业使用

输入

结果

空闲

准备生成

配置输入并点击运行以生成图片预览。

WAN Video 3.0 模型介绍

模型介绍

WAN Video 3.0 是为专业视频制作开发的下一代 AI 视频生成模型。它能从文本、图像、参考视频等多种输入中,高效生成电影级高品质视频内容。凭借对提示的深度理解、丰富的角色动态、连贯的场景发展,可精准控制镜头运镜和视频氛围。

它不仅支持文本和图像生成视频(T2V/I2V),还能满足实际工作流程需求,包括通过「参考生成」让多个镜头中的角色视觉保持一致,以及进行风格转换、局部重绘的「AI 视频编辑」。此外,该模型具备音视频精准同步的音画同步功能,还有能流畅衔接多个镜头的多镜头叙事功能,可为广告、动画、娱乐领域的专业故事构建和高品质视频制作提供强劲支持。

价格介绍

图像分辨率消耗积分(credits)
480p(credits/s)6
720p(credits/s)12
1080p(credits/s)18

模型技术规格

技术参数具体规格
核心能力文本到视频
分辨率480p,720p,1080p
比例16:9,4:3,1:1,3:4,9:16
时长2,3,4,5,6,7,8,9,10,11,12,13,14,15,16,17,18,19,20,21,22,23,24,25,26,27,28,29,30

探索类似模型