准备生成
配置输入并点击运行以生成图片预览。
WAN Video 3.0 是为专业视频制作开发的下一代 AI 视频生成模型。它能从文本、图像、参考视频等多种输入中,高效生成电影级高品质视频内容。凭借对提示的深度理解、丰富的角色动态、连贯的场景发展,可精准控制镜头运镜和视频氛围。
它不仅支持文本和图像生成视频(T2V/I2V),还能满足实际工作流程需求,包括通过「参考生成」让多个镜头中的角色视觉保持一致,以及进行风格转换、局部重绘的「AI 视频编辑」。此外,该模型具备音视频精准同步的音画同步功能,还有能流畅衔接多个镜头的多镜头叙事功能,可为广告、动画、娱乐领域的专业故事构建和高品质视频制作提供强劲支持。
| 图像分辨率 | 消耗积分(credits) |
|---|---|
| 480p(credits/s) | 6 |
| 720p(credits/s) | 12 |
| 1080p(credits/s) | 18 |
| 技术参数 | 具体规格 |
|---|---|
| 核心能力 | 文本到视频 |
| 分辨率 | 480p,720p,1080p |
| 比例 | 16:9,4:3,1:1,3:4,9:16 |
| 时长 | 2,3,4,5,6,7,8,9,10,11,12,13,14,15,16,17,18,19,20,21,22,23,24,25,26,27,28,29,30 |

BytePlus
最长可生成30秒、音画同步的电影级视频,是专业级高性能视频生成模型

BytePlus
实现了压倒性的生成速度与高品质兼备的轻量视频生成模型

WAN
以惊人速度生成最长30秒的电影级影像的下一代多模态视频生成模型

可自由融合文本与音频,高速生成连贯一致的高质量视频的最新模型。

Google DeepMind引以为傲的尖端AI视频生成模型。可生成电影级视频及同步音效。

Kling
实现电影级画质和原生音画同步的全能AI视频生成模型