准备生成
配置输入并点击运行以生成图片预览。
由Google DeepMind开发的「Veo 3.1」是拥有顶尖表现力的最前沿AI视频生成模型。它能够根据文本或图像,同步生成电影级画质的视频以及与之匹配的原生音频(包括对话、环境音、背景音乐、高精度唇形同步)。
除了支持4K和1080p高分辨率输出,它还原生适配TikTok和YouTube Shorts平台最适合的9:16竖屏格式。其具备「Ingredients to Video」功能,可从多张参考图像高度保持角色和物体的一致性;还能支持对推拉变焦、延时摄影等专业运镜方式进行指令设置。它不仅能呈现符合物理法则的真实质感,还具备极强的提示词理解能力,能将广告视觉、视频制作的分镜、社交媒体内容等各类专业创作者的创意构思变为现实。
| 图像分辨率 | 消耗积分(credits) |
|---|---|
| 720p(credits/s) | 6 |
| 1080p(credits/s) | 9 |
| 技术参数 | 具体规格 |
|---|---|
| 核心能力 | 文本到视频 |
| 分辨率 | 720p,1080p |
| 比例 | 16:9,9:16 |
| 时长 | 4,6,8 |

BytePlus
最长可生成30秒、音画同步的电影级视频,是专业级高性能视频生成模型

BytePlus
实现了压倒性的生成速度与高品质兼备的轻量视频生成模型

WAN
以惊人速度生成最长30秒的电影级影像的下一代多模态视频生成模型

可自由融合文本与音频,高速生成连贯一致的高质量视频的最新模型。

WAN
具备电影级画质与高级控制能力的下一代AI视频生成模型

Kling
实现电影级画质和原生音画同步的全能AI视频生成模型