Veo 3.1

根据文本和图像生成电影级别的视频。具备原生语音合成、高级相机控制和出色的一致性,有力支持专业视频制作。

音频支持
商业使用

输入

结果

空闲

准备生成

配置输入并点击运行以生成图片预览。

Veo 3.1 模型介绍

模型介绍

由Google DeepMind开发的「Veo 3.1」是拥有顶尖表现力的最前沿AI视频生成模型。它能够根据文本或图像,同步生成电影级画质的视频以及与之匹配的原生音频(包括对话、环境音、背景音乐、高精度唇形同步)。

除了支持4K和1080p高分辨率输出,它还原生适配TikTok和YouTube Shorts平台最适合的9:16竖屏格式。其具备「Ingredients to Video」功能,可从多张参考图像高度保持角色和物体的一致性;还能支持对推拉变焦、延时摄影等专业运镜方式进行指令设置。它不仅能呈现符合物理法则的真实质感,还具备极强的提示词理解能力,能将广告视觉、视频制作的分镜、社交媒体内容等各类专业创作者的创意构思变为现实。

价格介绍

图像分辨率消耗积分(credits)
720p(credits/s)6
1080p(credits/s)9

模型技术规格

技术参数具体规格
核心能力文本到视频
分辨率720p,1080p
比例16:9,9:16
时长4,6,8

探索类似模型