Veo 3.1

谷歌的尖端模型。可从多张参考图像中保持高度一致性,生成与高清视频同步的带声音的动画。

音频支持
商业使用

输入

参考图片*

从电脑拖拽文件、从剪贴板粘贴 (Ctrl/Cmd+V) 或提供 URL。支持格式:.jpg, .jpeg, .png, .webp

结果

空闲

准备生成

配置输入并点击运行以生成图片预览。

Veo 3.1 模型介绍

模型介绍

Veo 3.1 是谷歌DeepMind集合尖端AI技术打造的顶级视频生成模型。它具备「素材生成视频」功能,可通过组合多张参考图像构建故事,在最大限度保持角色和物体一致性的同时,生成连贯流畅的视频。

其最大特点是能生成与视频原生完全同步的高精度音频。它可一站式实现自然对话、身临其境的环境音、适配场景的背景音乐以及完美的口型同步。它还能精准响应电影式运镜(如缩放变焦、延时摄影等)的指令,呈现出逼真的质感,忠实模拟物理规律。

它原生支持竖屏格式(9:16),从社交媒体、广告视觉、分镜稿制作到专业视频创作,都能高效产出满足专业需求的高质量内容。

价格介绍

图像分辨率消耗积分(credits)
720p(credits/s)6
1080p(credits/s)9

模型技术规格

技术参数具体规格
核心能力参考图像到视频
分辨率720p,1080p
比例16:9
时长8

探索类似模型