Gemini Omni Flash

一款能够整合文本、图像和音频,生成连贯视频的高速模型。借助高级物理模拟和自然的语音同步功能,可快速实现专业水准的视频制作。

文本友好
音频支持
商业使用

输入

结果

空闲

准备生成

配置输入并点击运行以生成图片预览。

Gemini Omni Flash 模型介绍

模型介绍

Gemini Omni Flash 是谷歌开发的新一代高速多模态视频生成模型。它能深度理解、推理文本、图像、音频、视频等不同素材,瞬间将这些素材自然融合,生成连贯且高品质的视频。

该模型搭载出色的物理模拟技术,能逼真还原重力、流体运动等现实世界现象。此外,它还具备实用的视频编辑功能,可通过自然语言指令调整镜头角度和环境,同时保持角色视觉效果的连贯性。该模型还支持与视频完全同步的音频输出,最多可生成时长10秒的生动内容。

由于无需专业视频编辑技能即可直观操作,它在各类创意场景中都能展现出极强的生产力,比如快速制作广告创意模型、为社交媒体平台创作短视频、生成虚拟形象等。

价格介绍

图像分辨率消耗积分(credits)
720p(credits/s)4

模型技术规格

技术参数具体规格
核心能力文本到视频
分辨率720p
比例16:9,9:16
时长3,4,5,6,7,8,9,10

探索类似模型