Gemini Omni Flash

整合文字、圖像和音頻以生成一致性影片的高速模型。憑藉先進的物理模擬與自然的音頻同步,可快速實現專業品質的影片製作。

文字友善
支援音訊
商業用途

輸入

結果

閒置的

準備生成

配置輸入參數並點擊運行以產生影像預覽。

Gemini Omni Flash 模型介紹

模型介紹

Gemini Omni Flash 是由 Google 開發的次世代高速多模態影片生成模型。它能夠高度理解與推論文字、圖像、音聲、影片等不同素材,並瞬間生成將這些素材自然融合的、一致性高且品質優良的影片。

本模型內建出色的物理模擬技術,可將重力、流體的移動等完美重現真實世界的樣貌。此外,它還具備實用的影片編輯功能,能在維持角色外觀一致性的前提下,透過自然語言指令變更鏡頭角度與環境。它也支援與影像完全同步的音訊輸出,可輸出最長達 10 秒的生動內容。

由於即使沒有專業影片編輯技能也能直觀操作,因此能在各種創作場景中發揮極高的生產力,例如快速製作廣告創意的原型、社群媒體用的短片,或是製作虛擬分身等。

價格介紹

解析度消耗積分(credits)
720p(credits/s)4

模型技術規格

技術參數具體規格
核心能力文字到影片
解析度720p
比例16:9,9:16
時長3,4,5,6,7,8,9,10

探索類似模型