Veo 3.1

從文字或圖像生成電影級影片。支援原生語音合成、進階相機控制與優異一致性,為專業影片製作帶來強力協助。

支援音訊
商業用途

輸入

結果

閒置的

準備生成

配置輸入參數並點擊運行以產生影像預覽。

Veo 3.1 模型介紹

模型介紹

Google DeepMind 開發的「Veo 3.1」是具備頂尖表現力的先進 AI 影片生成模型。能夠從文字或圖像同時生成電影等級的影片,以及同步的原生音訊(包含對話、環境音效、背景音樂、高精度 lip sync 功能)。

除了 4K 和 1080p 的高解析度輸出外,還原生支援適用於 TikTok 和 YouTube Shorts 的 9:16 縱向格式。內建「素材轉影片」功能,可從多張參考圖像高度保持角色或物件的一致性,亦能輸入專業攝影技巧指令,如推拉變焦、縮時攝影等。其具備符合物理法則的真實質感表現能力,以及極高的提示詞理解度,能協助所有專業創作者實現各式各樣的創意,包括廣告視覺、影片製作分鏡、社群媒體內容等。

價格介紹

解析度消耗積分(credits)
720p(credits/s)6
1080p(credits/s)9

模型技術規格

技術參數具體規格
核心能力文字到影片
解析度720p,1080p
比例16:9,9:16
時長4,6,8

探索類似模型