Gemini Omni Flash

テキスト、画像、音声を統合して一貫性のある動画を生成する高速モデル。高度な物理シミュレーションと自然な音声同期により、プロ品質の映像制作を素早く実現します。

テキストに最適
音声対応
商用利用可

入力

仕上がり

準備完了

生成準備完了

画像プレビューを生成するには、入力項目を設定して「実行」をクリックしてください。

Gemini Omni Flash モデル紹介

モデル概要

Gemini Omni Flashは、Googleが開発した次世代の高速マルチモーダル動画生成モデルです。テキスト、画像、音声、動画などの異なる素材を高度に理解・推論し、それらを自然に融合させた一貫性のある高品質な動画を瞬時に生成します。

本モデルは優れた物理シミュレーション技術を内蔵しており、重力や流体の動きなどを現実世界さながらに再現。さらに、キャラクターのビジュアルを一貫して維持したまま、自然言語の指示でカメラアングルや環境を変更できる、実用的なビデオ編集機能を備えています。映像と完全に同期したオーディオ出力にも対応しており、最大10秒の生き生きとしたコンテンツを出力します。

専門的な映像編集スキルがなくても直感的に操作できるため、広告クリエイティブの迅速なモックアップ、SNS向けショート動画、バーチャルアバターの作成など、多様なクリエイティブシーンにおいて圧倒的な生産性を発揮します。

料金

解像度消費クレジット
720p(credits/s)4

技術仕様

技術パラメータ仕様
コア機能テキストからビデオ
解像度720p
アスペクト比16:9,9:16
時間3,4,5,6,7,8,9,10

類似モデルを探す