Gemini Omni Flash

テキスト、画像、音声を統合し、物理法則に即したリアルな動画と同期オーディオを高速生成。自然言語による高度な動画編集や、キャラクターの一貫性保持にも対応します。

テキストに最適
音声対応
商用利用可

入力

参考画像*

メディアファイルをドラッグ&ドロップ、クリップボードから貼り付け(Ctrl/Cmd+V)、またはURLを入力してください。対応形式: .jpg, .jpeg, .png, .webp

仕上がり

準備完了

生成準備完了

画像プレビューを生成するには、入力項目を設定して「実行」をクリックしてください。

Gemini Omni Flash モデル紹介

モデル概要

Gemini Omni Flashは、Googleの先進的な技術を投入した次世代の高速マルチモーダル動画生成・編集モデルです。テキスト、画像、音声、既存の動画といった多様なアセットを単に繋ぎ合わせるだけでなく、それぞれのコンテキストを深く推論し、一貫性のあるシームレスな映像へと統合します。高度な物理シミュレーションにより、重力や流体の動きを極めて自然に再現。さらに、現実世界に関する豊富な知識を内蔵しているため、詳細な指示を与えずともリアリティのあるシーンを描き出せます。

本モデルの強みは、自然言語の指示による柔軟な動画編集能力にあります。キャラクターの一貫性を保ったまま、オブジェクトの追加や削除、カメラアングルの変更、環境光の調整などを繰り返しながらブラッシュアップすることが可能です。最大10秒の音声付き動画を出力でき、クリエイターの表現力を拡張します。広告クリエイティブの高速検証から、SNS向け短尺動画、デジタル分身を活用した演出まで、プロフェッショナルな制作現場を強力に支援します。

料金

解像度消費クレジット
720p(credits/s)4

技術仕様

技術パラメータ仕様
コア機能参照画像からビデオ
解像度720p
アスペクト比16:9,9:16
時間3,4,5,6,7,8,9,10

類似モデルを探す