Gemini Omni Flash

テキストや画像、音声を組み合わせて高品質な動画を生成・編集。物理法則を再現したリアルな映像と、同期したオーディオを最大10秒まで出力可能です。

テキストに最適
音声対応
商用利用可

入力

参考画像*

メディアファイルをドラッグ&ドロップ、クリップボードから貼り付け(Ctrl/Cmd+V)、またはURLを入力してください。対応形式: .jpg, .jpeg, .png, .webp

仕上がり

準備完了

生成準備完了

画像プレビューを生成するには、入力項目を設定して「実行」をクリックしてください。

Gemini Omni Flash モデル紹介

モデル概要

Googleが開発した「Gemini Omni Flash」は、テキスト、画像、音声、動画を高度に統合して推論する最先端のマルチモーダル動画生成・編集モデルです。単に素材を組み合わせるだけでなく、入力された多様な情報を総合的に理解し、文脈の一貫性を持つ高品質な映像コンテンツを創り出します。高度な物理シミュレーション技術と豊富な世界知識を内蔵し、重力や物体の動きを極めてリアルに再現します。

最大10秒の映像生成に加え、画面と完全に同期したオーディオ出力に対応。さらに、自然言語による指示でカメラアングルの変更、オブジェクトの追加・削除、スタイルの変更といった高度な動画編集・繰り返し修正が可能です。キャラクターの一貫性を保ちながら直感的なクリエイティブの反復をサポートします。広告制作、SNS向けショート動画、デジタルアバター作成など、プロ品質の映像制作をかつてないスピードと手軽さで実現します。

料金

解像度消費クレジット
720p(credits/s)120

技術仕様

技術パラメータ仕様
コア機能画像からビデオへの参照
解像度720p
アスペクト比16:9,9:16
時間3,4,5,6,7,8,9,10

類似モデルを探す