ニュース

キャラがブレない。Googleが新型動画AI「Gemini Omni 1.1 Flash」公開

 AIによる動画生成での悩み事の1つに対してGoogleが回答を示した。Googleは8月27日(米国時間)、クリエイターおよび開発者向けの動画生成・編集機能を強化したAIモデル「Gemini Omni 1.1 Flash」を発表した。

 Gemini Omni 1.1 Flashは、映像生成における現実世界の推論と高度な制御性を備えた動画生成モデル。「シーン拡張」では、最大10秒前までの動画コンテキストを解析可能となった(従来は1秒)。これにより、登場人物や背景の視覚的一貫性を維持したまま、10秒単位で最大40秒までシームレスにシーンを延長してストーリーを展開できる。

 機能面では、動画の最初と最後のキーフレームを指定し、スムーズなカメラワークや連続したループ映像を生成する機能や、最大3秒間の参照動画を入力してキャラクターの動作やスタイルの一貫性を保つマルチモーダル入力に対応した。

 また、標準の720p映像と比較して最大60%高速に生成でき、かつコストを3分の1に抑えられる360pのドラフト表示モードも導入された。迅速なプロトタイピングを行なった後、最終出力として本番仕様の1080pや4K解像度へアップスケーリングすることができる。

 Google AI StudioのGemini APIやEnterprise Agent Platform APIを通じて開発者向けに提供が開始されているほか、Google AI Plus、Pro、Ultraの加入者向けにGoogle FlowおよびGeminiアプリでも利用可能だ。