Google、動画生成AI「Gemini Omni 1.1 Flash」公開
なぜ重要か
動画生成の精度と制御性が大幅に向上し、コンテンツ制作の効率と表現力を革新する技術です。
要約
Googleは、動画生成・編集に特化したマルチモーダルAI「Gemini Omni 1.1 Flash」を発表しました。直前の文脈を考慮した最大40秒のシーン延長や、開始・終了フレーム指定生成など、クリエイティブな動画制作を支援する機能がAPI経由で提供されます。
要点
- 動画生成・編集に特化
- Gemini Omni 1.1 Flash
- 最大40秒のシーン延長
- 4Kアップスケール対応
- API提供で開発促進
詳細解説
近年のコンテンツ制作需要の高まりと共に、動画生成AIへの期待は大きく、特にプロフェッショナルな現場では、より細やかな制御と高速な処理が求められています。Googleはこの需要に応えるため、マルチモーダルAI「Gemini Omni 1.1 Flash」を開発しました。本モデルは、直前10秒の文脈を参照し、最大40秒まで動画シーンを延長できるほか、開始・終了フレームを precise に指定して生成する機能も備えています。さらに、360pの高速プレビューから4Kアップスケールまで対応し、ユーザーは品質と速度を柔軟に選択できます。この技術は、Transformerアーキテクチャと効率的なデータ処理により、複雑な動画シーケンスの一貫性とリアリズムを高めるものです。これにより、動画クリエイターは、手作業では膨大な時間とコストがかかるシーンの延長や編集作業を大幅に効率化できます。映画・アニメ制作、広告、教育コンテンツなど、幅広い産業で高品質な動画コンテンツがこれまでよりも容易に生成・編集できるようになるでしょう。今後は、さらに複雑なシーン構成や、ユーザーの意図をより正確に反映できる機能が追加され、動画制作の民主化が加速すると予想されます。
元記事を読む
ITmedia AI+ で読む →