HOT 83 ITmedia AI+ 2026年5月29日

Googleが動画からの画像生成をサポートする「Nano Banana 2」をリリース

なぜ重要か

Googleの動画から画像生成機能は、マルチモーダルAIの新たな可能性を切り開き、クリエイティブ分野に大きな影響を与える。

要約

Googleが「Nano Banana 2」(Gemini 3.1 Flash Image)と「Nano Banana Pro」(Gemini 3 Pro Image)の一般提供を開始しました。特にNano Banana 2では、動画入力から画像を生成する新機能がプレビュー公開され、マルチモーダルAIの新たな活用法が提示されています。

要点

  • Nano Banana 2/Proが一般公開
  • Nano Banana 2は動画入力に対応
  • 動画から画像を生成可能に
  • マルチモーダルAIの進化
  • 動画コンテンツ制作に革新

詳細解説

Googleは、画像生成AIモデル「Nano Banana 2」と「Nano Banana Pro」の一般提供を開始しました。この発表の背景には、テキストから画像生成といった単一モーダルなAIの進化に加え、動画などのよりリッチなデータからの生成ニーズが高まっていることがあります。これにより、ユーザーはより多様な入力形式でクリエイティブなコンテンツを生成できるようになります。

「Nano Banana 2」は「Gemini 3.1 Flash Image」を、「Nano Banana Pro」は「Gemini 3 Pro Image」を基盤としており、それぞれ異なる性能とコスト特性を持ちます。特に注目すべきは、Nano Banana 2でプレビュー公開された動画入力からの画像生成機能です。これは、特定のシーンやフレームから高品質な画像を抽出・生成することを可能にし、動画コンテンツ制作や分析において革新的なツールとなる可能性があります。

技術的な意義としては、動画という時系列データから意味のある視覚情報を抽出し、それを基に新たな画像を生成するという高度なマルチモーダル処理が実現された点です。これは、大規模な動画データセットでの学習と、効率的な特徴抽出メカニズムによって支えられています。社会・産業への影響としては、動画クリエイター、マーケター、メディア業界が、既存の動画素材からインスピレーションを得たり、新たなビジュアルコンテンツを迅速に作成したりするのに役立ちます。また、研究開発分野でも、動画理解やマルチモーダルAIの発展に貢献するでしょう。今後の展望として、この技術は動画編集の自動化、映像コンテンツのパーソナライズ、さらにはセキュリティ監視など、幅広い分野での応用が期待されます。

元記事を読む

ITmedia AI+ で読む →
← 2026年5月31日(日) の一覧に戻る