Nano Banana 2 LiteとGemini Omni Flash登場、高速画像生成と動画編集がAPIで利用可能に

Nano Banana 2 LiteとGemini Omni Flash登場、高速画像生成と動画編集がAPIで利用可能に

Nano Banana 2 LiteとGemini Omni Flash登場、高速画像生成と動画編集がAPIで利用可能に

Google DeepMindは2026年6月30日、高速画像生成モデル「Nano Banana 2 Lite」と、動画生成・編集モデル「Gemini Omni Flash」を開発者向けに公開した。どちらもGoogle AI StudioとGemini APIから即日利用できる。

Nano Banana 2 Liteはテキストから画像をわずか4秒で生成し、1,000枚あたり0.034ドルという低コストが売りだ。Gemini Omni Flashは自然言語による動画編集と高品質な動画生成を両立し、1秒あたり0.10ドルで提供される。

この2つのモデルを組み合わせることで、画像を生成して即座に動画化するといったマルチメディア制作のワークフローが一気に加速する。本記事では各モデルの性能、活用シナリオ、連携方法を詳しく見ていく。

Nano Banana 2 Liteの概要と位置づけ

Nano Banana 2 Liteの概要と位置づけ

Nano Banana 2 Lite(モデル名 gemini-3.1-flash-lite-image)は、Nano Bananaファミリーの中で最も高速かつ低コストな画像生成モデルだ。主に短時間でのプロトタイピングや大量の画像生成が必要な開発パイプラインを想定している。

旧世代モデル Nano Banana(初代)
gemini-2.5-flash-image 標準的な速度とコスト。すでに後継モデルへの移行が推奨されている
新世代モデル Nano Banana 2 Lite(今回公開)
gemini-3.1-flash-lite-image 4秒で生成、1K枚あたり0.034ドル。速度重視の開発に最適
新世代(高効率)  旧世代(移行推奨)

旧モデルであるNano Banana(gemini-2.5-flash-image)からの置き換えが推奨されており、差し替えるだけで速度・品質・コストのすべてで改善が見込める。

速度とコストの具体的な数値

  • レイテンシ(処理時間) テキストから画像を出力するまでの時間は約4秒。対話的なプロトタイピングや下書き用途に向く。
  • 料金 1,000枚あたり0.034ドル。大量生成や予算管理が求められるプロジェクトでコストを抑えやすい。
  • 品質のバランス 速度優先ながら、プロンプトへの忠実度・キャラクターの一貫性・画像内テキストの可読性は確保されている。
Nano Banana 2 Lite の得意領域
速度 4秒で画像出力 コスト 0.034ドル/1K枚 用途 大量生成・高速プロトタイピング
速度・コスト・用途の3軸で最適化されたモデル

Nano Bananaファミリー全体の比較

Nano Bananaシリーズには4つのモデルが存在し、用途に応じて使い分ける設計だ。以下が各モデルの位置づけである。

最速・低コスト Nano Banana 2 Lite(Gemini 3.1 Flash Lite Image) 4秒生成、0.034ドル/1K枚。速度重視のワークフロー向け
バランス型 Nano Banana 2(Gemini 3.1 Flash Image) 品質と速度のベストバランス。汎用ユースケース向け
高精度 Nano Banana Pro(Gemini 3 Pro Image) 複雑なプロ用途向け。速度より正確さを優先
旧世代 Nano Banana(Gemini 2.5 Flash Image) 初代モデル。2 Liteへの移行が推奨されている
最速  バランス  高精度  旧世代

開発者は自分たちのプロジェクトが「速度」を求めるのか「品質」を求めるのかによって、Lite・標準・Proを切り替えられる。たとえば広告バナーの大量生成ならNano Banana 2 Lite、製品写真の精密な加工ならNano Banana Proといった使い分けが現実的だ。

Gemini Omni Flashがもたらす動画編集の変化

Gemini Omni Flashがもたらす動画編集の変化

Gemini Omni Flash(gemini-omni-flash-preview)は、テキスト・画像・動画を組み合わせたマルチモーダル入力をネイティブに扱い、高品質な動画生成と会話型編集を実現するモデルだ。2026年5月のGoogle I/Oで発表され、今回初めてGemini APIとGoogle AI Studioに公開された。

料金は出力動画1秒あたり0.10ドル。Veo 3.1 Fastと同水準であり、動画生成AIとしては競争力のある価格設定だ。

4つの得意領域

機能 1 会話型動画編集 自然言語で動画を調整・編集できる。たとえば「背景を夕方に変えて」といった指示が通る
機能 2 マルチモーダル参照 画像・テキスト・動画を組み合わせて入力し、シーンの一貫性を保ったまま生成できる
機能 3 実世界知識の活用 Geminiが持つ歴史・生物学・物語構造などの知識を動画構成に活かす
機能 4 テキストとアクションの同期 簡単なプロンプトで、動きとテキスト・図形を直接結びつけられる
会話型編集  マルチモーダル参照  実世界知識  テキスト同期

従来の動画生成AIでは「1回のプロンプトで動画を出力して終わり」という単発的な使い方が多かった。Omni Flashは会話を重ねながら微調整できる点が大きく異なる。動画の一部だけを修正したり、複数回の編集を積み重ねたりするワークフローが自然に回せるようになる。

現在の制限事項

  • 生成できる動画の長さは現時点で10秒まで。長時間の動画生成は今後対応予定。
  • 音声参照のアップロードとシーン延長機能は、今回のAPIでは未サポート。
  • APIの仕様上は3秒までの動画参照を受け付けるが、現時点では正しく処理されない。
  • シーン切り替えやパン(カメラの横移動)時のキャラクター一貫性に制限あり。改善中。

「10秒制限」は短く感じるかもしれないが、SNS向けショート動画やeコマースの商品紹介動画であれば十分な長さだ。3秒の動画参照制限についても、短いクリップを下敷きにした編集という使い方であれば実用範囲内といえる。

2つのモデルを連携させた実践ワークフロー

2つのモデルを連携させた実践ワークフロー

Nano Banana 2 LiteとGemini Omni Flashの真価は、両者を組み合わせることで発揮される。具体的には次のような流れだ。

STEP 1 Nano Banana 2 Liteでテキストから画像を高速生成
STEP 2 生成した画像を参照画像としてGemini Omni Flashに渡す
STEP 3 静止画を動画化。会話型編集で微調整を重ねる
STEP 4 Interactions APIでセッション履歴を保持し、最大3回の連続編集をスタック
画像生成  参照渡し  動画化  連続編集

Interactions APIを使うことでセッション履歴とコンテキストが保持されるため、ユーザーは最大3回まで連続した編集を積み重ねられる。1回の生成で終わらない、試行錯誤を前提としたクリエイティブ制作に適した設計だ。

公式デモアプリに見る実用例

Google DeepMindは両モデルを組み合わせた3つのデモアプリを公開している。いずれもGoogle AI Studio上で動作し、ソースコードをリミックスして自社サービスに組み込める。

Anywhere 自撮り写真をアップロードすると、世界中の名所に瞬間移動した画像をNano Banana 2 Liteが生成。画像をタップするとOmni Flashがその場所の動画クリップを生成する
Space Lift 部屋の写真をアップロードすると、Nano Banana 2 Liteが複数のインテリアデザイン案を自動生成。気に入ったデザインをOmni Flashでシネマティックな動画に変換し、空間を体感できる
Omni Product Studio Nano Banana 2 Liteで生成した商品画像を、Omni Flashでシネマティックなeコマース動画に変換。静止画のカタログを動画広告へ素早く展開できる
旅行・観光  インテリア  eコマース

これらのデモは、画像生成と動画編集を別々のAIに任せるのではなく、一つのワークフローとして統合することで生まれる価値を示している。eコマース事業者であれば、商品写真のバリエーションを大量生成し、その中から選んだ数枚だけを動画化するといった効率的な運用が可能になる。

開発者が知っておくべき安全性とモデル情報

開発者が知っておくべき安全性とモデル情報

両モデルともGoogleのセキュアなインフラ上で動作し、SynthIDによる電子透かし(ウォーターマーク)が埋め込まれる。SynthIDはAI生成コンテンツであることを検証可能にする技術で、GeminiアプリやChrome、Google検索を通じてコンテンツの来歴を確認できる。

すでにNano Banana 2 Liteは検索のAI Mode、Geminiアプリ、NotebookLM、Google Photos、Stitch、Google Flow、Google Adsなど、Googleの一般向けサービスにも順次展開されている。

API経由での利用にあたっては、各モデルの詳細な機能やリージョン別の制限が公式ドキュメントにまとめられている。開発を始める前に、Google AI Studioのプレイグラウンドで実際の挙動を試すのが確実だ。

この記事のポイント

  • Nano Banana 2 Liteは4秒で画像を生成し、1,000枚あたり0.034ドルの低コストで利用できる
  • Gemini Omni Flashは自然言語による動画編集と高品質な動画生成を両立し、1秒あたり0.10ドルで提供される
  • 両モデルを連携させると、画像生成から動画化・編集までを一貫したワークフローで回せる
  • Google AI StudioとGemini APIから即日利用可能で、具体的なデモアプリも公開済み
  • SynthIDによるAI生成コンテンツの検証機能が組み込まれており、商用利用にも配慮されている
海田 洋祐

・ 複数業界における17年間のデジタルビジネス開発経験 ・ ウェブサイト開発のためのHTML、PHP、CSS、JavaScript等の実用的知識 ・ 15ヶ国語対応の多言語SaaSの開発経験 ・ 17年間にも及ぶ、Eコマース長期運営経験 ・ 幅広い業界でのSEO最適化の豊富な経験

メッセージを残す