概要
私たちは、開発者がアイデアを素早く試し、スケールさせやすくするために、2つの新しいリリースを発表します。
- Nano Banana 2 Lite:Nano Banana ファミリーで最速かつ最もコスト効率の高い画像モデル。高スループット、速度、スケール向けに設計されています。Nano Banana 2 Lite は本日より Google AI Studio、Gemini API、Gemini Enterprise Agent Platform で利用可能です。また AI Mode in Search、Gemini app を含む Google の消費者向けプロダクトでも展開中です。
- Gemini Omni Flash:高品質でコスト効率の高いビデオ生成および会話的編集向けモデル。今回初めて Google AI Studio、Gemini API、Gemini Enterprise Agent Platform で開発者向けに提供されます。Omni Flash は Gemini app や Google Flow でも利用可能です。
これら2つのモデルを組み合わせることで、迅速な画像生成から高品質な動画生成・編集までをつなぐエンドツーエンドのマルチメディア体験を構築できます。数千枚の画像生成やマルチターンの動画編集など、ワークフローに応じて高速に反復・拡張できます。
Nano Banana 2 Lite:最速でコスト効率の高い Gemini Image モデル
- モデル名:Nano Banana 2 Lite (gemini-3.1-flash-lite-image)
- 設計目的:アイディエーション(rapid ideation)や高頻度の開発パイプライン向け。速度とコストを最優先するワークロードに最適化。
- 推奨用途:既存で Nano Banana (gemini-2.5-flash-image) を使っている開発者は、即時の性能改善のために置き換えることを推奨。
主な性能ハイライト:
- レイテンシ:テキスト→画像出力を約4秒で提供。対話的プロトタイピングや素早いビジュアルドラフティングに最適。
- コスト効率:$0.034 per 1K image。ドラフティング、アイデア出し、運用コスト管理や低帯域利用に向く選択肢。
- 品質面:速度優先でありながら、プロンプト遵守(prompt adherence)、キャラクターの一貫性、画像中のテキストの可読性は堅実に維持。
パフォーマンス比較では、生成/編集品質(Eloスコア)、処理レイテンシ、1K解像度あたりのコストなどのトレードオフを評価しています。
Nano Banana ファミリーの理解
- Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image):速度重視。超低レイテンシが重要な近リアルタイム・高ボリュームワークフロー向け。
- Nano Banana 2 (Gemini 3.1 Flash Image):ジェネラリストのワークホース。品質とレイテンシ、コストのバランスが良好。
- Nano Banana Pro (Gemini 3 Pro Image):複雑でプロフェッショナルなユースケース向け。精度や高度な推論・制御が重要な場面に最適。
- Nano Banana (Gemini 2.5 Flash Image):レガシーモデル。より良い品質、より高速、より低コストな Nano Banana 2 Lite へのアップグレードを推奨。
開発者向けの統合方法やモデル能力の完全な一覧は developer docs を参照してください。Nano Banana 2 Lite は開発者向けプラットフォームのほか、AI Mode in Search、Gemini app、NotebookLM、Google Photos、Stitch、Google Flow、Google Ads などの消費者向けサーフェスにも展開予定です。
Gemini Omni Flash:高品質でコスト効率の良い動画生成・編集
- モデル名:Gemini Omni Flash (gemini-omni-flash-preview)
- 提供状況:本日より Gemini API と Google AI Studio を通じて開発者に提供(パブリックプレビュー)。
- 価格:$0.10 per second の動画出力(Veo 3.1 Fast と同等の価格設定)。
Omni Flash の強み:
- 会話的な動画編集:自然言語で動画を改良・編集できる。
- マルチモーダル参照:画像、テキスト、ビデオなど複数入力を組み合わせてシーンの制御と一貫性を維持。
- 実世界知識:歴史、生物学、物語の論理など Gemini の知識を参照して説得力ある動画を構築。
- テキストとアクションの同期:単純なプロンプトでテキストやグラフィックを動画アクションに直接結びつけることが可能。
包括的なベンチマーキング情報は Google DeepMind の Gemini Omni ページを参照してください。
制限事項
- 現状、生成できる動画は10秒まで(将来的により長い長さを提供予定)。
- オーディオ参照のアップロードやシーン延長(scene extension)はこのモデルではまだ Gemini API に未対応。
- API スキーマでは最大3秒のビデオ参照が受け入れられますが、現時点ではモデルが正しく処理できない場合があります。
- シーンを変更したりカメラがパンする際のキャラクター一貫性には制限があり、改善作業を継続中。
詳細なモデル能力やリージョン固有の制限については developer docs を確認してください。
両モデルを組み合わせて構築する
本当の利点はこれらのモデルを連鎖させることで発揮されます。例:
- Nano Banana 2 Lite を高速な画像生成モデルとして利用し、その生成画像を Gemini Omni Flash に参照として渡して高品質な動画にアニメーション化する。
- Interactions API を使ったマルチターン体験では、セッション履歴とコンテキストを維持でき、ユーザーは最大3回までの順次編集を積み重ねられます。
デモアプリ(リミックス可)
- Anywhere:両モデルの強力な能力を示すデモアプリ。セルフィーや写真をアップロードすると Nano Banana 2 Lite でアイコニックなランドマークに即変換、生成画像をクリックすると Omni Flash がその画像をアニメ化して短いクリップにします。
- Space Lift:インテリアデザイン向けデモ。写真をアップロードすると Nano Banana 2 Lite が複数のデザインコンセプトを生成し、気に入ったルックで動画ボタンを押すと Omni がシネマティックにデザインを動きで見せます。
- Omni product studio:Nano Banana 2 Lite が作成した静止画を Gemini Omni がシネマティックなeコマース動画に変換するデモ。マルチモーダル入力を素早く統合して画像→動画出力を作るインタラクティブなメディア構築を示します。
安全性と透明性を組み込んで構築する
Gemini Omni と Nano Banana 2 Lite は Google のセキュアなインフラ上で動作し、SynthID のウォーターマーキングを使用しています。AI 生成コンテンツは Gemini app、Gemini in Chrome、Search で検証できます。ウェブ上でコンテンツがどのように作られ・編集されたかを理解するための検証ツールを拡張中です。
今すぐプロジェクトを始める
Nano Banana 2 Lite リソース:
- Google AI Studio で playground を試す。
- Gemini API Documentation を参照。
- Nano Banana prompting guide(ベストプラクティスと例付き)を確認。
Gemini Omni Flash リソース:
- Google AI Studio で playground を試す。
- Gemini API Documentation を参照。
- Gemini Omni Flash prompting guide(ベストプラクティスと例付き)を確認。
POSTED IN: Gemini models