IMAGE: AI生成ビジュアル
MODELS / MODELS
Google、画像生成モデル「Nano Banana 2.1」のモデルカードを公開 — Gemini 3.6 Flashベース、旧2モデルを上回る内部評価
Google DeepMindが2026年10月、画像生成モデルNano Banana 2.1のモデルカードを公開した。Gemini 3.6 Flashをベースとし、テキスト+画像入力・最大100万トークンのコンテキストで、画像とテキストを出力する。内部の人間評価(Elo)ではT2I・編集の各指標でNano Banana 2とNano Banana Proを上回るとしている(ベンダー公称値)。
Google DeepMindは2026年10月、画像生成モデル Nano Banana 2.1 のモデルカードを公開した。Gemini 3シリーズに属し、Gemini 3.6 Flashをベースとするマルチモーダル・リーズニングモデルで、テキストと画像を入力として受け取り、応答として画像とテキストを生成する。本稿はモデルカード(PDF、2026年10月刊)で確認できる範囲に限定して整理する。
仕様 — テキスト+画像入力、最大100万トークン
- 位置づけ: Gemini 3シリーズの高性能ネイティブ・マルチモーダル・リーズニングモデルの一員。アーキテクチャ・学習データ・ハードウェア等の詳細はGemini 3.6 Flashのモデルカードに委ねられている
- 入力: テキスト文字列(プロンプト・文書など)と画像。トークンコンテキストは最大100万
- 出力: 画像(4Kトークン出力)とテキスト(64Kトークン出力)
- 提供チャネル: Geminiアプリ、Google AI Studio、Gemini API、Google検索AIモード、Google広告、Google Flow、Google Stitchの7経路。API経由での利用に追加のハードウェア・ソフトウェア要件はないとしている
- ナレッジカットオフ: ベースのGemini 3.6 Flashは2026年3月。分野によっては2025年1月時点の知識に留まる場合があるとしている(Gemini 3モデルファミリー共通の注記)
評価 — T2I・編集の内部人間評価で旧2モデルを上回る(ベンダー公称値)
以下はいずれもモデルカード記載のベンダー公称値であり、独立評価ではない。評価手法は、多様なT2I・編集タスクでのSide-by-Side人間評価によるElo(全体選好・デザイン品質など)と、事実性についてのAutoRaterによる片側評価。後方互換の観点ではGemini 2.5 Flash ImageとGemini 3 Pro Imageの主要ユースケースでの回帰評価も行い、目立った後退はないとしている。
- T2I 全体選好(Elo): 2.1(Thinking)1050 ± 14、2.1(No Thinking)1015 ± 13、Nano Banana 2(Gemini 3.1 Flash Image)990 ± 7、Nano Banana Pro(Gemini 3 Pro Image)935 ± 8
- インフォグラフィック・デザイン: 2.1(Thinking)1048 ± 17、2.1(No Thinking)1001 ± 17、Nano Banana 2は961 ± 12、Proは912 ± 12
- インフォグラフィック事実性(AutoRater): 2.1(Thinking)0.521、2.1(No Thinking)0.328、Nano Banana 2は0.179、Proは0.265
- 編集系(Elo、Thinking): 全般編集1026 ± 12、単一キャラクター一貫性1028 ± 14、複数キャラクター一貫性1106 ± 14、マスク/インク編集1049 ± 15、製品一貫性1024 ± 18、スタイル化1062 ± 20、複数参照編集1066 ± 22 — いずれも旧2モデル(900台〜1000前後)を上回っている
- 用途: 複数回の素早い反復を伴う高精度な画像作成・編集、ポスターや精密図表向けの明瞭なテキスト生成、長いコンテキストの実世界知識、多言語の局所テキスト描画に適するとしている

出典: Nano Banana 2.1 - Model Card — Google DeepMind(評価数値の詳細はモデルカードPDF、Google DeepMind)
既知の制限と安全性 — 小さな文字描画などに課題、レッドチーミング実施
- 既知の制限: 小さな文字の描画が苦手(1Kモデルではぼやけがち)、長文・ページ長の描画、入力画像と出力画像のキャラクター一貫性が完全でない場合がある、マスク/ドゥードル編集での指示追従の部分的失敗、左右などの空間定位の混同などを挙げている
- 安全性評価: 開発チーム外の専門チームによる手動レッドチーミングを実施。児童安全の評価では必要な公開しきい値を満たし、コンテンツ安全全般ではGemini 3 Flashと同等か改善したとしている
- フロンティア安全: Gemini 3.1 ProとGemini 3.7 Flashの評価(追跡・重大能力レベルに未達)に依拠し、Nano Banana 2.1も新たな有意な能力や実質的な性能向上はないため、同様に未達の可能性が高いとしている
- 注意: モデルカードは随時更新されうる文書であり、評価値は「2026年10月時点」のものと明記されている。API価格やレート制限などの提供条件はモデルカードの範囲外のため、本稿では扱わない