Nano Banana 2.1をGPT Image 2.5と同じお題5本で比べた看板の文字はどちらも書け、差がついたのは貼り紙の小さな本文と同じキャラの描き分け
Googleが2026年10月6日、画像生成モデルNano Banana 2.1(gemini-nano-banana-2.1)を正式提供した。画像1枚の値段は1Kで0.0336ドルと前のNano Banana 2のほぼ半分で、Nano Banana 2は10月29日に提供を終える。GPT Image 2.5と同じお題5本で比べると、看板の大きな文字はどちらも書けた一方、貼り紙の小さな本文・同じキャラの描き分け・条件の多い絵ではGPTが上だった。

目次
【訂正】公開時に「公式のベンチマークは未公表」と書いたのは誤りでした。 Google DeepMindのモデルカード(10月6日付)に、Google社内の評価の点数が載っていました。解説動画でも「ベンチマークの点数は、まだ公式に出ていない」と言っていますが、同じく誤りです。点数は「Google自身の評価では、10項目すべてでNano Banana 2とProを上回った」の節に足しています(10月7日午前3時台に修正)。
2026年10月7日未明(日本時間)時点の情報です。Googleが10月6日、画像生成モデル「Nano Banana 2.1(ナノバナナ2.1)」を正式提供した。Gemini APIの変更履歴によると位置づけはNano Banana 2の更新版で、料金表では画像1枚の値段が前の版のほぼ半分になった。前のNano Banana 2は10月29日で提供を終える。Googleが出した点数はNano Banana 2・Proとの比較だけで、GPT Imageは入っていない。そこで、筆者が今の画像生成の一番手と見ているGPT Image 2.5に、同じお題5本をそのまま入れて比べた。結果は解説動画にまとめていて、この記事はその数字と絵を並べたものだ。
3行まとめ
- Nano Banana 2.1(gemini-nano-banana-2.1)は10月6日に正式提供。画像1枚は1Kで0.0336ドル(1ドル150円で約5円)、2Kで0.0504ドル、4Kで0.0756ドルで、Nano Banana 2の0.067/0.101/0.151ドルのほぼ半分。一方、入力は100万トークンあたり0.5ドルから1.5ドルへ3倍になった。
- Googleのモデルカードでは、社内の人の比べ評価で、Nano Banana 2とProを10項目すべてで上回った(GPT Imageとの比較は無い)。同じお題5本でGPT Image 2.5と比べると、看板の大きな文字はどちらも書けた。差がついたのは、貼り紙の小さな本文、同じキャラを3コマに描き分ける所、ペリカンに5つの条件を積んだ絵で、どれもGPT Image 2.5が上だった。
- 2.1にGoogle検索で自分の公式情報を調べさせて図にさせると、モデル名と発表日は合っていたが、1枚の値段を前のNano Banana 2の値段で書いた。
| 項目 | Nano Banana 2.1(2026年10月7日未明・日本時間時点) |
|---|---|
| 正式提供 | 2026年10月6日(Gemini API変更履歴・Google Cloudとも「GA」) |
| モデル名 | gemini-nano-banana-2.1。Nano Banana 2(gemini-3.1-flash-image)の更新版 |
| 使える場所 | Geminiアプリ、Google AI Studio、Gemini API、Google Cloud。同じ夜にOpenRouterとReplicateにも載った |
| 画像1枚の値段 | 1K 0.0336ドル/2K 0.0504ドル/4K 0.0756ドル(Gemini APIの料金表)。Batchは半額 |
| 100万トークンあたり | 入力1.5ドル(Nano Banana 2は0.5ドル)/文章の出力7.5ドル(同3ドル)/画像の出力30ドル(同60ドル) |
| 縦横の比 | 1:4・4:1・1:8・8:1の極端な横長・縦長を含む。解像度は1K・2K・4K |
| 無料枠 | Gemini APIの料金表では無料枠は「Not available」 |
| Nano Banana 2 | 2026年10月29日に提供終了。2.1への移行を案内 |
| 土台のモデル | Gemini 3.6 Flash(モデルカード) |
| 公式の点数 | Google DeepMindのモデルカード(10月6日付)に、社内の人の比べ評価(Elo)。比べた相手はNano Banana 2とPro |
Googleが言う「良くなった点」は7つ
Gemini APIの変更履歴は、2.1をこう説明している。
"An update to Nano Banana 2 (gemini-3.1-flash-image), it maintains Flash-level speed and cost efficiency while delivering significant improvements in visual quality, prompt adherence, multi-turn character consistency, text rendering, and wide and panoramic aspect ratio generation (1:4, 4:1, 1:8, 8:1) across 1K, 2K, and 4K resolutions."
(Nano Banana 2の更新版で、Flash並みの速さとコスト効率を保ったまま、画質、指示どおりに描く力、やり取りを重ねてもキャラが変わらないこと、文字の描画、極端な横長・縦長の生成を、1K・2K・4Kで大きく改善した)
Geminiアプリの公式Xは、10月7日午前1時ごろ(日本時間)の投稿で、範囲を指定する編集にも触れた。
"This upgraded version outperforms our previous models across the board, with notable leaps in visual design, mask-based editing, and subject consistency to help you create more natural-looking images."
(この新しい版は、これまでのモデルをすべての面で上回り、デザイン、マスクを使った編集、被写体の一貫性で大きく進んだ)
Google Cloudの資料には、Google検索と画像検索で調べてから描く機能も対応として載っている。変更履歴とXの投稿と資料を合わせると、画質・指示どおり・キャラの一貫性・文字・横長と縦長・マスク編集・検索との連動の7つになる。「すべての面で上回る」の裏づけとしてGoogleが出している点数は、次の節のモデルカードのものだ。
Google自身の評価では、10項目すべてでNano Banana 2とProを上回った
Google DeepMindのモデルカードによると、2.1はGemini 3.6 Flashを土台にしている。評価は、2枚を並べて人が良い方を選ぶ比べ評価から出したElo(点数が高いほど選ばれやすい)で、インフォグラフィックの事実の正確さだけは自動の採点だ。
| 項目(Elo、事実の正確さは採点) | 2.1(考える) | 2.1(考えない) | Nano Banana 2 | Nano Banana Pro |
|---|---|---|---|---|
| 文章から画像:全体の好み | 1050 ±14 | 1015 ±13 | 990 ±7 | 935 ±8 |
| インフォグラフィックのデザイン | 1048 ±17 | 1001 ±17 | 961 ±12 | 912 ±12 |
| インフォグラフィックの事実の正確さ | 0.521 | 0.328 | 0.179 | 0.265 |
| 編集:全般 | 1026 ±12 | 980 ±15 | 938 ±11 | 939 ±10 |
| 編集:1人のキャラの一貫性 | 1028 ±14 | 1021 ±14 | 981 ±10 | 991 ±9 |
| 編集:複数のキャラの一貫性 | 1106 ±14 | 1068 ±14 | 978 ±10 | 1011 ±10 |
| 編集:マスク・手描きでの範囲指定 | 1049 ±15 | 1042 ±16 | 965 ±12 | 927 ±12 |
| 編集:商品の一貫性 | 1024 ±18 | 981 ±18 | 955 ±22 | 965 ±14 |
| 編集:画風の変換 | 1062 ±20 | 1036 ±17 | 991 ±12 | 990 ±12 |
| 編集:複数の参考画像 | 1066 ±22 | 1041 ±20 | 988 ±13 | 989 ±12 |
(出典: Nano Banana 2.1 モデルカード「Results as of October, 2026」。Nano Banana 2は考えるモードの値。インフォグラフィックのデザインの2.1(考える)は、原文の表記が「+/ 17」)
10項目すべてで、2.1は考えるモードでも考えないモードでも、Nano Banana 2とProを上回っている。差が一番大きいのは複数のキャラの一貫性で、考えるモードの1106はNano Banana 2の978より128高い。ただし、これはGoogleが自分のモデルどうしを比べた社内の評価で、GPT Imageなど他社のモデルは入っていない。
同じモデルカードは、まだ弱い所としてこう書いている。
"Poor text rendering in small text (often blurry in 1k model), long paragraphs, page length"
(小さな文字の描画が弱い(1Kでは、ぼやけることが多い)。長い段落やページ分の文章も同じ)
"Occasional confusion around spatial localisation (e.g. left/right etc.)"
(左右など、位置の取り違えがときどきある)
下の比較で2.1が差をつけられた貼り紙の小さな本文は、Google自身が弱点として挙げている所と重なる。
横長はNano Banana 2でも作れた。今回の主張は、その横長・縦長の絵の質が上がったという点だ。8対1で、左から右へ江戸の日本橋から今の渋谷まで時代が流れる絵巻を1Kで頼んだのが下の絵になる。

頼んだのは日本橋・昭和の銀座・渋谷の3つだけだが、2.1は間に明治のれんが街を自分で挟み、画風も浮世絵から写真へ少しずつ変えてきた。同じ比率はGPT Imageでは頼めない。OpenAIの画像生成ガイドは、自由な大きさを指定する時の条件をこう書いている。
"the aspect ratio must be between 1:3 and 3:1"
(縦横の比は1:3から3:1の間でなければならない)
画像1枚は約半分、入力と文章は値上げ
| 100万トークンあたり(ドル) | 入力 | 文章の出力 | 画像の出力 | 画像1枚(1K/2K/4K) |
|---|---|---|---|---|
| Nano Banana 2.1 | 1.50 | 7.50 | 30.00 | 0.0336/0.0504/0.0756 |
| Nano Banana 2 | 0.50 | 3.00 | 60.00 | 0.067/0.101/0.151 |
値段はGemini APIの料金表(10月7日午前2時54分に取り直した)による。下がったのは画像を出す部分だけで、入力は3倍、文章の出力は2.5倍になった。参考画像をたくさん入れて1枚を描かせる使い方だと、前の版より高くつく場合がある。まとめて投げるBatchはどちらも半額だ。
4Kの値段は、Googleの資料どうしで食い違っている。Gemini APIの料金表とGoogle Cloudのモデルのページは4K=2,520トークン(0.0756ドル)と書いているが、Google Cloudの料金表の注記だけは「3780 tokens ($0.113) for 4K」となっている。4Kで大量に使うなら、最初の請求で確かめたほうがいい。
比べた相手のGPT Image 2.5も、画像の出力は100万トークンあたり30ドルで同じだ(OpenAIの料金表)。ただ、OpenAIのガイドは次のように注意している。
"Equal token rates don't mean equal cost per image: token consumption can differ by model and quality setting."
(トークン単価が同じでも1枚の値段が同じとは限らない。使うトークン数はモデルと品質の設定で変わる)
GPTは品質の設定で1枚に使うトークン数が変わるので、1枚いくらの比較は、この記事ではしない。
同じお題5本で比べた条件
お題は、海外の比較記事が実際に試して差が出た試験を日本語向けに作り直した。英語の看板だらけの交差点(Decrypt)、ペリカンに条件を積む試験(MindStudio)、参照からのキャラの一貫性(AI Blew My Mind)などだ。
- Nano Banana 2.1はGoogle AI Studio(APIキーなし・2K・検索なし)、GPT Image 2.5はChatGPTの画像作成で作った。日時は2026年10月7日の午前1時40分〜2時20分ごろ(日本時間)
- 同じ文をそのまま貼り、それぞれ1回目の絵で比べた。引き直していない
- 最初は2.1を1Kで回していて、GPTの絵(1672×941)より小さかった。条件をそろえるため2.1を2Kで全部撮り直した。下の判定は2Kの結果
- ChatGPT側の品質の設定は、この記事では確かめていない
この記事に載せた2.1の絵は、AI Studioの画面を撮影したもの(幅およそ1,265ピクセル)だ。AI Studioの一時チャットを閉じた時に2Kの元ファイルが消えた。GPTの絵は元のファイルを縮めて載せている。細部の見え方は2.1に不利になっている点を割り引いて見てほしい。判定は生成直後にAI Studioの画面で拡大して見たもので、小さすぎて読めなかった所は判定していない。
| お題 | Nano Banana 2.1 | GPT Image 2.5 |
|---|---|---|
| ① 文字だらけの深夜の路地 | 頼んだ文字は「止まれ」以外正確。「止まれ」は向こう向き | 頼んだ文字が全部正確。貼り紙の小さな本文まで読める |
| ② 同じキャラを3コマに | 特徴は保ったが、宇宙船のコマは横から。絵柄が1回目と変わった | 服装まで1回目と同じ。宇宙船のコマも上からの構図 |
| ③ ペリカンに条件を5つ | 翼から人の手。時計は5時15分と違う時刻 | 右の翼に時計、左の翼にワイン。時計は5時15分に近い |
| ④ ポスター36枚 | 36枚ともタイトルが読める。絵柄の幅が広い | 36枚ともタイトルが読め、全部にキャッチコピー |
| ⑤ 神様のスマホ | 笑いのネタが多い。画面が重なり端が切れる | 9画面を本物のスマホのように作り込んだ。カレンダーは2024年 |
① 文字だらけの深夜の路地
雨上がりの新宿の路地に、縦書きの看板「スナック 夜明け前」、赤提灯「とりあえず生」、シャッターの落書き「まだここにいる」、破れたポスター「最終公演 10月31日」、電柱の貼り紙「迷い猫 探しています」、路面の「止まれ」を入れるよう頼んだ。

2.1は「止まれ」以外を正確に書いた。1Kで出した時は「まだここにいる」が崩れていたので、2Kにした分だけ上がっている。ただ「止まれ」は、道の向こう側から読む向きに書かれていて、カメラ側からは読めない。GPTは頼んだ文字が全部正確で、「止まれ」もカメラ側から読める向きだった。頼んでいない「新宿ゴールデン街」の案内板や焼き鳥屋の看板まで描き足している。

差がはっきり出たのは迷い猫の貼り紙だ。GPTは小さな本文まで「茶白のオス/首輪なし/見かけた方は/ご連絡ください」と意味の通る日本語にした。2.1の貼り紙の本文は、手元に残った画面撮影では小さすぎて判定できない。1Kで出した時の2.1は、意味のない文字の並びだった。
Decryptの英語版の試験では、逆にNano Banana 2が文字で勝ち、GPT Image 2.5は落書きを「STILLL HERE」とLを1つ多く書いていた。今回の日本語の1回では、GPTのほうが文字を落とさなかった。
② 同じキャラを別の場面へ
1回目に「銀髪のショートボブ、右目の下に小さな星のほくろ、黄色いレインコートの胸に青い猫のワッペン、左耳だけに赤いイヤリング」のキャラを駅のホームに立たせ、2回目に同じ見た目のまま、ラーメン屋・夜の海辺・宇宙船の窓(斜め上から)の3コマにさせた。キャラの一貫性は、Googleが今回良くなったと言っている所だ。

2.1は髪型・ワッペン・イヤリングを3コマとも保った。ただ、宇宙船のコマは頼んだ斜め上からでなく横から描き、絵柄も1回目の絵より線のはっきりした漫画寄りに変わった。ほくろは丸い点で、頼んだ星の形ではない。GPTはリュック、チェックのスカート、スニーカー、黒いタイツまで1回目と同じで、宇宙船のコマは上から見下ろす構図、横顔のコマでは星形のほくろが見えた。AI Blew My Mindは、参照写真からのキャラの一貫性でGPTが大きく上だったと書いている(比べたのは1つ前の世代のNano Banana 2とGPT Images 2)。今回も同じ向きの結果になった。
③ ペリカンに条件を5つ積む
MindStudioはGPT Image 2.5のレビューで、自転車に乗ったペリカンに5時15分とワインを足すと崩れたと書いている。時計がアナログとデジタルの2つ出て、ペダルが自転車の同じ側に付いたという。これを京都版にして、「左の翼になみなみの赤ワイン、右の翼に5時15分の懐中時計、両足は左右のペダル、背景に五重塔」と頼んだ。

2.1は五重塔と石畳の雰囲気は出したが、ワインのグラスを持っているのは翼の先から生えた人間の手で、時計は5時15分と違う時刻を指していた。1Kで出した時も手は生えていた。GPTはペリカンを正面に向け、本人の右の翼に時計、左の翼にワインを持たせ、時計は5時15分に近い位置を指していた。それでもワインはなみなみまではいかず、羽の先は手のように物をつかんでいて、片足はペダルに乗っているがもう片方は隠れて見えない。今回の1回では、MindStudioの報告ほどGPTは崩れなかった。
④ 架空のアニメ映画のポスター36枚
6×6に並べた36枚に、絵柄・ジャンル・配色を変えて違う日本語のタイトルを入れるよう頼んだ。

どちらも36枚ともタイトルが読め、重複もなかった。2.1はドット絵、ちびキャラ、ロボット、忍者と絵柄の幅が広い。ただ1枚(「激闘!ブレイク」)は、筆者の目には有名な漫画の主人公によく似て見えた。商用で使うなら1枚ずつ確かめたほうがいい。GPTは塗りがそろって1つの作品集のようになり、36枚全部に「きっと、どこかで、また会える。」のような意味の通るキャッチコピーまで入れた。タイトル以外の小さな文字は、1Kで出した時の2.1では意味のない文字の並びだった。
⑤ 神様のスマホのスクショ集
LINE、カレンダー、検索履歴、通知などを、神様のスマホとして日本語で、ちょっと笑えるように描かせた。

笑いのネタは2.1のほうが多かった。天使とのLINEで「あ、忘れてた。適当に隕石落としといて」と恐竜の絶滅を頼み、「じゃあ40日くらい雨降らせて(ノアの件)」と続く。ただスマホ5台を重ねた構図で、端の画面は切れている。GPTは9つの画面を本物のスマホのように作り込んだが、カレンダーの年は「2024年4月」になっていた。
2.1に自分の公式情報を調べさせたら、値段を前の版で書いた
検索と組み合わせて描けるのが2.1の売りの1つなので、AI StudioでGoogle検索をオンにして「今日発表されたNano Banana 2.1の公式情報を調べ、1枚の図にまとめて」と頼んだ。2.1は12回検索してから描いた。

モデル名と10月6日の発表、初代Nano Bananaが10月2日に終わったこと、Imagen 4が8月17日に終わったことは合っていた。間違えたのは2か所だ。1枚の値段を1K 0.067ドル・2K 0.101ドル・4K 0.151ドルと書いたが、これは前のNano Banana 2の値段で、2.1の正しい値段は0.0336・0.0504・0.0756ドル。しかも「Batchは半額」として0.034・0.050・0.075ドルと書いていて、こちらは2.1の通常の値段に近い数字だった。もう1つは、Nano Banana 2の終了日を「未発表」と書いたこと。提供終了日の一覧には10月29日と載っている。どのページを読んでこの値段を書いたのかは、画面には出ていない。
名前だけ伝えたら、バナナではなく菜の花の妖精になった
動画の図は全部2.1に描かせ、案内役のキャラクターも2.1に作らせた。頼んだのは「『なのばなちゃん』というオリジナルキャラクターを、あなたの自由なイメージでデザインして。全身、正面。」の一文だけだ。

出てきたのは、黄色いツインテールに菜の花の髪飾り、葉のケープを着た女の子で、背景は菜の花畑だった。「なのばな」を「菜の花」と読んだらしく、バナナの要素はどこにもない。動画の値段表や使い分けの図も、このキャラと同じ一時チャットで描かせた。図の中の日本語は一字ずつ突き合わせて、崩れが無いことを確かめている。大きな見出しや表の日本語は、今回試した範囲では崩れなかった。
ちなみに筆者のGeminiアプリ(Proプラン)の画面には「Nano Banana を使用」と出るだけで、どの版で描いているかは表示されなかった。2.1を名指しで試したいなら、AI Studioでモデルを選ぶのが確実だ。AI Studioの使用量の画面には、APIキーを選ばずに使った分は無料と書かれていて、今回の比較はすべてその範囲で行った。
筆者の結論は、王者はまだGPT Image
ここからは筆者の主観だ。5本を並べて見ると、2.1は全体に絵が安っぽく、GPT Image 2.5とは描き込みの桁が違う。2.1を2Kにそろえて撮り直しても、この評価は変わらなかった。
それでも、画像1枚が約5円で、看板の大きな文字は正確に書け、8対1の絵巻のようにGPT Imageでは頼めない形も作れる。大量に作る仕事なら2.1を選ぶ理由は十分ある。使い分けを2.1自身に図にさせると、こうなる。

1回ずつの比較で言えること・言えないこと
- お題ごとに1回目の絵だけで比べた。引き直せば結果は変わりうる。Decryptの英語の試験では文字でNano Banana 2が勝っていて、今回とは逆の向きだった
- GPT Image 2.5はChatGPTの画像作成経由で、APIの品質設定を指定して比べたわけではない
- 2.1の2Kの元ファイルは手元に無く、記事の絵は画面撮影。判定は生成直後に画面で拡大して見たもの
- AI Studioの2.1の画面には「This model is not stable and may not be suitable for production use」と出ている。一方でGemini APIの変更履歴とGoogle Cloudの資料は正式提供(GA)と書いていて、説明が場所によってそろっていない
- Googleの点数は社内の比べ評価で、GPT Imageなど他社のモデルは入っていない。外部のランキングに2.1が載っているかは、この記事では確かめていない
出典と、確かめた時刻
- 正式提供・モデル名・Nano Banana 2の終了日: Gemini API 変更履歴、提供終了日の一覧(10月7日午前0時53分に掲載を確認、午前2時54分に再確認)
- 値段: Gemini API 料金、Google Cloud 料金(同2時54分に再確認)。円の金額は1ドル150円で計算
- 公式の点数・土台のモデル・弱い所: Google DeepMind「Nano Banana 2.1 モデルカード」(PDF・更新時刻は10月7日午前0時42分。記事への反映は午前3時台)
- 対応機能・正式提供: Google Cloud「Gemini Nano Banana 2.1」
- 公式X: Gemini、Google AI Studio、Nano Banana
- 外部サービス: OpenRouter(10月7日午前1時53分に登録を確認)、Replicate(同じころに確認)
- GPT Image 2.5: OpenAI 画像生成ガイド、OpenAI 料金
- お題の元にした比較記事: Decrypt、MindStudio、AI Blew My Mind
外部のランキングに2.1が載ったら、この記事に追記する。本記事は続報があり次第更新します。同じ日にGoogleが出したEmbeddingGemma 2を手元のMacで試した記事もある。比べてほしいお題があれば、動画のコメント欄で教えてほしい。次の比較に使う。
出典・参照資料
- 一次資料Gemini API 変更履歴(2026-10-06) ↗
- 一次資料Gemini API 料金 ↗
- 一次資料Gemini API 提供終了日の一覧 ↗
- 一次資料Google Cloud「Gemini Nano Banana 2.1」 ↗
- 一次資料Google Cloud 料金 ↗
- 一次資料Google DeepMind「Nano Banana 2.1 モデルカード」(2026-10-06) ↗
- 一次資料Nano Banana 2.1 Model Card(PDF) ↗
- 一次資料Gemini 公式X(2026-10-06) ↗
- 一次資料Google AI Studio 公式X(2026-10-06) ↗
- 一次資料Nano Banana 公式X(2026-10-06) ↗
- 一次資料OpenAI 画像生成ガイド ↗
- 一次資料OpenAI 料金 ↗
- 二次資料OpenRouter「Google: Nano Banana 2.1」 ↗
- 二次資料Replicate「google/nano-banana-2.1」 ↗
- 二次資料Decrypt「ChatGPT Images 2.5 vs Nano Banana 2」 ↗
- 二次資料MindStudio「GPT Image 2.5 Review」 ↗
- 二次資料AI Blew My Mind「Nano Banana 2 vs GPT Images 2」 ↗
更新・訂正履歴
- 公開時(10月7日午前3時ごろ・日本時間)に「公式のベンチマークは未公表」と書いたが誤りだった。Google DeepMindのNano Banana 2.1のモデルカード(10月6日付)に、Google社内の人の比べ評価(Elo)の点数が載っていた。同じURLのPDFの更新時刻は10月7日午前0時42分(日本時間)で、記事を書いた時点ですでに出ていた。モデルカードを確かめずに「未公表」と書いた。点数の節を足し、表・冒頭・但し書きの該当箇所を直した。
この記事の解説動画
YouTubeで見る ↗大きいニュースはYouTubeでも解説しています。Xでは新着記事をお知らせしています。
コメント
まだコメントはありません。最初のコメントを書いてみませんか?
AIについて聞きたいことはありますか?
質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。
質問箱を見る →