ニュース

画像生成AI「Nano Banana 2.1」、Pro超えの品質で出力料金は半額

 安いモデルが上位モデルを食う構図になってきた。Googleは10月6日(現地時間)、画像生成/編集AIモデル「Nano Banana 2.1」を公開した。Geminiアプリ、Google AI Studio、Gemini API、Google検索のAIモード、Google Ads、Google Flow、Google Stitchで順次提供する。

 Gemini APIの有料枠における100万トークン当たりの価格は以下の通り。なお、Nano Banana 2のモデルID「gemini-3.1-flash-image」は非推奨となり、10月29日にサービスを終了する。

モデルNano Banana 2.1Nano Banana 2
入力1.5ドル(約237.65円、1ドル=約158.43円換算)0.5ドル(約79.22円)
出力(画像)30ドル(約4,753円)60ドル(約9,506円)

 Nano Banana 2.1は、今年(2026年)2月に登場した「Nano Banana 2」(Gemini 3.1 Flash Image)の後継にあたる高効率モデル。ベースはGemini 3.6 Flashで、速度とコスト効率を維持したまま、画質、プロンプトへの忠実性、会話を重ねた際のキャラクターの一貫性、テキスト描画を改善。上位モデル「Nano Banana Pro」(Gemini 3 Pro Image)よりも効率重視となる。

 人間評価では、総合的な好みのスコアがThinking有効時で1,050±14と、Nano Banana 2の990±7、Nano Banana Proの935±8のいずれをも上回った。差が大きいのは複数キャラクターの一貫性で、Nano Banana 2が978、Proが1,011であったのに対して、1,106を記録した。

 また、インフォグラフィックの事実性を測る指標も従来から大きく伸び、Thinkingを無効にした場合でも総合スコアは1,015で従来モデルを上回る。なお、Thinkingのレベルはminimal/medium/highの3段階から選べ、既定はmediumとなる。

 機能面では、1K/2K/4Kの各解像度で画質とリアリズムを向上させたほか、2K/4K出力時に1:4や4:1、1:8、8:1といった横長/縦長のアスペクト比で発生していたタイル状のアーティファクトを修正した。

 参照画像は最大14枚を同時に扱え、4人までのキャラクターと10個までのオブジェクトの同一性を保ったまま合成できる。Google検索およびGoogle画像検索によるグラウンディングにも対応する。

 既知の制約として、小さな文字や長い段落のテキスト描画がぼやける場合があることや、入力画像とのキャラクターの一貫性が常に保たれるわけではないこと、左右などの空間的な位置の取り違えが起こり得るとしている。