結論:Googleが新型の画像生成・編集AIモデル「Nano Banana 2.1」を公開
米Googleは10月6日(現地時間)、画像生成・編集AIモデル「Nano Banana 2.1」を発表しました。本モデルは「Gemini 3.6 Flash」をベースにして開発されており、開発者向けに提供されるAPIの画像出力料金が前モデルである「Nano Banana 2」の約半額に引き下げられるなど、コストパフォーマンスの向上が図られています。
何が発表・変更されたか:基本仕様と料金体系
今回の発表により、開発者やユーザーが利用できる新たな選択肢として「Nano Banana 2.1」が追加されました。
- ベースモデル:「Gemini 3.6 Flash」を基盤に構築されている。
- 入力とコンテキスト:テキストと画像の両方に対応し、コンテキストウィンドウは最大100万トークンをサポートする。
- API提供形態:開発者向けにはGemini APIを通じてモデルID「gemini-nano-banana-2.1」として提供される。
- 利用条件:有料ティアのみでの利用となる。
- 料金面:APIでの画像出力料金が「Nano Banana 2」と比較して約半額になる。
確認済みの具体情報と現在の課題
「Nano Banana 2.1」は幅広い応用が期待される一方で、現時点ではいくつかの課題も挙げられています。
具体的には、小さな文字や長い段落の描画がぼやけることがあること、入力画像と生成画像の間でキャラクターの一貫性が常に完全ではないこと、左右など空間的な位置関係を取り違える場合があることなどが課題として挙げられています。利用にあたっては、こうした技術的な特性を把握しておくことが重要となります。
開発者・利用者への影響と今後の展望
APIの画像出力料金が約半額になったことは、画像生成機能を自社のアプリケーションやサービスに組み込みたい開発者にとって大きなメリットとなります。コスト負担が軽減されることで、より多様なユースケースでの導入や実験が促進されることが見込まれます。
また、「Gemini 3.6 Flash」をベースに持つことで、最大100万トークンという広範なコンテキストウィンドウを活用した高度なテキスト・画像処理が可能になります。有料ティア限定での提供とはなりますが、実用的なAIアプリケーション開発を加速させる重要なアップデートと言えるでしょう。


コメント