Googleは、画像生成・編集モデル「Gemini Nano Banana 2.1」を一般提供しました。
Gemini APIやGeminiアプリ、Google検索のAIモードなどに順次展開します。
画像出力料金は従来モデルの半額となる一方、入力とテキスト出力の料金は引き上げました。
記事の概要
Nano Banana 2.1は、Gemini APIで「gemini-nano-banana-2.1」として利用できます。
1K、2K、4Kの画像生成に対応し、画質やプロンプトへの追従性を改善しました。
複数回の編集でキャラクターの一貫性を保つ性能や、文字の描画精度も高めました。
2Kと4Kでは、1:4、4:1、1:8、8:1のワイド・パノラマ画像に対応しました。
マルチ画像融合では、最大14枚の参照画像を使い、最大4人のキャラクターを維持できます。
APIの画像出力料金は100万トークンあたり30ドルで、Nano Banana 2の60ドルから半額になりました。
一方、入力料金は1.5ドル、テキストと思考の出力料金は7.50ドルに上がりました。
従来の「gemini-3.1-flash-image」は10月29日に提供を終了し、移行が案内されています。
記事のポイント
- 対応サービスを拡大: Gemini APIに加え、GeminiアプリやGoogle AI Studio、Google Adsなどへ順次展開します。
- 画像生成の仕様: 最大14枚の参照画像を使い、最大4人のキャラクターと10個のオブジェクトを扱えます。
- 料金と移行期限: 画像出力は半額になりましたが、入力とテキスト・思考出力は値上げされました。
このニュースがもたらす影響
- 導入検討企業: 画像中心の生成・編集を大量利用する企業では、出力単価の低下を生かす一方、入力・テキスト思考出力の増加を含む処理全体の原価試算が必要になりそうです。
- 画像AI提供者: 複数の参照画像や人物・物体の一貫性を業務用途に求める顧客には、対応できる制作範囲や品質を基準に、既存サービスとの差を示すことが求められそうです。
- API運用担当: 従来モデルの提供終了日が示されているため、既存の画像生成処理では出力品質だけでなく、料金構成やプロンプト互換性を含めた移行検証を早めに進める必要がありそうです。
このニュースの背景
画像生成・編集モデルは、画質や文字描画だけでなく、複数回の編集で対象を維持できるかが実務利用のしやすさを左右します。
今回はワイド画像や複数の参照画像への対応が広がり、広告やデザインなど、構成要素の多い制作にも使いやすくなる方向です。
APIでは画像出力の料金が下がる一方、入力とテキスト・思考出力は値上がりしており、用途によって費用構造が変わります。
従来モデルの提供終了も案内されているため、利用企業には性能比較と料金再計算を伴う移行判断が必要になっています。
関連するニュース
- GoogleはGeminiの無料版とGoogle AI Plusで利用できるモデルを10月9日から制限します。
- グーグルはGeminiのプラン別利用モデルを変更し、未加入者をFlash-Liteのみとします。
- GoogleはGemini 3.8に音声生成モデルと映像アバターによる対話機能を追加しました。
詳しい記事の内容はこちらから(引用元)
Googleは、画像生成・編集モデル「Gemini Nano Banana 2.1」を一般提供した。Gemini API…
https://www.watch.impress.co.jp/docs/news/2146379.html