動察 Beating AI 速報、GoogleがNano Banana 2.1を正式にリリースしました。これはNano Banana 2のアップグレード版で、引き続き高効率な画像生成・編集モデルとして位置づけられています。主な改善点は画質、指示への追従性、テキスト生成、マルチターンのキャラクター一貫性に集中しています。Gemini、AI Mode、AI Studio、Flow、Stitch、Google Adsなどの製品で順次提供が開始されており、APIモデル名はgemini-nano-banana-2.1です。
今回の重点は画像編集です。2.1は1K、2K、4Kに対応し、最大14枚の参照画像を同時に使用でき、最大4つのキャラクターと10つのオブジェクトの一貫性を維持できます。Googleはマスク編集、つまり指定領域のみを変更する機能も強化し、インフォグラフィックのレイアウト、画像内テキスト、超ワイド画角の生成も改善しました。モデルは現在、minimal、medium、highの3段階の思考強度を選択できるようになっています。
Google自身のモデルカードでは、thinkingを有効にした2.1は、テキストからの画像生成、汎用編集、複数人一貫性、マスク編集など全10項目の評価において、点推定値がNano Banana 2およびNano Banana Proを上回っています。独立系のArenaランキングでも明確な向上が確認されています。2.1は現在、テキストからの画像生成で第5位、単一画像編集で第6位と、いずれもGoogleモデルの中で最高ですが、GPT Image 2.5とGPT Image 2にはまだ劣っています。
価格はむしろ下がりました。標準APIの1K、2K、4K画像出力はそれぞれ0.0336、0.0504、0.0756ドルで、およそNano Banana 2の半額です。ただし、入力価格は100万トークンあたり0.50ドルから1.50ドルに、テキストおよびthinking出力も3ドルから7.50ドルに値上がりしました。参照画像が多く、思考が重いほど、画像値下げによるコスト優位性は小さくなります。