Google a rendu Gemini Nano Banana 2.1 disponible de manière générale dans la Gemini API. Ce modèle consacré à la génération et à l'édition conversationnelle d'images succède à Gemini 3.1 Flash Image, également appelé Nano Banana 2, dont l'arrêt est prévu le 29 octobre 2026.
Le modèle accepte du texte, des images, de la vidéo et des PDF en entrée et génère des images ainsi que du texte. Google annonce une meilleure qualité visuelle, un suivi plus précis des instructions, un rendu du texte amélioré et une meilleure cohérence des personnages au fil des modifications. Les sorties sont proposées en 1K, 2K et 4K, avec des corrections visant les artefacts de répétition sur des formats très larges comme 1:4, 4:1, 1:8 et 8:1.
Pour l'édition à partir de références, la documentation mentionne jusqu'à 14 images, avec une cohérence pouvant porter sur quatre personnages et dix objets. Le modèle peut également s'appuyer sur Google Web et Image Search et propose plusieurs niveaux de thinking. La fiche de Google DeepMind le rattache à la famille Gemini 3 et indique qu'il repose sur Gemini 3.6 Flash.
Les comparaisons de qualité publiées par Google montrent des progrès sur plusieurs évaluations de génération et d'édition, mais elles restent fournies par le concepteur du modèle. Aucune évaluation indépendante crédible postérieure au lancement n'a été trouvée pendant cette vérification. Pour les développeurs, la disponibilité générale s'accompagne surtout d'une migration à préparer avant l'arrêt de Gemini 3.1 Flash Image.