Una nuova generazione di intelligenza artificiale visiva

Google ha annunciato il rilascio di Nano Banana 2.1, la versione più recente del modello dedicato alla creazione e alla modifica di immagini. Il nuovo sistema si appoggia alle fondamenta di Gemini 3.6 Image e promette miglioramenti su più fronti, concentrandosi in particolare su tre aree chiave: design visivo, editing con maschere e coerenza dei soggetti.

Dal Nano Banana 2 al 2.1: cosa è cambiato

All’inizio dell’anno era arrivato Nano Banana 2, noto anche come Gemini 3.1 Flash Image, che combinava la qualità della versione Pro con la velocità dei modelli Flash. Quella release aveva introdotto una migliore conoscenza del mondo reale, una resa più accurata del testo e una maggiore coerenza tra personaggi e oggetti. Nano Banana 2.1 amplia questi vantaggi, rendendo l’esperienza visiva più fluida e professionale.

Design visivo più raffinato

Il nuovo modello punta a produrre composizioni più gradevoli e grafiche più rifinite. Gli utenti notano meno l’aspetto “volantino di una sagra improvvisata” e più una resa curata, adatta a contesti pubblicitari, editoriali e creativi. La capacità di gestire colori, luci e prospettiva è stata ottimizzata per offrire risultati più coerenti con le intenzioni dell’utente.

Editing con maschere: precisione al livello successivo

Una delle novità più attese è l’editing con maschere, che consente di selezionare con precisione una porzione dell’immagine e modificarla senza dover rigenerare l’intera scena. Questa funzionalità è particolarmente utile per i professionisti del fotoritocco, i designer e chiunque abbia bisogno di interventi puntuali su dettagli specifici, mantenendo intatto il resto dell’immagine.

Coerenza dei soggetti in ogni immagine

Nano Banana 2.1 è più abile a mantenere l’aspetto e l’identità di persone o oggetti attraverso modifiche successive e nella generazione di serie collegate. Il modello riconosce e preserva tratti distintivi come volto, abbigliamento o oggetti ricorrenti, garantendo che la stessa tazza, la stessa giacca o lo stesso volto compaiano con coerenza in più immagini.

Disponibilità e integrazione nei prodotti Google

Il rollout è già iniziato e il modello è stato distribuito su diversi servizi dell’ecosistema Google, tra cui l’app Gemini, AI Mode, Google AI Studio, Flow, Stitch, Google Ads e la Gemini Enterprise Platform. Gli sviluppatori possono accedere al modello con l’ID gemini-nano-banana-2.1, disponibile in via generale. Nano Banana 2.1 accetta input di testo, immagini, audio e video, e può produrre immagini a risoluzioni di 1 K, 2 K e 4 K.

La concorrenza sul mercato dell’immagine AI

Nonostante le novità di Google, il modello più avanzato attualmente sul mercato rimane ChatGPT Images 2.5 di OpenAI. La sua forza principale è la capacità di ricordare le modifiche precedenti durante il processo di rifinitura, evitando di alterare parti non interessate e preservando l’integrità dell’immagine originale. A inseguire OpenAI c’è MAI‑Image‑2.6 di Microsoft AI, lanciato ad agosto di quest’anno, che punta a chiudere il gap in termini di qualità e coerenza.

Prospettive future

Con Nano Banana 2.1 Google consolida la propria posizione nel panorama della generazione di immagini AI, puntando su strumenti più pratici per professionisti e creativi. La capacità di gestire maschere precise e la maggiore coerenza dei soggetti aprono nuove opportunità per campagne pubblicitarie, progetti di design e applicazioni aziendali. La sfida rimane ora quella di mantenere il ritmo di innovazione rispetto a concorrenti come OpenAI e Microsoft, che continuano a spingere i limiti della creatività artificiale.