L’intelligenza artificiale che gira direttamente sullo smartphone, senza cloud e senza connessione internet, sta diventando il nuovo campo di battaglia tra i produttori di chip e i colossi del software. Google ha appena mosso una mossa importante: Gemini Nano 4 è ufficiale, e quello che promette merita attenzione.
Cos’è Gemini Nano 4 e perché è diverso da prima
Gemini Nano 4 è la nuova generazione del modello AI on-device di Google pensato per i flagship Android. La sua particolarità — quella che lo distingue davvero dalla generazione precedente — è che non nasce come prodotto isolato, ma come derivazione ottimizzata di Gemma 4, il modello open source che Google ha presentato contemporaneamente per sviluppatori e PC.
Il concetto è rilevante: chi sviluppa app usando Gemma 4 oggi scrive codice che sarà automaticamente compatibile con i dispositivi Gemini Nano 4 quando arriveranno sul mercato. Google ha scelto un approccio che riduce la frammentazione e abbassa le barriere per gli sviluppatori.
I numeri sulle prestazioni sono concreti. Rispetto alle versioni precedenti, Gemini Nano 4 è fino a quattro volte più veloce nell’esecuzione delle inferenze e consuma il 60% di energia in meno. Per uno smartphone, dove la batteria è sempre la risorsa più scarsa, questo non è un dato secondario.
Due versioni, due filosofie
Google ha strutturato Gemini Nano 4 in due varianti con obiettivi distinti.
- Gemini Nano 4 Fast, basato su Gemma 4 E2B: progettato per la massima velocità e la latenza più bassa possibile. Risponde tre volte più rapidamente del modello Full. È la scelta per tutto ciò che richiede reattività immediata — trascrizioni in tempo reale, risposta rapida ai comandi, funzioni di assistenza quotidiana.
- Gemini Nano 4 Full, basato su Gemma 4 E4B: sacrifica una frazione della velocità per ottenere una capacità di ragionamento superiore. È il modello per compiti complessi — analisi di testi articolati, ragionamento matematico, comprensione di contesti multilivello.
Entrambe le varianti supportano input multimodali: testo, immagini e audio nello stesso flusso di elaborazione. E parlano, nativamente, oltre 140 lingue.
Dove girano questi modelli
Gemini Nano 4 è ottimizzato per girare sugli acceleratori AI di ultima generazione. Google ha dichiarato che le prestazioni complete si esprimono su hardware prodotto da Google, MediaTek e Qualcomm Technologies — i tre nomi che dominano il mercato dei chip per smartphone Android di fascia alta.
Su dispositivi non compatibili con AICore, i modelli possono comunque girare su CPU, ma con prestazioni non rappresentative di quelle finali. Per questi casi, Google ha reso disponibile anche l’app AI Edge Gallery come banco di prova alternativo.
La versione stabile che è disponibile oggi sui flagship — come Pixel 10 e Galaxy S26 — è Gemini Nano 3. Gemini Nano 4 arriverà sui nuovi top di gamma Android entro la fine del 2026.
Già disponibile per gli sviluppatori, non ancora per tutti
Il modello è accessibile oggi, ma solo attraverso l’AICore Developer Preview. Chi sviluppa app Android può iscriversi al programma, scaricare i modelli direttamente sul dispositivo di test e cominciare a costruire funzionalità prima che il modello sia distribuito agli utenti finali.
Google ha annunciato che durante il periodo di preview aggiungerà progressivamente nuove capacità: supporto al tool calling, output strutturati, system prompt e — dettaglio non banale — una modalità di “thinking” che permetterà al modello di ragionare in modo più deliberato prima di rispondere.
Cosa cambia davvero per chi compra uno smartphone
Francamente, la distinzione tra AI cloud e AI on-device è ancora sottovalutata da chi sceglie uno smartphone. Eppure la differenza è sostanziale.
Un modello che gira localmente risponde anche quando non c’è segnale. Non invia dati a un server remoto — e questo ha implicazioni dirette sulla privacy. Non introduce la latenza della rete. E non dipende dalle scelte commerciali di un’azienda che un giorno potrebbe decidere di monetizzare quei dati.
Con Gemini Nano 4, Google sta costruendo un’infrastruttura AI che funziona dentro il telefono come un organo, non come un servizio esterno. L’aspetto interessante è che, finora, questa direzione era stata percorsa soprattutto da Apple con i suoi modelli on-device per Apple Intelligence. Google sta accelerando, e lo fa con un approccio aperto agli sviluppatori che Apple, per ora, non replica.
Resta da vedere come tutto questo si tradurrà nell’esperienza concreta degli utenti. I numeri ci sono, l’architettura è solida, le premesse tecniche convincono. Il verdetto finale — come sempre — lo daranno i dispositivi nelle mani di chi li usa ogni giorno.
Fonti:
Android Developers Blog — Announcing Gemma 4 in the AICore Developer Preview
9to5Google — Google previews Gemini Nano 4 for Android AICore, coming this year
Business Standard — Google unveils Gemma 4 open models that can run on smartphones, PC