Gemma 3n: l’AI di Google arriva direttamente sui dispositivi mobili | Llm nlp | Intelligenza artificiale pro e contro | Chatgpt login | Turtles AI

Gemma 3n: l’AI di Google arriva direttamente sui dispositivi mobili
Prestazioni avanzate, supporto multimodale e consumo ridotto di memoria per un’AI più accessibile, efficiente e attenta alla privacy, ora in anteprima per sviluppatori su Android e ChromeOS
Editorial Team20 maggio 2025

 

Gemma 3n è il nuovo modello open source di Google, progettato per offrire AI avanzata direttamente su dispositivi mobili. Grazie a innovazioni come le Per-Layer Embeddings, garantisce prestazioni elevate con un consumo ridotto di memoria, supportando input multimodali e operando in modalità offline per una maggiore privacy.

Punti chiave:

  • Efficienza su dispositivi mobili: Grazie alle Per-Layer Embeddings, Gemma 3n riduce significativamente l’uso della RAM, permettendo l’esecuzione di modelli complessi su dispositivi con risorse limitate.
  • Supporto multimodale: Il modello gestisce input di testo, immagini, audio e video, offrendo una comprensione approfondita e interazioni avanzate.
  • Flessibilità dinamica: Con la funzionalità "many-in-1", Gemma 3n consente la creazione di sottomodelli adattabili alle esigenze specifiche, bilanciando qualità e latenza.
  • Privacy e modalità offline: L’esecuzione locale garantisce la protezione dei dati dell’utente, permettendo il funzionamento anche senza connessione Internet.

Google ha recentemente presentato Gemma 3n, un modello di AI open source progettato per operare direttamente su dispositivi mobili come smartphone, tablet e laptop. Questo modello rappresenta un passo significativo verso l’accessibilità dell’AI, combinando potenza computazionale e efficienza energetica.

Una delle innovazioni chiave di Gemma 3n è l’utilizzo delle Per-Layer Embeddings (PLE), sviluppate da Google DeepMind. Questa tecnica consente una riduzione significativa dell’uso della RAM, permettendo l’esecuzione di modelli con 5 e 8 miliardi di parametri su dispositivi mobili, con un consumo di memoria comparabile a modelli da 2 e 4 miliardi di parametri. In pratica, Gemma 3n può operare con un ingombro di memoria dinamica di soli 2 GB e 3 GB, rendendolo ideale per applicazioni on-device.

Il modello supporta input multimodali, inclusi testo, immagini, audio e video, offrendo una comprensione approfondita e la capacità di gestire interazioni complesse. Ad esempio, è in grado di eseguire trascrizioni vocali in tempo reale e traduzioni dal parlato al testo, il tutto mantenendo i dati dell’utente sul dispositivo per garantire la privacy.

Gemma 3n introduce anche la funzionalità "many-in-1", che consente la creazione di sottomodelli nidificati all’interno del modello principale. Questa flessibilità permette agli sviluppatori di bilanciare dinamicamente le prestazioni e la qualità in base alle esigenze specifiche, senza la necessità di ospitare modelli separati. La funzione "mix’n’match" facilita ulteriormente la creazione di sottomodelli ottimizzati per casi d’uso specifici, offrendo un compromesso ideale tra qualità e latenza.

Per gli sviluppatori interessati a esplorare Gemma 3n, Google offre due modalità di accesso:

-Google AI Studio: una piattaforma basata su cloud che consente di testare Gemma 3n direttamente dal browser, senza necessità di configurazione.

-Google AI Edge: una suite di strumenti e librerie per integrare Gemma 3n localmente su dispositivi, permettendo l’uso delle sue funzionalità di comprensione e generazione di testo e immagini.

Con il lancio di Gemma 3n, Google continua a promuovere un’AI più accessibile e rispettosa della privacy, aprendo nuove possibilità per applicazioni intelligenti e interattive su dispositivi mobili.

Video