Google rafforza il chatbot Gemini con nuove funzionalità open access | Festina Lente - Notizie, recensioni e approfondimenti sull’intelligenza artificiale | Turtles AI

Google rafforza il chatbot Gemini con nuove funzionalità open access
Google annuncia l’espansione di Gemini 1.5 Flash e nuove funzionalità di caricamento file e protezione per adolescenti.

Punti chiave

  • Espansione di Gemini 1.5 Flash: Disponibile in 40 lingue e 230 paesi.
  • Aumento del contesto: Finestra di contesto ampliata a 32.000 token.
  • Caricamento file: Esteso a tutti gli utenti, non solo a quelli premium.
  • Protezione adolescenti: Nuove politiche e guida all’uso responsabile per gli studenti.

 

Google rafforza il chatbot Gemini con nuove funzionalità open access

 

Google lancia nuovi aggiornamenti per il livello gratuito di Gemini, il suo chatbot potenziato dall’AI, con l’obiettivo di migliorarne le prestazioni e la disponibilità.

 

Google ha annunciato l’espansione di Gemini 1.5 Flash, una versione leggera e multimodale del modello, su web e dispositivi mobili in 40 lingue e circa 230 paesi. La società afferma che Gemini 1.5 Flash offre miglioramenti significativi in termini di qualità e latenza, con notevoli progressi nel ragionamento e nella comprensione delle immagini. Inoltre, potrebbe risultare meno costoso da gestire in backend.

 

Alla presentazione di Gemini 1.5 Flash, Google ha sottolineato che il modello è una versione "distillata" e altamente efficiente di Gemini 1.5 Pro, progettato per carichi di lavoro generativi di AI "stretti" e "ad alta frequenza". Visti i costi elevati associati alla gestione di una piattaforma chatbot come Gemini (si veda ad esempio le spese di ChatGPT di OpenAI), Google è chiaramente interessata a cogliere ogni opportunità di riduzione dei costi, soprattutto se queste opportunità migliorano anche le prestazioni.

 

Oltre al nuovo modello base, Google sta ampliando la finestra di contesto di Gemini a 32.000 token, equivalenti a circa 24.000 parole (o 48 pagine di testo). La finestra di contesto si riferisce ai dati di input che un modello considera prima di generare l’output. Tra i vantaggi dei modelli con contesti più ampi vi è la capacità di riassumere e ragionare su testi più lunghi e file, nonché una minore probabilità di dimenticare argomenti discussi di recente.

 

La possibilità di caricare file per l’analisi su Gemini era precedentemente riservata a Gemini Advanced, l’edizione a pagamento del chatbot accessibile tramite il piano Google One AI Premium da 20 dollari al mese. Tuttavia, Google ha dichiarato che presto permetterà il caricamento di file da Google Drive e dispositivi locali per tutti gli utenti di Gemini.

 

"Potrai caricare la tua guida di studio di economia e chiedere a Gemini di creare domande di pratica," ha scritto Amar Subramanya, VP di ingegneria presso Google, in un post sul blog condiviso con TechCrunch. "Gemini sarà presto in grado di analizzare i file di dati per te, permettendoti di scoprire approfondimenti e visualizzarli attraverso grafici e diagrammi."

 

Per combattere le allucinazioni, ovvero le situazioni in cui un modello generativo come Gemini 1.5 Flash inventa informazioni, Google sta anticipando una funzione che mostra link a contenuti web correlati sotto alcune risposte generate da Gemini. Gli utenti di lingua inglese di Gemini in territori selezionati vedranno un’icona a forma di "chip" alla fine di un paragrafo generato da Gemini con un link a siti web — o email, se si è dato il permesso a Gemini di accedere alla propria casella di posta Gmail — dove poter approfondire l’argomento.

 

Questa mossa segue le rivelazioni secondo cui i modelli generativi di AI di Google sono soggetti a gravi allucinazioni, come suggerire colla non tossica in una ricetta per pizza o inventare recensioni di libri false attribuite a persone reali. All’inizio di quest’anno, Google ha rilasciato una funzione di "double check" in Gemini progettata per evidenziare affermazioni originate da Gemini che altre fonti online confermano o contraddicono. Tuttavia, i link ai contenuti correlati sembrano essere un tentativo di rendere più trasparente da quali fonti di informazioni Gemini potrebbe attingere.

 

Google non sta aspettando per ampliare la disponibilità del servizio. Dopo il debutto di Gemini in Messages per dispositivi selezionati all’inizio dell’anno, Google sta estendendo la funzione nell’Area Economica Europea (EEA), nel Regno Unito e in Svizzera, con la possibilità di chattare in nuove lingue come francese, polacco e spagnolo. Gli utenti possono avviare Gemini in Messages toccando il pulsante "Start chat" e selezionando Gemini come partner di chat.

 

Google sta anche lanciando l’app mobile di Gemini in più paesi e ampliando l’accesso a Gemini per gli adolescenti a livello globale. La società ha introdotto un’esperienza focalizzata sugli adolescenti a giugno, permettendo agli studenti di registrarsi utilizzando i loro account scolastici — sebbene non in tutti i paesi. Nella settimana successiva, questa possibilità verrà estesa agli adolescenti in tutti i paesi e regioni in cui Gemini è normalmente disponibile per gli adulti.

 

In concomitanza con il rollout, Google ha dichiarato che sta implementando "ulteriori politiche e salvaguardie" per proteggere gli adolescenti — senza entrare nei dettagli. È in arrivo anche un nuovo processo di onboarding su misura per i giovani, insieme a una "guida all’alfabetizzazione AI" per aiutare gli adolescenti a utilizzare l’AI in modo responsabile.

 

È oggetto di grande dibattito se i giovani stiano sfruttando gli strumenti di AI generativa nel modo previsto o abusandone. Google è sicuramente desiderosa di evitare titoli che suggeriscano che Gemini è un generatore di saggi plagiati o capace di dare consigli mal concepiti su problemi personali agli adolescenti, e quindi sta prendendo tutte le misure possibili per prevenire i peggiori scenari.