ChatGPT si evolve: OpenAI lancia la modalità vocale con analisi visiva | Chat GPT gratis | Chat OpenAI | Chat AI | Turtles AI

ChatGPT si evolve: OpenAI lancia la modalità vocale con analisi visiva
Interazioni in tempo reale e riconoscimento di immagini ampliano le possibilità per gli utenti abbonati, sfidando la concorrenza tecnologica
Editorial Team13 dicembre 2024

 

OpenAI ha lanciato una funzione rivoluzionaria per ChatGPT: l’Advanced Voice Mode con visione, che consente interazioni vocali e visive in tempo reale. L’aggiornamento, disponibile per abbonati selezionati, promette nuove possibilità nell’interpretazione di immagini e schermi condivisi.

Punti chiave:

  • Nuova modalità vocale avanzata: integra analisi visiva e interazioni vocali naturali.
  • Accesso graduale: inizialmente disponibile solo per alcuni abbonati Plus, Team e Pro.
  • Utilizzi innovativi: capacità di analizzare immagini, disegni e schermi condivisi.
  • Rivali in competizione: Google e Meta lavorano su tecnologie simili.

OpenAI ha introdotto una delle innovazioni più attese nel panorama delle AI: la modalità Advanced Voice Mode con visione, una funzionalità progettata per arricchire le interazioni di ChatGPT, combinando la naturalezza delle conversazioni vocali con la capacità di analizzare contenuti visivi in tempo reale. Lanciata in modalità graduale, questa funzione è attualmente riservata agli utenti che hanno sottoscritto abbonamenti a ChatGPT Plus, Team o Pro, con esclusione, almeno fino a gennaio, degli utenti Enterprise ed Edu. Inoltre, gli utenti residenti in Europa e in alcuni altri paesi non avranno accesso immediato alla funzione a causa di limitazioni non ancora chiarite.

L’uso dell’Advanced Voice Mode con visione è semplice e intuitivo: una volta attivata l’opzione vocale tramite l’app di ChatGPT, gli utenti possono accedere alla modalità video con un tocco sull’icona dedicata e, se necessario, avviare la condivisione dello schermo attraverso il menu a tre punti. Le applicazioni sono molteplici: da spiegazioni in tempo reale su impostazioni complesse di dispositivi, fino alla soluzione di problemi matematici o all’analisi di immagini e oggetti. Durante una recente dimostrazione, il presidente di OpenAI, Greg Brockman, ha evidenziato il potenziale della tecnologia mostrando come ChatGPT potesse riconoscere e valutare disegni anatomici in tempo reale, pur sottolineando che la funzione non è esente da errori, come dimostrato da una risposta inesatta a un problema geometrico.

Questa innovazione, benché entusiasmante, non è stata priva di ritardi. Annunciata inizialmente sette mesi fa, la modalità ha subito diverse revisioni per garantire una qualità adeguata all’implementazione su larga scala. La versione esclusivamente vocale è stata introdotta alcuni mesi fa, ma l’integrazione della componente visiva ha richiesto ulteriori test e perfezionamenti. Il lancio graduale attuale sembra riflettere un approccio cauto, mirato a bilanciare innovazione e affidabilità.

Nel frattempo, i principali concorrenti di OpenAI, come Google e Meta, stanno accelerando sullo sviluppo di funzionalità simili. Google, ad esempio, ha reso disponibile il suo sistema di AI conversazionale con analisi visiva, noto come Project Astra, a un gruppo di tester fidati su dispositivi Android. Questi sviluppi segnano un momento importante nella competizione per il predominio nelle tecnologie di AI generativa.

Infine, OpenAI ha lanciato una modalità festiva, denominata Santa Mode, che offre una voce preimpostata ispirata a Babbo Natale, un’aggiunta pensata per rendere più giocosa e coinvolgente l’esperienza degli utenti durante le festività.

Con il rilascio progressivo dell’Advanced Voice Mode con visione, OpenAI riafferma il proprio impegno nel trasformare l’interazione uomo-macchina.

Video