DeepMind sfida OpenAI con Veo 2, il nuovo sistema di generazione video | Generatore immagini ai gratis | Buon giovedì speciale | Midjourney ai | Turtles AI
DeepMind, il laboratorio d’AI di Google, presenta Veo 2, un modello avanzato di generazione video capace di produrre clip di oltre due minuti in risoluzione 4K, superando le capacità tecniche di Sora di OpenAI. Attualmente disponibile su VideoFX in versione limitata, Veo 2 promette innovazioni nella fisica e nei controlli della telecamera.
Punti chiave:
- Innovazione tecnica: Veo 2 supporta video fino a 4K e due minuti, surclassando le specifiche attuali dei rivali.
- Tecnologia cinematografica: Miglioramenti nella simulazione della luce, dinamica dei fluidi e controllo delle angolazioni di ripresa.
- Applicazioni future: Presto disponibile su Vertex AI, promette un ampio impiego nei prodotti Google.
- Sfide etiche: Dibattiti sul copyright e sull’addestramento con dati non consensuali.
DeepMind, divisione di Google specializzata in AI, ha presentato Veo 2, una tecnologia di generazione video che si candida a ridefinire il panorama del settore. Questo nuovo modello, successore di Veo, eleva lo standard attuale offrendo la possibilità di creare clip di oltre due minuti con risoluzione fino a 4K (4096x2160 pixel), un significativo passo avanti rispetto ai limiti dei concorrenti. Rispetto a Sora di OpenAI, che produce video di massimo venti secondi a 1080p, Veo 2 dimostra un netto vantaggio tecnico teorico. Tuttavia, nella pratica, il modello è attualmente implementato su VideoFX, uno strumento sperimentale che limita la risoluzione a 720p e la durata dei video a otto secondi. Google ha dichiarato di voler ampliare l’accesso a VideoFX e di pianificare il lancio del modello su larga scala tramite la piattaforma Vertex AI, non appena il sistema sarà ottimizzato.
Le novità introdotte da Veo 2 includono una comprensione più approfondita delle leggi fisiche e un maggiore realismo nel controllo della telecamera. Il modello consente di simulare effetti cinematografici complessi, come la rifrazione della luce, ombre realistiche e movimenti fluidi, offrendo texture e dettagli più nitidi anche in scene dinamiche. È in grado di generare video a partire da semplici prompt testuali o combinazioni di testo e immagini di riferimento. Queste capacità sono state sviluppate tenendo conto del feedback di artisti e produttori come Donald Glover e The Weeknd, collaboratori attivi fin dalle prime fasi del progetto. Tuttavia, permangono limiti legati alla coerenza dei dettagli nei video più lunghi e alle complessità dei movimenti rapidi, aree che DeepMind intende affinare ulteriormente.
Dal punto di vista etico e tecnico, Veo 2 solleva interrogativi significativi. Il modello è stato addestrato su un vasto insieme di dati video, molti dei quali potrebbero provenire da piattaforme come YouTube, di proprietà di Google. Questa pratica ha attirato critiche dalla comunità creativa, soprattutto considerando i potenziali impatti occupazionali dell’automazione nei settori cinematografici e televisivi. Nonostante i filtri per contenuti inappropriati e una tecnologia di watermarking avanzata, i rischi di uso improprio, come la creazione di deepfake, restano una preoccupazione. L’assenza di un meccanismo per consentire ai creatori di rimuovere i propri contenuti dal set di addestramento alimenta il dibattito sulla gestione dei diritti e sulla trasparenza.
Parallelamente, DeepMind ha annunciato aggiornamenti a Imagen 3, il suo modello di generazione di immagini. Integrato in ImageFX, Imagen 3 offre miglioramenti nella composizione, nel realismo delle texture e nella fedeltà ai prompt testuali, oltre a una nuova interfaccia che guida gli utenti nella creazione di contenuti.
Veo 2 rappresenta un passo decisivo verso l’integrazione di modelli generativi avanzati nelle applicazioni creative, portando con sé opportunità straordinarie e sfide etiche da affrontare.
