Microsoft lancia la serie Phi-3.5: nuovi modelli AI aperti e ad alte prestazioni | | | | Turtles AI

Microsoft lancia la serie Phi-3.5: nuovi modelli AI aperti e ad alte prestazioni
Tre modelli avanzati per ragionamento e visione artificiale, ora disponibili con licenza open source per sviluppatori e aziende
Editorial Team21 agosto 2024

 

 Microsoft ha presentato tre nuovi modelli della serie Phi-3.5, con un focus su AI linguistica e multimodale. Questi modelli, rilasciati con licenza MIT, offrono capacità avanzate di ragionamento e elaborazione visiva, proponendosi come strumenti flessibili e scalabili per sviluppatori e aziende. Vediamo le caratteristiche tecniche e l’addestramento di ciascuno.

Punti chiave:
1. Tre nuovi modelli AI: Phi-3.5 Mini Instruct, MoE e Vision Instruct.
2. Licenza MIT: Utilizzo aperto e modificabile, ideale per sviluppatori.
3. Addestramento intensivo: Utilizzo di GPU ad alte prestazioni.
4. Prestazioni elevate: Competitivi nei benchmark rispetto a modelli di altri leader del settore.

 

Microsoft ha recentemente annunciato l’espansione della sua offerta nel campo dell’AI con il lancio di tre nuovi modelli della serie Phi-3.5, denominati Phi-3.5 Mini Instruct, Phi-3.5 MoE e Phi-3.5 Vision Instruct. Questi modelli sono stati concepiti per rispondere a diverse esigenze nel campo del ragionamento linguistico e dell’elaborazione multimodale, offrendo agli sviluppatori strumenti versatili per creare applicazioni avanzate. La particolarità di questa nuova offerta risiede non solo nelle prestazioni, ma anche nella scelta di Microsoft di rilasciare i modelli con una licenza open source MIT, che consente un ampio margine di utilizzo e personalizzazione, senza vincoli per l’uso commerciale.

 

Il modello "Phi-3.5 Mini Instruct" è stato ottimizzato per operare in ambienti con limitate risorse di calcolo, mantenendo una solida capacità di ragionamento e di esecuzione di attività complesse come la generazione di codice o la risoluzione di problemi logico-matematici. Questo modello è stato addestrato su 3,4 trilioni di token utilizzando 512 GPU H100-80G, in un processo durato 10 giorni.

Il modello "Phi-3.5 MoE" (Mixture of Experts) rappresenta una novità nella gamma di Microsoft, sfruttando un’architettura che attiva solo una parte dei parametri complessivi per specifici compiti, rendendolo particolarmente efficiente in attività che richiedono un ragionamento complesso. Addestrato su 4,9 trilioni di token con un impiego massiccio di GPU H100-80G, il processo di training è durato 23 giorni.

Infine, il modello "Phi-3.5 Vision Instruct" si distingue per la sua capacità multimodale, essendo in grado di elaborare e comprendere immagini, testo e video. Questo modello è stato addestrato con 500 miliardi di token utilizzando GPU A100-80G, completando l’addestramento in 6 giorni. È particolarmente adatto per applicazioni di riconoscimento ottico dei caratteri (OCR), analisi di grafici e tabelle, e sintesi video.

Tutti i modelli sono disponibili per il download su Hugging Face, con la possibilità per gli sviluppatori di personalizzarli e integrarli nelle proprie soluzioni. L’approccio open source scelto da Microsoft sottolinea l’intenzione di promuovere l’innovazione e la ricerca nel campo dell’AI, offrendo modelli avanzati che competono con quelli dei principali attori del settore, come Google e Meta.

 La serie Phi-3.5 si propone come una risorsa preziosa per chi cerca soluzioni AI avanzate e flessibili, in un contesto di licenza aperta che ne facilita l’adozione e l’integrazione in una vasta gamma di applicazioni.