Lanciata Stable Diffusion 3.5: Potenza e Accessibilità | Intelligenza artificiale immagini | Generatore di immagini ai gratis | Immagini buongiorno domenica | Turtles AI

Lanciata Stable Diffusion 3.5: Potenza e Accessibilità
Nuovi modelli personalizzabili per una generazione d’immagini ottimizzata e alla portata di tutti
Editorial Team23 ottobre 2024

 

E’ stata lanciata la versione 3.5 di Stable Diffusion, un potente modello di generazione di immagini accessibile e personalizzabile. Questa release risponde ai feedback della comunità e offre diverse varianti adatte a vari casi d’uso. I modelli sono disponibili per il download con licenze permissive.

Punti chiave:

  •  Stable Diffusion 3.5 include modelli potenziati per hardware consumer.
  •  La nuova architettura migliora la personalizzazione e la qualità delle immagini.
  •  Licenza permissiva per uso commerciale e non commerciale fino a 1 milione di dollari.
  •  I modelli offrono prestazioni elevate e variabilità nei risultati, mantenendo elevati standard di qualità.

 Stability AI ha annunciato il lancio di Stable Diffusion 3.5, un aggiornamento significativo che introduce modelli altamente avanzati e adattabili, fruibili su hardware di uso comune e disponibili con una licenza permissiva per la comunità. Questa nuova versione comprende varianti personalizzabili, come Stable Diffusion 3.5 Large e la versione turbo, entrambi scaricabili da Hugging Face e accompagnati dal codice di inferenza su GitHub. Questo aggiornamento segue la release di giugno, Stable Diffusion 3 Medium, che non ha soddisfatto completamente le aspettative. Dopo aver ascoltato il feedback della community, Stability AI ha deciso di investire tempo nello sviluppo di modelli che puntano a rivoluzionare il panorama dei media visivi. 

Stable Diffusion 3.5 si distingue per la sua capacità di offrire strumenti all’avanguardia, rendendoli accessibili a ricercatori, appassionati e aziende, in linea con la missione dell’azienda. Il modello base, Stable Diffusion 3.5 Large, si caratterizza per i suoi 8 miliardi di parametri e per la qualità d’immagine superiore, rendendolo ideale per applicazioni professionali, mentre Stable Diffusion 3.5 Large Turbo, una versione più veloce e leggera, riesce a generare immagini di alta qualità in soli 4 passaggi, rappresentando una soluzione ottimale per chi cerca tempi di risposta rapidi senza compromettere la qualità. 

Inoltre, la versione Medium, in uscita il 29 ottobre, sarà dotata di 2,5 miliardi di parametri e progettata per un’operatività immediata su hardware standard, offrendo un buon compromesso tra qualità e facilità d’uso. Nello sviluppo di questi modelli, un aspetto centrale è stato il miglioramento della personalizzazione attraverso l’integrazione della Query-Key Normalization nei blocchi del trasformatore, un approccio che stabilizza il processo di formazione e facilita ulteriori sviluppi e ottimizzazioni. Tuttavia, questa maggiore flessibilità potrebbe comportare una variabilità nei risultati generati, con output che possono variare anche significativamente a seconda dei parametri di input, una scelta intenzionale per mantenere una base di conoscenza ampia e diversificata.

Stable Diffusion 3.5 si distingue anche per la sua capacità di generare immagini rappresentative e diversificate, superando i modelli precedenti e ponendosi come leader nel mercato per quanto riguarda la rapidità e la qualità delle immagini generate. I modelli Turbo e Medium in particolare sono stati ottimizzati per ottenere prestazioni elevate anche su hardware consumer senza requisiti particolari. 

Un ulteriore aspetto positivo è rappresentato dalla licenza Stability AI Community, che consente l’uso gratuito per fini non commerciali, oltre a garantire la possibilità di utilizzo commerciale per startup e piccole imprese fino a 1 milione di dollari di fatturato annuo. Gli utenti possono mantenere la proprietà dei media generati senza restrizioni significative, promuovendo così una cultura di condivisione e innovazione.

Stable Diffusion 3.5 rappresenta un passo avanti notevole nel campo della generazione di immagini, offrendo soluzioni versatili e performanti per una vasta gamma di utenti.