Nuovo LLM di StabilityAI | Llm Meaning | Chat gpt in Italiano | Large Language Models Italiano | Turtles AI

Nuovo LLM di StabilityAI
DukeRem20 aprile 2023
  #StabilityAI, l’azienda leader nella ricerca #AI che ha creato #StableDiffusion per la creazione di immagini, ha annunciato il rilascio della serie #StableLM di modelli linguistici di grandi dimensioni (#LLM), con il set iniziale di modelli StableLM-alpha ora disponibile per l’uso. I nuovi modelli sono costruiti su The Pile, un enorme #dataset contenente 1,5 trilioni di token, tre volte più grande del precedente dataset utilizzato da StabilityAI. I modelli StableLM-alpha sono attualmente disponibili in due dimensioni: 3B e 7B parametri. È inoltre previsto il rilascio di modelli da 15B e 30B nel prossimo futuro. I modelli di base sono rilasciati sotto CC BY-SA-4.0, rendendoli liberamente utilizzabili. Oltre ai modelli StableLM-alpha, StabilityAI ha anche perfezionato il modello con la procedura di Stanford Alpaca utilizzando una combinazione di cinque recenti set di dati per agenti conversazionali, tra cui Alpaca di Stanford, gpt4all di Nomic-AI, ShareGPT52K di RyokoAI, Dolly dei laboratori Databricks e HH di Anthropic. Questi modelli saranno rilasciati come StableLM-Tuned-Alpha. Gli utenti possono provare subito il modello 7B StableLM-Tuned-Alpha su Hugging Face Spaces. I modelli saranno continuamente aggiornati con nuovi checkpoint e una relazione tecnica di prossima pubblicazione documenterà le specifiche del modello e le impostazioni di addestramento. Tutti i modelli StableLM sono ospitati sull’hub di Hugging Face. Gli utenti possono prendere in prestito un notebook per eseguire l’inferenza con capacità limitate della GPU. Per iniziare a chattare con StableLM-Tuned-Alpha, gli utenti possono utilizzare lo snippet di codice fornito. Se da un lato i modelli StableLM offrono possibilità interessanti, dall’altro ci sono alcuni problemi potenziali da considerare. Come per qualsiasi modello linguistico di grandi dimensioni, senza una messa a punto aggiuntiva e l’apprendimento per rinforzo, le risposte ottenute dall’utente potrebbero essere di qualità variabile e potrebbero potenzialmente includere linguaggio e opinioni offensive. Tuttavia, StabilityAI è fiduciosa che con dati migliori, feedback della comunità e ottimizzazione, questi problemi possano essere ridotti al minimo. StabilityAI è entusiasta del potenziale della sua serie StableLM per aiutare gli utenti a svolgere un’ampia gamma di compiti, dalla scrittura di poesie e racconti alla scrittura di codice. L’azienda è anche aperta a idee per sviluppi futuri e incoraggia gli utenti a contattare il loro canale Discord con suggerimenti.