Mithrill Security avverte di un potenziale “avvelenamento degli LLM” | Chatgpt Gratis | Rete Neurale Significato | Chat gpt Gratis Romana | Turtles AI

Mithrill Security avverte di un potenziale “avvelenamento degli LLM”
DukeRem11 luglio 2023
I ricercatori di AI di #Mithrill #Security hanno recentemente teorizzato come un malintenzionato potrebbe modificare di nascosto un modello linguistico di grandi dimensioni (LLM) e caricarlo su hub di modelli popolari come #HuggingFace, mettendo a rischio l’affidabilità dell’AI open-source. Gli esperti avvertono che questo "avvelenamento" dei modelli linguistici di grandi dimensioni potrebbe consentire alla falsa propaganda o alla disinformazione dannosa di diffondersi senza essere individuata su vasta scala. Le agenzie di intelligence stanno ora prestando molta attenzione a questi rischi, poiché attori e nazioni disoneste potrebbero tentare di corrompere i modelli di IA per scopi malevoli. Sebbene l’open-sourcing del codice dei modelli e dei set di dati sia un passo avanti verso la trasparenza, non è sufficiente a garantire l’integrità dei modelli. In particolare, i ricercatori hanno dimostrato come le sottili modifiche apportate con tecniche come il "rank one editing" possano alterare i risultati di un modello per richieste specifiche, pur mantenendo prestazioni simili nei benchmark. Ricordiamo che è possibile leggere la nostra guida sugli LLM, per capire meglio di cosa stiamo parlando.