DeepSeek sfida OpenAI con il suo nuovo modello di AI ragionante | ChatGPT download | ChatGPT OpenAI | Chat OpenAI | Turtles AI

DeepSeek sfida OpenAI con il suo nuovo modello di AI ragionante
Il laboratorio cinese lancia DeepSeek-R1, un’AI che rivalizza con O1, ma si scontra con sfide politiche e di sicurezza
Editorial Team21 novembre 2024

 


DeepSeek, una società cinese di ricerca sull’AI, ha presentato il suo nuovo modello, DeepSeek-R1, che si propone come rivale del sistema OpenAI O1. Il modello, progettato per il ragionamento complesso, si distingue per la capacità di verificare i fatti e pianificare le risposte, ma mostra anche limiti e problematiche legate alla censura politica e alla sicurezza.

Punti chiave:

  •  DeepSeek-R1 è un’AI progettata per il ragionamento, simile al modello O1 di OpenAI.  
  •  Il modello utilizza una pianificazione anticipata per eseguire compiti complessi, ma è sensibile a query politiche.  
  •  La compagnia cinese DeepSeek è finanziata da un hedge fund e mira a sviluppare un’AI "superintelligente".  
  •  La crescente attenzione sul "test-time compute" segna un cambiamento nelle strategie di sviluppo dei modelli di AI.

Mercoledì scorso, DeepSeek, una società cinese di ricerca nell’ambito dell’AI, ha svelato una versione preliminare di DeepSeek-R1, il suo nuovo modello di AI pensato per risolvere problemi complessi attraverso un ragionamento articolato. Con questo modello, l’azienda cinese intende competere direttamente con il sistema O1 di OpenAI, uno degli strumenti più avanzati in circolazione. A differenza della maggior parte delle AI attuali, che tendono a fornire risposte immediate basate su informazioni pre-esistenti, DeepSeek-R1 si distingue per la sua capacità di "pensare" prima di rispondere. In altre parole, dedica più tempo all’analisi della domanda e alla verifica dei fatti, il che lo rende capace di evitare alcuni degli errori comuni che solitamente affliggono i modelli tradizionali.

Simile a O1, il nuovo modello di DeepSeek si avvale di una serie di operazioni pianificate per risolvere le questioni in modo più accurato e ponderato. Tuttavia, questo processo può essere più lento rispetto ai sistemi tradizionali, con tempi di risposta che possono allungarsi a seconda della difficoltà del compito. Nonostante queste peculiarità, l’azienda sostiene che DeepSeek-R1 mostri prestazioni simili al modello O1-preview di OpenAI, secondo due benchmark ben noti nel settore dell’AI, AIME e MATH, rispettivamente focalizzati sulla valutazione delle capacità generali e sulla risoluzione di problemi verbali.

Tuttavia, come ogni tecnologia emergente, anche DeepSeek-R1 presenta alcune problematiche. Alcuni esperti hanno osservato che, proprio come O1, il modello di DeepSeek ha difficoltà nell’affrontare problemi logici di base, come il gioco del tris. Al contempo, è emersa una vulnerabilità interessante: DeepSeek-R1 può essere facilmente "jailbroken", ossia sollecitato a ignorare alcune delle sue protezioni di sicurezza, come nel caso di una ricetta per la metanfetamina ottenuta da un utente. Questo tipo di comportamento potrebbe sollevare preoccupazioni per la sicurezza e l’uso improprio della tecnologia.

Inoltre, DeepSeek-R1 è stato progettato per rispettare le normative imposte dal governo cinese, il che si riflette nel suo approccio rigoroso alla censura. Durante i test, il modello ha rifiutato di rispondere a domande politiche ritenute troppo sensibili, come quelle relative a Xi Jinping, alla protesta di Piazza Tiananmen e alla situazione geopolitica riguardante Taiwan. Questa caratteristica è probabilmente una risposta alle leggi cinesi che richiedono ai modelli di AI di allinearsi con i "valori socialisti fondamentali", un concetto che porta a limitazioni sulle fonti di informazione e sulla capacità di trattare argomenti considerati controversi. La pressione del governo sui modelli di AI per garantire che le loro risposte siano conformi alla narrativa ufficiale ha quindi un impatto diretto sul comportamento di questi sistemi.

In questo scenario, l’innovazione tecnologica in corso è legata a un concetto che sta guadagnando sempre più attenzione: il "test-time compute". Questo approccio prevede l’allocazione di risorse di calcolo aggiuntive durante la fase di inferenza per dare più tempo ai modelli di rispondere a compiti complessi. I difetti dei modelli più tradizionali, che sembrano non evolversi più in modo drastico nonostante l’aumento di potenza computazionale, hanno spinto i ricercatori a esplorare nuove tecniche come questa. In un recente intervento, Satya Nadella, CEO di Microsoft, ha evidenziato l’emergere di una nuova legge della scalabilità in relazione a questa tecnica, sottolineando come l’infrastruttura e la pianificazione dei calcoli siano fondamentali per il miglioramento dei sistemi di AI.

Dal punto di vista della sostenibilità e dell’ambizione, DeepSeek ha anche in programma di aprire il codice sorgente di DeepSeek-R1 e di rilasciare un’API, permettendo a sviluppatori esterni di contribuire e sperimentare con la piattaforma. Questo passo potrebbe favorire l’adozione di questo nuovo modello a livello globale, nonostante le difficoltà politiche e le restrizioni legate al contesto cinese. L’azienda è supportata da High-Flyer Capital Management, un hedge fund che utilizza l’AI per ottimizzare le sue operazioni di trading, e mira a sviluppare una "superintelligenza" artificiale tramite i suoi modelli. High-Flyer ha anche creato un’infrastruttura dedicata all’addestramento dei modelli, con un cluster di server equipaggiato con 10.000 GPU Nvidia A100, che si dice costi circa 1 miliardo di yen.

L’ascesa di DeepSeek, con i suoi ambiziosi progetti e l’introduzione di modelli avanzati come DeepSeek-R1, rappresenta un passo significativo nella corsa globale verso un’AI sempre più potente e complessa.

Tuttavia, la sfida resta anche quella di bilanciare l’evoluzione tecnologica con la gestione dei rischi e delle implicazioni politiche che essa comporta.