DeepSeek R2 probabilmente arriverà a maggio con capacità di codifica migliorate e altro ancora | Chat gpt login free | Chatgpt download | Nlp e llm | Turtles AI
DeepSeek, startup cinese di AI, anticipa il rilascio del modello R2 dopo il successo di R1, che ha scosso il mercato globale con prestazioni elevate a costi ridotti. L’azienda si distingue per una gestione orizzontale e investimenti mirati in potenza computazionale. Pechino supporta DeepSeek, mentre crescono le preoccupazioni internazionali sulla privacy e sull’accesso ai chip avanzati.
Punti chiave:
- DeepSeek vuole lanciare R2 in anticipo rispetto alla tabella di marcia.
- Il modello R1 ha dimostrato capacità superiori con hardware meno potente.
- L’azienda opera con una cultura lavorativa innovativa e incentivi economici elevati.
- La Cina sostiene DeepSeek, ma permangono restrizioni internazionali sui chip.
DeepSeek, emergente realtà tecnologica di Hangzhou, sta accelerando il lancio del suo prossimo modello di AI, R2, inizialmente previsto per maggio. L’azienda, che ha recentemente attirato l’attenzione internazionale con il suo modello R1, mira a migliorare la qualità della generazione di codice e l’elaborazione in lingue diverse dall’inglese. La decisione di anticipare il rilascio è giunta mentre il settore AI globale ancora assimila l’impatto di R1, capace di competere con prodotti realizzati con risorse nettamente superiori.
Il fondatore di DeepSeek, Liang Wenfeng, ha costruito un’impresa dal modello operativo distante dalle convenzioni dell’industria tecnologica cinese, spesso caratterizzata da rigide gerarchie e orari di lavoro estenuanti. In DeepSeek, la gestione è improntata alla collaborazione e all’autonomia, con salari significativamente più elevati rispetto alla media del settore. L’approccio adottato deriva dall’esperienza di Liang in ambito finanziario: High-Flyer, il suo fondo hedge quantitativo, è tra i più prosperi della Cina e ha reinvestito massicciamente nella ricerca AI, anticipando le sfide del settore e accumulando capacità computazionali fondamentali prima delle restrizioni imposte dagli Stati Uniti sui chip avanzati.
High-Flyer ha investito miliardi di yuan in infrastrutture di supercalcolo, tra cui il cluster Fire-Flyer II, costituito da migliaia di GPU Nvidia A100. Questo vantaggio ha permesso a DeepSeek di sviluppare modelli innovativi sfruttando tecniche come la Mixture-of-Experts (MoE) e l’attenzione latente multihead (MLA), che ottimizzano l’uso delle risorse computazionali. Il risultato è stato un sistema AI estremamente efficiente e accessibile, il cui costo per inferenza è stato stimato fino a 40 volte inferiore rispetto alle soluzioni concorrenti.
Mentre OpenAI e Google hanno dovuto adeguare i propri prezzi e strategie in risposta al successo di DeepSeek, la startup cinese ha ottenuto un crescente sostegno governativo. Il fondatore Liang è stato ricevuto dal premier cinese Li Qiang, e diverse amministrazioni locali e aziende statali hanno già implementato i suoi modelli. Tuttavia, la crescente influenza di DeepSeek non è passata inosservata: alcuni governi occidentali hanno iniziato a limitarne l’accesso, citando preoccupazioni sulla protezione dei dati.
L’ambiente geopolitico resta un ostacolo per la crescita di DeepSeek, con le restrizioni sui chip AI avanzati che rappresentano una sfida importante per il futuro dell’azienda.
Fonte: Reuters
