Huawei mette il turbo alla memoria: l’AI-SSD che sogna l’infinito | | | | Turtles AI
Huawei sembra stia studiando una memoria “AI-SSD” ottimizzata per i carichi di lavoro di AI, che potrebbe affiancarsi o attenuare la dipendenza dalla HBM occidentale. Intanto si affianca il lancio del software UCM per orchestrare HBM, DRAM e SSD.
Punti chiave:
- Huawei progetta un SSD AI di nuova generazione pensato per carichi AI.
- Il software Unified Cache Manager (UCM) ottimizza l’uso di HBM, DRAM e SSD, riducendo latenza fino al 90 % e aumentando throughput fino a 22×.
- La Cina punta alla produzione nazionale di HBM entro il 2026 con partner come Wuhan Xinxin.
- Huawei ha già presentato soluzioni come OceanStor A800 e AI CloudMatrix per affrontare il gap hardware imposto dalle sanzioni.
Huawei ha messo nel mirino la memoria dell’AI come nuovo campo di battaglia tecnologico. Pare che la compagnia sia al lavoro su un SSD specifico per carichi AI, una sorta di memoria “ai-SSD” che promette capacità illimitata e alta efficienza: una risposta all’accesso limitato alla HBM, costosa e strettamente controllata da parte delle aziende cinesi. Senza dichiarare sostituzioni, l’idea è di avere un’alternativa “di sistema” che sposti alcuni compiti gravosi dall’HBM a storage molto capaci, ponendo le basi per un’infrastruttura meno vincolata a fornitori occidentali.
Parallelamente, Huawei ha presentato il software Unified Cache Manager (UCM) in un forum AI a Shanghai: un orchestratore che dirige i dati tra HBM, DRAM e SSD a seconda della loro latenza e dei bisogni dell’applicazione. I risultati interni, testati con China UnionPay su inferenze LLM e task come analisi vocale e marketing, parlano di una riduzione della latenza fino al 90 % e di un aumento del throughput fino a 22 volte. Huawei prevede di rendere UCM open-source a partire da settembre 2025, prima in ambiente interno, poi pubblicamente.
Da un punto di vista industriale, la strategia cinese tende a rafforzare le capacità interne: un consorzio guidato da Huawei, sostenuto dallo Stato e comprendente Fujian Jinhua e altri, mira a produrre chip HBM avanzati entro il 2026, con almeno due linee produttive già avviate. In parallelo, una collaborazione con Wuhan Xinxin punta a sviluppare HBM attraverso tecniche di packaging sofisticate (CoWoS)
Allo stesso tempo, Huawei non resta a guardare sul fronte infrastrutturale: l’OceanStor A800, storage dedicato per AI, supporta set di training massivi con IOPS elevatissimi e throughput fino a 500 GB/s, risposte ai checkpoint fino a 8× più veloci, e scala fino a exabyte con SSD da 128 TB. Inoltre, la superinfrastruttura AI CloudMatrix 384, basata su 384 NPU Ascend 910C, offre 300 petaflops FP16,molto di più della controparte GB200 di NVIDIA pur consumando più energia.
Infine, nel mondo online alcuni osservatori sottolineano la crescente competitività degli Ascend: Ascend 910C offre circa il 60 % delle prestazioni di inference dell’H100 di NVIDIA, mentre sui futuri modelli, 910D con chiplet avanzati o Ascend 920 con HBM3 a 900 TFLOP si specula su un gap sempre più ridotto.
Huawei sta tessendo un intreccio tra soluzioni software sofisticate, partnership industriali per memoria nazionale e infrastrutture potenti basate su AI: un mosaico tecnico che potrebbe mutare la dipendenza da tecnologie occidentali.
Una manovra strategica che parla più di ingegno operativo che di grandi annunci trionfali.


