NVIDIA accelera con i server AI Vera Rubin e lancia Blackwell Ultra GB300 | | | | Turtles AI

NVIDIA accelera con i server AI Vera Rubin e lancia Blackwell Ultra GB300
La produzione dei nuovi sistemi AI entra nel vivo con il debutto delle unità GB300 e il design dei rack Rubin pronto entro luglio, mentre l’architettura R100 promette un salto prestazionale con chiplet, HBM4 e processo a 3 nm
Editorial Team22 luglio 2025

 

 NVIDIA ha avviato la produzione limitata delle unità Blackwell Ultra GB300 e sta ultimando il progetto dei server rack Vera Rubin, con lancio previsto tra il 2026 e il 2027. Innovazioni nel design chiplet, memoria HBM4 e CPU Vera segnano un nuovo ciclo accelerato.

Punti chiave:

  •  In produzione piccola scala delle unità Blackwell Ultra GB300, spedizioni in Q3 2025.
  •  Design Vera Rubin server rack finalizzato entro luglio, produzione massiva nel 2026.
  •  Architettura Rubin introduce GPU R100 su nodo 3 nm, chiplet, interposer CoWoS-L e HBM4.
  •  Rack Rubin saranno implementati in due fasi, prima su infrastruttura Oberon e poi su Kyber più potente.

NVIDIA ha già avviato una fase iniziale di produzione per i server Blackwell Ultra basati su piattaforma GB300, con consegne su vasta scala previste per settembre 2025. Queste soluzioni, adottate da ecosistemi partner tra cui Dell, Microsoft e ODM come Foxconn, sfruttano un’architettura modulare che migliora la personalizzazione e semplifica la supply chain grazie al riuso della scheda Bianca. In questo contesto le criticità legate al raffreddamento a liquido restano sotto controllo e senza ostacoli significativi.

Contemporaneamente, NVIDIA sta definendo il design della nuova generazione di server Vera Rubin: i rack – nelle versioni NVL su piattaforma Oberon e successivamente Kyber – verranno svelati ai produttori entro luglio, con lancio commerciale tra fine 2026 e inizio 2027. Questa architettura rappresenta un salto quantitativo nei cicli di sviluppo hardware, con un periodo ridotto a circa 12 mesi tra le generazioni.

Dettaglio tecnico: la GPU Rubin R100 sarà realizzata su processo TSMC 3 nm N3P, integrerà otto stack HBM4 (circa 288 GB e 13 TB/s) e rappresenta la prima implementazione chiplet di NVIDIA, con un reticolo 4× più esteso rispetto al 3,3× di Blackwell. Il packaging CoWoS-L su substrate da 100 × 100 mm supporterà future varianti Ultra con quattro chiplet. Inoltre, la CPU companion “Vera” sarà anch’essa prodotta con processo avanzato e si integrerà nel rack Rubin.

La roadmap di NVIDIA prevede già una successiva iterazione "Rubin Ultra" attesa nel 2027, con rack NVL576 dotati di fino a 576 GPU e richieste energetiche prossime a 600 kW – elementi emersi durante GTC 2025. Queste novità mostrano come l’azienda stia ridefinendo i parametri di densità e potenza nei data center AI.

Parallelamente, è stata posticipata l’integrazione della memoria SOCAMM, originariamente prevista per GB300, ma ora destinata esclusivamente ai server Rubin e Rubin Ultra, per garantire affidabilità termica e di catena di approvvigionamento.

La strategia NVIDIA punta quindi su cicli di sviluppo serrati, innovazioni radicali nel design chiplet, passi avanti nella memoria HBM4 e infrastrutture rack a potenza megawatt, pur mantenendo un approccio pragmatico su supply chain e compatibilità hardware.