NVIDIA Blackwell arriva nel cloud pubblico: GA di AWS EC2 P6-B200
In una frase AWS rende generalmente disponibile p6-b200.48xlarge con 8 GPU NVIDIA B200 e 1440GB di memoria GPU — ma solo nella regione US West (Oregon) e solo tramite EC2 Capacity Blocks for ML, non in On-Demand standard.
Blackwell è la generazione di GPU NVIDIA che segue Hopper, e le appartengono solo B200 e GB200. La H200, che spesso viene accorpata a loro, è ancora Hopper: è un aggiornamento di memoria della generazione precedente, non una nuova architettura. Non è mai esistito un singolo giorno in cui Blackwell è diventata ampiamente disponibile: è arrivata cloud per cloud e regione per regione. Il traguardo AWS del 15 maggio 2025 è uno dei segnali più netti: l'istanza p6-b200.48xlarge diventa generalmente disponibile con otto GPU B200. L'accesso però era ristretto. Al lancio esisteva in una sola regione, US West (Oregon), e si poteva ottenere unicamente tramite EC2 Capacity Blocks for ML: si prenota un blocco di GPU per una finestra definita, non si avvia un'istanza on demand come un server qualsiasi. La dichiarazione di prestazioni di AWS è misurata: fino a 2x le prestazioni delle istanze P5en per training e inferenza. P5en è la generazione H200, quindi il confronto è con Hopper e non con la più vecchia H100. Ciò che cambia in pratica è che affittare Blackwell non richiedeva più un accordo diretto con NVIDIA. Richiedeva ancora di prenotare capacità in anticipo in un angolo del mondo, quindi la scarsità si era spostata, non dissolta.
Aziende
NVIDIA, AWS
Tool
B200, Blackwell, Amazon EC2
Tag
Fonti