GPU NVIDIA H200 e B200 Blackwell raggiungono ampia disponibilità cloud
In una frase Tutti e tre i cloud principali offrono ora istanze Blackwell; i costi di training calano del 40% rispetto a H100 e il throughput di inferenza raddoppia su B100.
La generazione di GPU Blackwell di NVIDIA — H200 e B200 — è ora disponibile contemporaneamente su AWS, Google Cloud e Azure. Questo è importante perché in precedenza le generazioni di GPU all'avanguardia erano scarse, con liste d'attesa di mesi. Ora qualsiasi azienda può avviare istanze Blackwell tramite le console cloud standard. I numeri sono convincenti: addestrare modelli grandi su Blackwell costa circa il 40% in meno rispetto alla precedente generazione H100, semplicemente perché l'hardware fa più lavoro per watt e per dollaro. Per l'inferenza — l'esecuzione dei modelli anziché il training — i cluster che passano a B100 vedono circa il doppio del throughput, il che significa che possono servire il doppio delle richieste a parità di costo. Per i laboratori AI e le aziende che costruiscono sul cloud, questo accelera le tempistiche e riduce l'intensità di capitale del lavoro AI.
Aziende
NVIDIA, AWS, Google, Microsoft
Tool
H200, B200, Blackwell
Tag
Fonti