NVIDIA organisera un Hot Chips Talk la semaine prochaine, plongeant dans sa nouvelle architecture GPU Blackwell tout en rappelant au monde que son GPU Blackwell possède la plus grande capacité de calcul IA, de bande passante mémoire et de bande passante d'interconnexion jamais dans un seul GPU.
VOIR LA GALERIE – 11 IMAGES
La semaine prochaine, lors du Hot Chips 2024, NVIDIA détaillera l'architecture GPU Blackwell tout en rappelant qu'elle ne comporte pas un, mais deux GPU limités par le réticule fusionnés en un seul. L'une des limites des outils de fabrication de puces lithographiques est qu'ils ont été conçus pour fabriquer des circuits intégrés (CI) dont la taille ne dépasse pas environ 800 millimètres carrés, ce que l'on appelle la « limite du réticule ».
NVIDIA possède deux GPU IA limités par le réticule (104 milliards de transistors par puce, 208 milliards de transistors au total). NVIDIA discutera de la construction jusqu'à la limite du réticule et de la manière dont elle offre la densité de communication la plus élevée, la latence la plus faible et une efficacité énergétique optimale lors de son Hot Chips Talk.
Outre les 208 milliards de transistors, le Blackwell B200 dispose également de 20 PetaFLOPS FP4 AI, jusqu'à 192 Go de mémoire HBM3E avec 8 To/s de bande passante mémoire grâce à son HBM3E à 8 sites. Il y a 1,8 To/s de bande passante bidirectionnelle via NVLink et une liaison NVLink-C2C à haut débit vers le processeur Grace. Il se passe BEAUCOUP de choses à l'intérieur de Blackwell, BEAUCOUP.

- Deux GPU limités par réticule fusionnés en un seul package
- Transistors 208B dans TSMC 4NP
- 20 Peta FLOPS FP4 AI
- Bande passante mémoire de 8 To/s
- Mémoire HBM3e à 8 sites
- Bande passante NVLINK bidirectionnelle de 1,8 To/s
- Liaison NVLINK-C2C à haut débit vers le processeur Grace
