$AMD Explication du réseau Helios :


Mise à l’échelle : à l’intérieur du rack
- 72 GPU MI455X
- 12 ASIC Broadcom Tomahawk 6
- 36 plans réseau parallèles
- 3,6 To/s bidirectionnels par GPU
- 260 To/s en agrégé
Le réseau repose sur deux standards :
> UALoE définit comment les GPU communiquent, y compris les lectures et écritures mémoire, l’ordonnancement des transactions, et la manière dont le trafic est réparti sur les 36 plans réseau
> ESUN fournit le maillage Ethernet en dessous, en gérant l’acheminement, le contrôle de flux, la gestion de la congestion, les nouvelles tentatives au niveau des liaisons, et une transmission avec moins de surcharge pour les petits messages
Le chemin est :
MI455X → UALoE → Ethernet ESUN → Tomahawk 6 → MI455X
Les 31 To de HBM4 restent physiquement répartis sur 72 GPU. UALoE permet à n’importe quel GPU de lire ou d’écrire directement la mémoire de n’importe quel autre GPU, faisant du rack entier un seul et même ordinateur
Mise à l’échelle : entre les racks
Les racks sont interconnectés via une mise à l’échelle Ethernet avec des cartes réseau IA Pensando Vulcano à 800G vers un fabric prêt pour UEC
Le chemin est :
Rack Helios → NIC Vulcano → Ethernet UEC → un autre rack Helios
AMD-8,63%
AVGO-1,29%
Voir l'original
post-image
post-image
Cette page peut inclure du contenu de tiers fourni à des fins d'information uniquement. Gate ne garantit ni l'exactitude ni la validité de ces contenus, n’endosse pas les opinions exprimées, et ne fournit aucun conseil financier ou professionnel à travers ces informations. Voir la section Avertissement pour plus de détails.
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Commentaire
Ajouter un commentaire
Ajouter un commentaire
Aucun commentaire