SupermicroSYS-422GA-NRT-01-G2

Quatre NVIDIA RTX PRO 6000 Blackwell avec 384 Go de mémoire GPU au total, deux Xeon 6960P de 72 cœurs et 1 To de DDR5 dans un châssis 4U qui a de la place pour quatre de plus.

Supermicro SYS-422GA-NRT-01-G2Rack 4U · Gold Series G2

La configuration exacte

Fiche technique officielle

Face avant schématique  survolez chaque composant.
Processeur2× Intel Xeon 6960P72 cœurs · 2,7 GHz
GPU4× NVIDIA RTX PRO 6000 Blackwell Server Edition
Mémoire1 ToDDR5-6400
Stockage1× 960 Go M.2 NVMe2× 3,84 To E1.S
Réseau1× dual 10 GbE RJ45
FormatRack 4U
Garantie
3 ans pièces et main-d'œuvre
Intervention sur site
En option  le jour ouvré suivant, pendant 3 ans

Des GPU partagés entre plusieurs équipes et services

Supermicro destine cette famille aux plateformes d'inférence partagées, et c'est là qu'elle donne le meilleur d'elle-même : un serveur sollicité en même temps par l'équipe data, celle qui développe des agents et deux ou trois services en production. Chaque RTX PRO 6000 peut être découpée avec MIG (le partitionnement NVIDIA d'un GPU en instances isolées) en quatre parts au plus, chacune avec sa propre mémoire. La machine peut ainsi se répartir en seize petits GPU ou fonctionner avec quatre grands, selon ce que demande chaque charge. Les 144 cœurs des deux Xeon 6960P suffisent largement pour le prétraitement, les bases vectorielles et les autres services qui entourent un modèle.

Les quatre GPU communiquent via un commutateur PCIe 5.0, sans le réseau NVLink des machines HGX, et c'est ce qui fixe sa limite. Pour servir un modèle réparti sur les quatre, cela fonctionne bien ; pour entraîner un grand modèle, où les GPU échangent des données en permanence, l'option est une HGX B300, car NVLink relie les GPU bien plus vite que le PCIe. Le réseau standard est en 10 GbE, suffisant si les modèles résident sur les disques E1.S locaux, insuffisant si vous les chargez depuis un stockage partagé.

Ce que nous prenons en charge

Nous l'intégrons à OpenShift AI ou à Kubernetes avec le NVIDIA GPU Operator, qui répartit les instances MIG entre les projets et permet à chaque équipe de demander le GPU dont elle a besoin sans toucher à la machine. Par-dessus, nous installons vLLM pour les modèles en production, ainsi que les notebooks et les pipelines de données de l'équipe data. Si vous voulez voir l'architecture complète, nous la décrivons dans inférence d'IA sur Kubernetes et Ceph.

Ce qu'il faut dans votre centre de données

Elle occupe 4U pour 737 mm de profondeur et entre donc dans presque toutes les baies. La fiche officielle indique quatre alimentations Titanium de 3 200 W en redondance 3+1, les mêmes que la version à huit GPU : si vous l'étendez plus tard, l'alimentation est déjà dimensionnée, et ce qu'il faut prévoir dès le départ, ce sont les prises et la PDU. Elle est refroidie par air avec dix ventilateurs de 8 cm.

Face au reste de la famille

ModèleCe qu'il embarqueQuand le choisir
SYS-822GS-NB3RT-01-G2HGX B300 8-GPU · 2 ToLa HGX B300 avec Intel ; le choix si votre standard est Xeon.
AS-8126GS-NB3RT-01-G2HGX B300 8-GPU · 3 ToMême HGX B300 avec AMD, 3 To et réseau de stockage séparé.
AS-5126GS-TNRT-01-G22x RTX PRO 6000 · 1,5 ToDeux GPU aujourd'hui, de la place pour huit et de la mémoire à revendre.
SYS-212GB-FNR-01-G22x RTX PRO 6000 · 512 GoLa plus compacte : 2U pour un service à deux GPU.
SYS-422GA-NRT-02-G28x RTX PRO 6000 · 1,5 ToLe maximum en PCIe : huit GPU et réseau 400 GbE.
SYS-C542i-11302UPrêt pour RTX 50 · 32 GoTour de développement sans GPU d'origine ; vous choisissez la carte.
ARS-511GD-NB-LCC-01-G2Grace + B300 · 748 GoUn nœud GB300 en tour pour l'équipe qui affine des modèles sans réserver de cluster.

Voir tous les serveurs IA et GPU

Ce que comprend la livraison

En usine

  • Configuration assemblée et testée par Supermicro
  • Garantie de 3 ans pièces et main-d'œuvre

De notre côté

  • Montage en rack
  • Gestion à distance (BMC) et firmware à jour
  • Système d'exploitation et pile logicielle installés
  • Tests avec votre charge avant la mise en production

Si vous en avez besoin

  • Astreinte 24×7 avec SLA
  • Intervention sur site le jour ouvré suivant pendant les 3 ans

Comment nous le mettons en place

Ce qui tourne sur ces serveurs, expliqué en détail 

Questions sur la SYS-422GA-NRT-01-G2

Quelle différence entre la SYS-422GA-NRT-01-G2 et la -02 ?

Elles partagent le châssis et des processeurs de la série Xeon 6900. La -01 embarque quatre RTX PRO 6000, 1 To de mémoire et uniquement du réseau 10 GbE ; la -02 remplit le châssis avec huit GPU, passe à 1,5 To et ajoute une carte 200 GbE et deux cartes 400 GbE pour le stockage et pour relier des nœuds. La -01 convient comme plateforme partagée appelée à grandir, la -02 quand le modèle ou le nombre d'utilisateurs exigent déjà huit GPU.

Peut-on partager un GPU entre plusieurs utilisateurs ?

Oui. Avec MIG, chaque RTX PRO 6000 se divise en quatre instances isolées au plus, chacune avec sa mémoire et ses cœurs, si bien que l'activité d'une équipe ne ralentit pas celle d'à côté. Dans Kubernetes ou OpenShift AI, ces instances se demandent comme n'importe quelle autre ressource, et nous les configurons selon la taille des modèles de chaque groupe.

Puis-je l'étendre à huit GPU ?

Oui. Le châssis accepte jusqu'à huit GPU double largeur et ses quatre alimentations de 3 200 W en redondance 3+1 sont celles de la -02 à huit GPU : l'extension consiste à ajouter les cartes, mettre à jour le firmware et revalider avec votre charge. En revanche, il faut revoir le réseau 10 GbE, car avec huit GPU on a généralement besoin de 200 ou 400 GbE.

Le SYS-422GA-NRT-01-G2 convient-il à votre projet 

Décrivez-nous la charge et le centre de données qui l'accueillera  nous vous répondons avec le prix, le délai confirmé et ce qu'il faut pour le mettre en service.