Aller au contact
Formation officielle IBM · HPC et calcul haute performance

Formations HPC
pour clusters d'entreprise

Formation officielle en IBM Spectrum LSF (workload scheduling), IBM Storage Scale (GPFS) et Elastic Storage Server. Cinq cours officiels IBM pour les équipes qui exploitent des clusters HPC en production — du batch scheduling au filesystem parallèle. Alternative professionnelle à Ceph et SLURM quand l'entreprise a besoin du support éditeur et de SLA.

Partenaire officiel IBM Business PartnerFormation officielle certifiée
[ 01 ]Deux administrations inséparables

Un cluster HPC, ce sont deux administrations tenues avec du ruban adhésif.

Un cluster de calcul haute performance a deux couches techniques qu'on apprend séparément et qu'on administre ensemble. D'un côté le workload scheduling (LSF, SLURM) : décide ce qui s'exécute, quand, avec quelle priorité et contre quel SLA. De l'autre le filesystem parallèle (Storage Scale/GPFS, Ceph, Lustre) : sert les données à des centaines de nœuds sans s'effondrer. Ce hub réunit les deux parce qu'en production personne ne les gère isolément très longtemps.

Formation officielle IBM en Spectrum LSF (H010G), Storage Scale / GPFS (H005G, H006G, H008G) et supervision de l'Elastic Storage Server. Dispensée directement par nos ingénieurs de déploiement, pas par des formateurs externes.

Si vous avez besoin d'autres pièces du stack : Ceph SDS pour du stockage distribué open-source, Linux avancé comme base système, le hub IBM Storage pour la sauvegarde et le stockage d'entreprise, et le conseil IBM Spectrum Compute · HPC quand il faut monter le cluster, pas seulement l'apprendre.

CATALOGUE5 cours // FAMILLESLSF · Storage Scale · Elastic Storage // ALT.SLURM · PBS // LANGUESFR · EN · ES // MODEen ligne · intra-entreprise
admin@hpc-master · ~ · bash
# soumettre un job GPU sur la file "gpu" en réservant des A100 en mode exclusif
$ bsub -q gpu -n 8 -gpu "num=2:mode=exclusive_process" \
    -R "select[gpu_model0=NVIDIAA100]" ./train.sh
Job <18274> is submitted to queue <gpu>.

# voir l'état du job avec des colonnes utiles
$ bjobs -o "jobid stat queue exec_host time_left"
JOBID  STAT  QUEUE  EXEC_HOST       TIME_LEFT
18274  RUN   gpu    2*gpu-node-04   3:47:12

# état d'une file : priorité, jobs en attente/en cours, limites
$ bqueues gpu

Ce que vous ferez dès le premier jour du cours H010G.

[ 03 ]Questions fréquentes

Questions fréquentes sur le HPC

Qu'est-ce que le HPC (High Performance Computing) et à quoi sert-il ?

Le HPC (High Performance Computing) — en français calcul haute performance — est la discipline qui agrège des dizaines ou des centaines de serveurs en un cluster pour exécuter des charges qu'un serveur seul ne peut pas traiter : simulation numérique (CFD, météorologie, chimie), entraînement de modèles d'IA à grande échelle, analyse de risque financier, traitement sismique, EDA en semi-conducteurs, rendu 3D. Un cluster HPC d'entreprise a besoin d'au moins deux couches : un workload scheduler qui décide où et quand un job s'exécute (LSF, SLURM, PBS), et un filesystem parallèle qui sert les données simultanément à tous les nœuds (Storage Scale / GPFS, Lustre, Ceph).

Qu'est-ce qui différencie IBM Spectrum LSF de SLURM ?

SLURM est un ordonnanceur libre très répandu dans le HPC académique. IBM Spectrum LSF est l'alternative professionnelle : il couvre les SLA contractuels, la priorisation complexe entre projets, la gestion fine des licences logicielles onéreuses, des politiques fairshare avancées et le support éditeur IBM. Quand l'entreprise exige des engagements de temps d'exécution et une traçabilité auditable, LSF s'impose. Quand la priorité est le coût zéro et la flexibilité académique, SLURM reste la voie. Dans le cours H010G nous menons une comparaison pratique sur le cluster.

Ai-je besoin de Storage Scale (GPFS) si j'ai déjà LSF ?

Pas obligatoirement. LSF peut fonctionner sur NFS ou n'importe quel filesystem partagé — il est agnostique au stockage. Mais en HPC sérieux, NFS devient le goulet d'étranglement dès que la charge monte. Storage Scale (GPFS) est un filesystem parallèle conçu pour que des centaines de nœuds accèdent aux mêmes données sans dégradation. On peut aussi le remplacer par Ceph (open-source) ou Lustre. La combinaison LSF + Storage Scale est le stack HPC de référence d'IBM.

Ceph peut-il remplacer Storage Scale (GPFS) ?

Cela dépend du profil de la charge. Ceph est puissant et flexible pour du stockage distribué objet, bloc et fichier — coût de licence nul et contrôle total. Mais sur des charges HPC avec beaucoup d'I/O petites et de latence critique, Storage Scale (GPFS) reste plus performant grâce à des années de tuning spécifique. Ceph l'emporte quand la flexibilité, le multi-tenant et le mix de charges priment. Chez SIXE nous formons et déployons les deux — le choix dépend du profil réel du cluster.

La formation peut-elle se faire en intra-entreprise sur notre cluster réel ?

Oui. Toutes les formations du hub HPC peuvent se dérouler en intra-entreprise, avec un programme adapté à votre version de LSF et Storage Scale, à votre topologie réseau et aux applications qui tournent réellement en production. Nous travaillons sur l'environnement de pré-production du client et vous ressortez avec une configuration quasi prête à passer en prod. Demandez un devis en indiquant le nombre de participants, les versions et le lieu.

Les cours sont-ils en ligne, en présentiel ou hybrides ?

Les deux modalités, dans les trois langues (FR, EN, ES). En ligne en direct avec salle virtuelle et cluster réel dédié par participant, ou en présentiel intra-entreprise sur site client. La qualité pratique est équivalente — les travaux pratiques tournent sur le même environnement.

SIXE déploie-t-il aussi le cluster, ou uniquement la formation ?

Les deux, en services séparés. Au-delà du catalogue de formations, nous proposons du conseil, du déploiement et de l'intégration de clusters HPC IBM Spectrum Computing (LSF + Storage Scale + Elastic Storage Server). Beaucoup de clients contractent d'abord le déploiement, puis forment leurs équipes en interne pour l'exploiter.
[ 05 ]   Demander plus d'informations

Parlez-nous de votre cluster

Dites-nous combien vous êtes, quel ordonnanceur et quel filesystem vous utilisez (ou d'où vous venez côté scheduler) et si vous préférez en ligne ou en présentiel. Nous revenons avec un format, des dates et une équipe pédagogique concrets.

Téléphone+34 91 198 02 43
PrixSur demande par groupe
LanguesFR · EN · ES
SIXE