Aller au contact
Formation officielle IBM · HPC · 3 jours · H010G

IBM Spectrum LSF
administration de base d'un cluster HPC

Formation officielle IBM H010G — trois jours pour déployer, exploiter et déboguer un cluster Spectrum LSF en production : installation, files d'attente, politiques fairshare et SLA, gestion CPU, GPU et mémoire, intégration d'applications et dépannage. L'alternative professionnelle à SLURM quand l'entreprise exige support éditeur, priorisation réelle et haute disponibilité.

Durée 3 jours · 24 h
Niveau Intermédiaire · admin Linux
Pratique Cluster HPC réel
Format En ligne ou présentiel
Logo IBM Spectrum LSF
IBM Spectrum LSF Cluster HPC bsub · bjobs · bkill Fairshare et SLA GPU scheduling EGO vs SLURM · PBS LIM · RES · mbatchd IBM Spectrum LSF Cluster HPC bsub · bjobs · bkill Fairshare et SLA GPU scheduling EGO vs SLURM · PBS LIM · RES · mbatchd
[ 01 ]Pourquoi cette formation

De bsub à l'exploitation
d'un cluster HPC en production.

Trois jours avec un cluster IBM Spectrum LSF réel dans nos laboratoires : master, candidate masters et hosts, files d'attente configurées, GPU et CPU partagés, et applications réelles de simulation numérique. L'objectif : que vous ressortiez avec une capacité opérationnelle effective, pas seulement des notes.

Nous couvrons ce qui apparaît chaque jour en production — soumission et contrôle des travaux avec bsub, conception des files d'attente, politiques fairshare et SLA, limites par utilisateur et projet, intégration d'applications, administration via EGO et débogage quand quelque chose casse. Le tout aligné sur le programme officiel IBM H010G.

[ 02 ]Pour qui · ce que vous en retirez

Une formation pour les équipes qui exploitent des charges HPC sérieusement

C'est pour votre équipe si…

  • Vous êtes administrateurs Linux ou UNIX et vous allez déployer ou maintenir un cluster LSF en production.
  • Vous venez de SLURM, PBS ou LoadLeveler et devez passer à LSF, ou faire cohabiter les deux.
  • Vous gérez des charges batch avec SLA et priorisation par projet : simulation numérique, EDA, ML, rendu.
  • Vous devez partager CPU, GPU, mémoire et licences logicielles entre utilisateurs et groupes avec des règles claires et auditables.

À la fin vous exploitez

  • Vous installez LSF de zéro sur RHEL ou Debian et validez master, candidate masters et hosts.
  • Vous soumettez et contrôlez les travaux avec bsub, bjobs, bkill, bstop et bresume.
  • Vous configurez les ressources consommables (CPU, GPU, mémoire, licences) et des limites par utilisateur, groupe et projet.
  • Vous concevez des files avec fairshare, préemption et SLA pour les charges critiques.
  • Vous administrez le cluster au quotidien et déboguez avec logs, traces et bconf quand quelque chose échoue en production.
[ 03 ]Programme · 3 jours

De l'architecture LSF à l'exploitation quotidienne

Trois jours qui construisent le même cluster couche par couche : nous partons des fondamentaux et de l'installation, montons jusqu'aux files d'attente, aux politiques fairshare et SLA, et finissons par administrer et déboguer le système comme en production réelle.

01 Jour 1 · Fondamentaux et installation

Architecture, installation et première soumission

  • Ce que résout LSF et en quoi il diffère de SLURM, PBS ou Kubernetes pour le HPC.
  • Architecture interne : LIM, RES, sbatchd, mbatchd et rôle du master.
  • Installation pas à pas sur RHEL ou Debian et vérification du cluster.
  • Première soumission avec bsub et commandes de consultation de base.
Pratique sur cluster réel
02 Jour 2 · Ressources, files et politiques

Gestion des ressources, files d'attente et politiques d'ordonnancement

  • Ressources consommables : CPU, GPU, mémoire et licences logicielles.
  • Conception des files par profil utilisateur et type de charge.
  • Politiques fairshare, préemption et priorités relatives.
  • SLA et guarantees, limites par utilisateur, groupe, host et projet.
Pratique sur cluster réel
03 Jour 3 · Exploitation, EGO et dépannage

Applications, administration via EGO et débogage

  • Intégration et déploiement d'applications dans le cluster.
  • Administration quotidienne : démarrage, arrêt, ajout de nouveaux hosts.
  • Administration des ressources via EGO quand le déploiement l'exige.
  • Débogage avec logs, traces et bconf, et résolution des pannes courantes.
Pratique sur cluster réel
[ 05 ]Questions fréquentes

Questions fréquentes

Quelle expérience préalable est nécessaire ?

Administration Linux ou UNIX de base — bash, permissions, réseau, systèmes de fichiers partagés (NFS ou équivalent). Aucune expérience préalable avec LSF ou d'autres produits IBM n'est requise. Si vous venez de SLURM, PBS ou LoadLeveler, les concepts vous seront familiers.

Quand choisir LSF plutôt que SLURM ou Kubernetes ?

LSF est le choix professionnel quand l'entreprise a besoin de SLA contractuels, d'une priorisation complexe entre projets, d'une gestion fine des licences logicielles onéreuses et du support officiel IBM. SLURM couvre la partie ordonnanceur libre, et Kubernetes est conçu pour les services, pas pour les charges batch HPC traditionnelles. Dans la formation nous menons une comparaison pratique et aidons à décider avec les bons critères.

Sur quelle infrastructure se déroulent les travaux pratiques ?

Sur un cluster HPC réel de nos laboratoires, avec master, candidate masters et plusieurs hosts. Chaque participant travaille contre un environnement qui simule la production, pas une machine virtuelle isolée.

Le GPU scheduling est-il couvert ?

Oui. La gestion des GPU en tant que ressources consommables est couverte dans le bloc gestion des ressources : comment les déclarer, les affecter par travail et les partager entre utilisateurs avec des règles fairshare ou des limites par projet.

En quoi se différencie-t-elle des formations LSF avancées ?

C'est le cours officiel d'administration de base (H010G) — il couvre le déploiement complet et l'exploitation quotidienne d'un cluster LSF. Les formations LSF avancées approfondissent le tuning fin, les intégrations spécifiques et les architectures larges ; nous les dispensons séparément une fois que l'équipe a une base solide.

Quelles modalités sont disponibles ?

Contactez-nous pour connaître les modalités et dates. Nous dispensons la formation en français, anglais et espagnol, en ligne en direct ou en présentiel, et nous préparons des sessions intra-entreprise sur mesure sur votre cluster réel.

Quel est le prix ?

Le prix est calculé par groupe et dépend du format, de la langue et de la modalité. Parlez-nous de votre projet — nombre de participants, lieu et dates cibles — et nous vous renvoyons une proposition concrète.

Peut-on la réserver en intra-entreprise ?

Oui. Nous adaptons le rythme, les exemples et les exercices à la stack réelle de votre organisation — versions d'OS, topologie réseau, applications et SLA. Écrivez-nous en indiquant le nombre de participants, le lieu (présentiel ou distanciel) et les langues requises.
[ 06 ]   Demander plus d'informations

Parlez-nous de votre cluster

Dites-nous combien vous êtes, en quelle langue, quelle version de LSF vous utilisez (ou de quel ordonnanceur vous venez) et si c'est en ligne ou en présentiel. Nous vous renvoyons une proposition concrète — format, dates et équipe pédagogique — pas un devis générique.

Téléphone+34 91 198 02 43
PrixSur demande par groupe
LanguesFR · EN · ES
SIXE