Aller au contact
Formation avancée · Niveau 3

Ceph en Production Opérations | CoursQuand un cluster de 200 To tombe à 3 h du matin et vous avez besoin de réponses, pas de théorie

Le seul cours indépendant de la distribution — IBM Storage Ceph, Red Hat, Ubuntu, Rocky, Alma Linux ou Ceph upstream. Scénarios réels de production à l'échelle du pétaoctet que les vendeurs n'enseignent pas, avec un programme aligné à la certification Red Hat EX260.

Formation Ceph Production Operations dispensée par SIXE — instructrice expliquant des scénarios critiques d'administration de clusters Ceph à l'échelle du pétaoctet
3 joursIntensifs
100%Hands-on
RéelsScénarios de production
Max 10Personnes par groupe
[ 01 ]Vous apprendrez à résoudre

Les scénarios qui ne figurent pas dans la documentation

Quatre catégories de problèmes réels travaillés pendant le cours — pas des diapositives ni des exemples de manuel.

01

Pannes critiques sur des clusters de 200 To+

02

Recovery de 40 To de CephFS corrompu

03

Tuning extrême pour AI/ML (500 To/jour)

04

Troubleshooting sous pression 24/7

[ 02 ]Pour qui
Niveau
Senior

Administrateurs certifiés ou avec une expérience réelle en production qui doivent maîtriser des scénarios critiques que les vendeurs n'enseignent pas — ceux qui arrivent à 3 h du matin quand le cluster tombe.

[ 03 ]Structure · 3 jours

Programme intensif pour affronter les crises réelles

Conçu pour optimiser les clusters de production à l'échelle du pétaoctet. Chaque journée combine une matinée de fondamentaux avancés avec une après-midi de laboratoire sur des problèmes réels.

01
Jour 1

Performance Engineering et Forensics avancé

De l'architecture au troubleshooting forensique réel.

Matin

Optimisation architecturale

  • BlueStore internals : RocksDB tuning, compaction, write amplification
  • Optimisation CPU : impact des C-states (labs avec 5× de dégradation), NUMA
  • Réseau : patterns 100 GbE, TCP tuning, nf_conntrack
  • NVMe-specific : reactor tuning, optimisation de bdevs_per_cluster
Après-midi

Troubleshooting forensique

  • Diagnostic toolchain : blktrace, perf, objectstore-tool
  • Case studies réels : NVMe degradation, OSD flapping post-upgrade
  • PG lifecycle avancé : stuck states, intervention manuelle
  • Labs : cluster avec problèmes réels à diagnostiquer
02
Jour 2

Disaster Recovery, Multi-Site et Petabyte Scaling

Récupération extrême et architectures multi-site.

Matin

DR avancé

  • Cas Edinburgh 40 To : chaîne complète de l'erreur et procédure de recovery
  • CephFS disasters : corruption des métadonnées, MDS failure handling
  • RBD mirroring : pool-based vs image-based, automatisation du failover
  • DR physique : extraction de disque, préservation du journal et du whoami
Après-midi

Multi-Site et Petabytes

  • RGW multisite : master zone failure, promotion manuelle, sync fairness
  • Planification WAN : formule 1 GbE par 8 To d'ingest journalier
  • Petabyte challenges : CERN 30 Po (7 200 OSDs), 310 M objets
  • Labs : simulation de multi-site failover et recovery
03
Jour 3

Security, AI/ML Workloads et Cost Engineering

Sécurité entreprise et optimisation pour charges modernes.

Matin

Security Hardening

  • Encryption : OSDs avec LUKS/dmcrypt, msgr2 secure, RGW SSE-S3/KMS
  • Key management : rotation (Squid 19.2.3+), intégration Barbican
  • Compliance : architecture HIPAA, GDPR, audit logging
  • Threat detection : patterns de supervision et gestion des vulnérabilités
Après-midi

AI/ML et ROI Engineering

  • S3 Select : intégration Trino (performance 2,5× à 9×), analytics pushdown
  • Patterns AI/ML : checkpointing, optimisation de l'accès parallèle
  • Analyse TCO : efficacité EC, économies avec du matériel commodity
  • Architectures hybrides : OpenStack DCN, edge-to-core, multi-cloud
[ 04 ]Spécifications du laboratoire

Infrastructure réaliste sur cloud enterprise

Chaque personne travaille sur un cluster réel avec des données pré-peuplées. Le laboratoire reste accessible 7 jours après la fin du cours pour consolider l'apprentissage.

Infrastructure

  • Cluster de 5-6 nœuds réels
  • 500 Go+ de données pré-peuplées par personne
  • Accès 24/7 pendant et 7 jours après

Scénarios réels

  • Disk failures et network partitions
  • Corruption simulée de métadonnées
  • Performance degradation injectée

Outils

  • blktrace, perf, objectstore-tool
  • Debugging symbols pré-installés
  • Datasets réels avec I/O patterns
[ 05 ]Indépendant de la distribution

Nous travaillons avec votre distribution et version

Nous alignons le laboratoire avec ce que votre équipe utilise en production. Sans biais de vendeur.

Distributions disponibles

  • Rocky Linux 9
  • Ubuntu 24.04 LTS
  • Red Hat Enterprise Linux
  • Alma Linux

Versions Ceph

  • Ceph upstream Squid 19.2+
  • IBM Storage Ceph 7.1
  • Red Hat Ceph Storage 7.x
[ 06 ]Prochaines sessions

Trois formats, groupes réduits

Formation intensive de 3 jours, maximum 10 personnes pour maximiser l'interaction et le troubleshooting collaboratif.

Format · 01

Présentiel chez SIXE

Dans nos locaux, avec un accès complet aux laboratoires et à l'équipement spécialisé.

Format · 02

In-company

Dans vos bureaux, pour des équipes de 4 personnes ou plus, avec une configuration personnalisée à l'environnement du client.

Format · 03

À distance

En direct avec un laboratoire cloud dédié et un accès complet aux ressources de pratique en temps réel.

[ 07 ]Certification SIXE

Badge Ceph Production Operations + alignement EX260

À la fin du cours vous obtenez le badge numérique Ceph Production Operations émis par SIXE sur Credly (Niveau 3, le plus senior du parcours). Le programme est aligné avec les domaines évalués dans Red Hat EX260Red Hat Certified Specialist in Ceph Cloud Storage : déploiement, gestion des pools replicated et erasure-coded, RBD/RGW/CephFS, troubleshooting, performance tuning, sécurité et haute disponibilité/disaster recovery. Si vous cherchez un simulacre d'examen spécifique et un guide de préparation pas à pas, cela se trouve dans le Niveau 2 (Avancé).

Badge numérique SIXE Ceph Production Operations sur Credly — certification du Niveau 3 (Expert) du parcours de formation Ceph

Ceph Production Operations · Niveau 3 · Expert

Émis par SIXE sur Credly à la fin du cours. Certifie la capacité à exploiter des clusters Ceph à l'échelle du pétaoctet en production : forensics, disaster recovery, multi-site, security hardening et charges AI/ML. Credential vérifiable avec un lien unique.

Voir les credentials SIXE sur Credly
[ 08 ]Au-delà de la formation

SIXE est IBM Business Partner

Au-delà de la formation, nous vendons, implémentons et assurons le support d'IBM Storage Ceph. Si vous devez couvrir le cycle complet, comptez sur nous.

Acquisition de licences

Conseil technique pour dimensionner et acquérir les licences IBM Storage Ceph adaptées au cas d'usage de votre organisation.

Déploiement en production

Conception et implémentation d'IBM Storage Ceph : architecture, matériel, réseau, intégration avec OpenStack, Kubernetes et systèmes legacy.

Support technique Ceph

Support continu avec une réponse spécialisée de notre équipe d'ingénierie. Voir le service →

[ 09 ]Parcours de formation

Ce cours est le Niveau 3 du parcours Ceph

Trois cours indépendants. Celui-ci est le plus senior : pensé pour ceux qui exploitent déjà Ceph et doivent maîtriser les scénarios critiques qu'aucun vendeur n'enseigne.

01 Niveau 1 · Initiation

Déploiement et administration

Fondamentaux jusqu'au cluster fonctionnel En savoir plus
02 Niveau 2 · Avancé

Administration avancée

Tuning, multi-site DR et EX260 En savoir plus
Vous êtes ici 03 Niveau 3 · Expert

Production Operations

Forensics, DR, AI/ML, HIPAA et EX260 Voir le programme

Cours associés : OpenStack intermédiaire · Docker et Kubernetes · Ansible. Services : Support technique Ceph.

[ 10 ]Questions fréquentes

Questions fréquentes

Quel profil est attendu chez la personne participante ?

Administrateurs certifiés ou avec une expérience réelle en production sur Ceph. Ce n'est pas un cours d'initiation ni de révision : on suppose la maîtrise préalable des OSD, pools, RBD, RGW, CephFS et du troubleshooting de base. Si vous n'avez pas ce niveau, commencez par le Niveau 1 ou le Niveau 2.

Le cours fonctionne-t-il avec IBM Storage Ceph ? Et avec Ceph upstream ?

Oui, avec les deux. Le cours est indépendant de la distribution : couvre IBM Storage Ceph 7.1, Red Hat Ceph Storage 7.x, Ceph upstream Squid 19.2+ et les distributions de base Rocky Linux 9, Ubuntu 24.04 LTS, RHEL et Alma Linux. Le laboratoire est adapté à la combinaison utilisée par votre équipe en production.

Quelle est la taille du groupe ?

Maximum 10 personnes par session. C'est un choix de conception : dans des scénarios de crise et de troubleshooting collaboratif, des groupes plus larges tuent l'interaction. Pour une formation in-company, le minimum est de 4 personnes.

Quelle est la durée d'accès au laboratoire ?

Accès 24/7 pendant les 3 jours du cours et 7 jours supplémentaires après la dernière session. L'objectif est que vous puissiez répéter les exercices et consolider l'apprentissage tant que le contenu est frais.

Ce cours prépare-t-il à la certification Red Hat EX260 ?

Oui. Le programme est aligné avec les domaines évalués dans EX260Red Hat Certified Specialist in Ceph Cloud Storage : déploiement, pools replicated et erasure-coded, RBD/RGW/CephFS, troubleshooting, performance tuning, sécurité et HA/DR. Si en plus du contenu vous avez besoin d'un simulacre d'examen spécifique et d'un guide de préparation pas à pas, cette partie est dans le Niveau 2 (Avancé). Le cours n'inclut pas les frais d'examen : ils se contractent directement auprès de Red Hat.

Les scénarios du laboratoire sont-ils réels ou simulés ?

Les deux. Des charges et datasets avec I/O patterns réels, et par-dessus on injecte des pannes contrôlées : disk failures, network partitions, corruption de métadonnées et dégradation de performance. Le diagnostic et la réponse sont à 100 % de votre côté.

Peut-on réduire le programme à 2 jours ?

C'est possible, mais nous ne le recommandons pas. Le jour de DR et multi-site nécessite du temps pour les failovers complets. En cas de contrainte d'agenda, discutons-en : d'habitude on résout en gardant les 3 jours mais en comprimant une session.

Pouvez-vous fournir un support 24/7 à notre cluster après le cours ?

Oui. SIXE est IBM Business Partner et propose un support technique Ceph continu avec des accords de réponse spécialisée.
[ 11 ]   Demander des informations

Prêt à éliminer la crainte des scénarios critiques ?

Demandez des informations sur les prochaines dates, le programme détaillé et les conditions. Réponse en moins de 24 heures.

Ou appelez-nous directement +34 91 198 02 43
SIXE