École Hexagone Executive

Proxmox VE et Ceph : installer, déployer et maintenir une infrastructure hyperconvergée

Concevoir et exploiter un cluster Proxmox VE hautement disponible avec stockage distribué Ceph, l'alternative open source et souveraine à VMware vSphere et vSAN.

Concevoir, déployer et maintenir un cluster Proxmox VE 9 hyperconvergé avec stockage distribué Ceph : clustering, haute disponibilité, migration à chaud, réseau de cluster, sauvegarde et plan de reprise. Une formation orientée exploitation, qui confronte chaque stagiaire à des pannes réelles pour maîtriser une infrastructure de production sans point unique de défaillance.

Durée
4 jours (28 heures)
Modalités
Présentiel, Distanciel synchrone, Hybride
Prochaine session
Sessions à venir
Prix
2 900 € HT

Objectifs pédagogiques

  • Concevoir et dimensionner une infrastructure hyperconvergée Proxmox VE et Ceph
  • Créer et administrer un cluster Proxmox VE : Corosync, quorum, réseaux dédiés
  • Déployer un stockage distribué Ceph : moniteurs, OSD, pools, règles CRUSH
  • Mettre en œuvre la migration à chaud et la haute disponibilité des machines virtuelles
  • Protéger l'infrastructure avec Proxmox Backup Server et formaliser un plan de reprise d'activité
  • Diagnostiquer et résoudre les pannes courantes : nœud, disque, réseau
  • Maintenir le cluster dans la durée : mises à jour sans interruption, montées de version, supervision

Public visé

Administrateurs systèmes et infrastructure, ingénieurs virtualisation, architectes techniques, équipes en charge d'une migration depuis VMware vSphere ou vSAN.

Prérequis

Avoir suivi la formation « Proxmox VE : installer, déployer et maintenir un serveur de virtualisation » ou disposer d'une expérience équivalente d'administration de Proxmox VE. Bonne maîtrise de l'administration Linux et des réseaux (VLAN, routage, agrégation de liens).

En bref

Niveau
Expert
Durée
4 jours (28 heures)
Prix
2 900 € HT
Modalités pédagogiques
Présentiel, Distanciel synchrone, Hybride
Formats
Inter-entreprises, Intra-entreprise
Langue
Français
Lieux
Versailles, La Défense (Tour Canopy), Clermont-Ferrand
Effectif
De 2 à 12 participants

Programme détaillé

Module 1 – Conception d'une infrastructure hyperconvergée

  • Hyperconvergence ou SAN centralisé : avantages, limites et cas d'usage.
  • Trois nœuds minimum : pourquoi, et ce que cela implique pour la tolérance aux pannes.
  • Dimensionnement : CPU, RAM par OSD, disques SSD/NVMe entreprise avec protection contre les coupures, contrôleurs en mode HBA (jamais de RAID matériel sous Ceph).
  • Réseau : 10/25 GbE, redondance, séparation des flux Corosync, Ceph, migration et production.
  • Identification des points uniques de défaillance ; comparaison avec VMware vSphere + vSAN (fonctionnalités et coûts).

Module 2 – Cluster Proxmox VE

  • Corosync et le système de fichiers de cluster pmxcfs (/etc/pve).
  • Création du cluster et ajout de nœuds : pvecm create, pvecm add, pvecm status.
  • Liens Corosync redondants (link0/link1) et exigences de latence.
  • Quorum et votes : comportement en cas de perte de nœuds ; cluster à deux nœuds et QDevice.
  • Retrait propre d'un nœud avec pvecm delnode et pièges à éviter.

Module 3 – Réseau de cluster et SDN

  • Plan d'adressage et séparation physique ou logique des flux.
  • Réseau de migration dédié, MTU 9000 et vérification de bout en bout ; agrégation LACP pour le stockage.
  • SDN : zones Simple, VLAN et VXLAN, VNets, IPAM.
  • Fabrics OpenFabric et OSPF : Ceph en maillage complet sur trois nœuds sans commutateur.
  • Présentation d'EVPN et des fabrics WireGuard pour les architectures multi-sites.

Module 4 – Architecture Ceph

  • RADOS et les démons Ceph : MON, MGR, OSD, MDS.
  • BlueStore, WAL et DB : placement sur disque rapide.
  • Placement groups et autoscaler ; algorithme CRUSH et domaines de défaillance (disque, hôte, baie).
  • Réplication size 3 / min_size 2 : pourquoi ne jamais descendre à min_size 1.
  • Erasure coding : principe, gains de capacité et contraintes.

Module 5 – Déploiement de Ceph sur Proxmox VE

  • Choix de la version Ceph (Squid, Tentacle) et des dépôts : pveceph install.
  • Initialisation avec réseaux public et cluster séparés : pveceph init.
  • Moniteurs et managers répartis sur trois nœuds ; création des OSD avec ou sans DB/WAL séparés.
  • Pools RBD pour les disques de VM, option KRBD ; CephFS pour les ISO, templates et fichiers partagés.
  • Tableau de bord Ceph et outils ceph -s, ceph osd tree, ceph df.

Module 6 – Performance et capacité

  • Classes de disques (HDD, SSD, NVMe) et règles CRUSH dédiées.
  • Seuils nearfull et full : planifier la capacité pour survivre à la perte d'un nœud.
  • Calcul de la capacité réellement utilisable.
  • Mesures de performance avec rados bench et fio ; paramètres de VM adaptés à Ceph (cache, discard, IOthread).

Module 7 – Migration à chaud et haute disponibilité

  • Migration à chaud sur stockage partagé et avec stockage local.
  • Réplication ZFS : alternative pour les petits clusters sans Ceph.
  • HA Manager : gestionnaires CRM et LRM, états des ressources ; watchdog et fencing.
  • Règles d'affinité de nœud et de ressource ; politique d'arrêt, mode maintenance et répartition dynamique de charge (CRS).

Module 8 – Sauvegarde et plan de reprise d'activité

  • Pourquoi les snapshots Ceph ne remplacent pas une sauvegarde.
  • Proxmox Backup Server hors du cluster : datastores, espaces de noms, jetons API.
  • Sauvegardes à l'échelle du cluster, vérification, rétention et garbage collection ; synchronisation vers un PBS distant.
  • Restauration en direct (live restore) et restauration de fichiers.
  • RPO, RTO et rédaction d'une procédure de reprise d'activité.

Module 9 – Tests de résilience

  • Panne brutale d'un nœud : fencing et redémarrage des VM.
  • Panne d'un disque : passage d'un OSD à l'état down puis out.
  • Coupure du réseau Corosync ou du réseau Ceph.
  • Observation de la reconstruction (recovery, backfill, degraded), retour à la normale et analyse post-incident.

Module 10 – Exploitation de Ceph

  • Lecture de ceph health detail et des états des placement groups.
  • Remplacement d'un disque défaillant : sortie, destruction et recréation de l'OSD.
  • Ajout d'un nœud ou d'OSD et rééquilibrage des données.
  • Drapeaux de maintenance noout et norebalance ; scrub, deep-scrub et rapports de crash.

Module 11 – Maintenance du cluster

  • Mises à jour en roulement, nœud par nœud, sans interruption de service.
  • Mode maintenance HA et désarmement de la HA pour les interventions sur le réseau de cluster.
  • Montée de version Ceph (Squid vers Tentacle) puis de Proxmox VE : ordre des opérations.
  • Préparation d'une procédure avec retour arrière et point de contrôle.

Module 12 – Supervision et sécurité

  • Serveur de métriques externe (InfluxDB, Graphite) et module Prometheus de Ceph.
  • Intégration Zabbix et alertes sur l'état de santé Ceph ; notifications du cluster (SMTP, webhook).
  • Isolation des réseaux Corosync et Ceph : non routés et inaccessibles depuis les VM.
  • Délégation des droits d'administration : pools de ressources, rôles et jetons API.

Mise en situation finale : diagnostic et remédiation d'incidents sur un cluster hyperconvergé.

Méthodes pédagogiques

Apports structurés et études de cas concrets issus de déploiements en production ; travaux pratiques sur un cluster Proxmox VE de trois nœuds par stagiaire ou par binôme ; scénarios de panne provoqués en conditions réelles ; fil rouge : conception, déploiement et exploitation de l'infrastructure hyperconvergée d'une PME ; environ 70 % de pratique ; supports fournis et procédures d'exploitation réutilisables

Modalités d'évaluation

Test de positionnement en amont ; évaluations continues (QCM, travaux pratiques) ; mise en situation finale : diagnostic et remédiation d'incidents sur un cluster hyperconvergé ; attestation de fin de formation

Formateur

Valentin Dumont

Financement

Cette formation peut être financée par :

  • OPCO de votre branche professionnelle, pour les salariés
  • Plan de développement des compétences de votre entreprise
  • France Travail (AIF), pour les demandeurs d'emploi
  • Transitions Pro, dans le cadre d'un projet de reconversion professionnelle

Nous vous accompagnons dans le montage de votre dossier de financement.

Accessibilité

Toutes nos formations sont accessibles aux personnes en situation de handicap. Avant votre inscription, notre référent handicap étudie avec vous vos besoins et les adaptations possibles : aménagement du rythme et des modalités, adaptation des supports, accessibilité des locaux, et recours si nécessaire à des partenaires spécialisés. Nos trois sites sont accessibles aux personnes à mobilité réduite.

Inscription

Sessions à venir

Laissez vos coordonnées : un conseiller vous recontacte pour confirmer votre inscription et son financement.