Linux

Proxmox — Cluster 2 nœuds + Réplication (BCP)

Monter un cluster Proxmox à 2 nœuds avec réplication ZFS pour la continuité d'activité, puis valider le backup d'un CT vers PBS — entièrement via l'interface web.

← Retour aux tutoriels Linux
📚 Objectif du tuto Mettre en place un PCA / BCP (Plan de Continuité d'Activité) avec deux hôtes Proxmox : un CT répliqué automatiquement d'un nœud à l'autre, et une sauvegarde testée vers Proxmox Backup Server. Tout se fait depuis la GUI, sans terminal.
🗂️ Scénario : cluster 2 nœuds + PBS [Cluster PVE] PVE-1 ───(réplication ZFS du CT)──▶ PVE-2 │ │ └──────────────┬───────────────────────┘ ▼ [PBS] (backup + restauration du CT)
⚠ Important — quorum à 2 nœuds Un cluster à 2 nœuds perd le quorum si un nœud tombe. Pour un vrai BCP, ajoutez un QDevice (petit témoin externe) afin de garder le quorum et autoriser la bascule. En labo, on peut s'en passer mais on en parle à l'étape 6.

Vérifier les prérequis du labo

  • 2 hôtes Proxmox VE installés : PVE-1 et PVE-2.
  • Sur chaque nœud, un stockage ZFS portant le même nom (ex : local-zfs). La réplication Proxmox exige du ZFS et un nom de pool identique sur les deux nœuds.
  • Horloge synchronisée (NTP actif) et résolution de noms (DNS ou /etc/hosts) entre les nœuds.
  • Un PBS joignable depuis le cluster (voir le tuto Proxmox Backup — PBS).
  • Accès à la GUI de chaque hôte : https://IP:8006.
💡 Vérifier le ZFS en GUI Sur chaque nœud : Datacenter > Storage, ou <nœud> > Disks > ZFS. Le nom du pool/stockage doit être strictement identique sur PVE-1 et PVE-2.

Créer le cluster sur PVE-1

  1. Connectez-vous à la GUI de PVE-1.
  2. Allez dans Datacenter > Cluster.
  3. Cliquez Create Cluster.
  4. Renseignez un nom (ex : bcp-cluster) et laissez le réseau Corosync par défaut (ou dédiez-le).
  5. Validez avec Create et attendez la fin de la tâche.

Joindre PVE-2 au cluster

  1. Toujours sur PVE-1 : Datacenter > Cluster > Join Information, puis Copy Information.
  2. Connectez-vous à la GUI de PVE-2.
  3. Allez dans Datacenter > Cluster > Join Cluster.
  4. Collez l'information copiée, saisissez le mot de passe root de PVE-1, puis validez.
  5. Après quelques secondes, les deux nœuds apparaissent dans l'arborescence de gauche.
✔ Vérification Dans Datacenter > Cluster, vous devez voir Nodes : 2 et un état quorate (quorum atteint).

Créer un CT de test

  1. Assurez-vous d'avoir un template LXC : <nœud> > local (storage) > CT Templates > Templates, et téléchargez par ex. debian-12-standard.
  2. En haut à droite, cliquez Create CT.
  3. Onglet General : nœud PVE-1, un CT ID (ex : 200), un hostname (ex : ct-test), un mot de passe.
  4. Onglet Template : sélectionnez le template téléchargé.
  5. Onglet Disks : placez le disque sur le stockage ZFS (ex : local-zfs) — c'est indispensable pour la réplication.
  6. Renseignez CPU, mémoire et réseau, puis Finish.
  7. Démarrez le CT et vérifiez qu'il fonctionne.
⚠ Disque sur ZFS obligatoire Si le disque du CT est sur local (répertoire) ou un stockage non-ZFS, la réplication sera impossible. Le volume doit être sur le pool ZFS.

Configurer la réplication ZFS du CT

  1. Sélectionnez le CT 200 dans l'arborescence.
  2. Ouvrez l'onglet Replication.
  3. Cliquez Add.
  4. Renseignez :
    • Target : PVE-2 (le nœud de destination).
    • Schedule : la fréquence (ex : */15 = toutes les 15 minutes).
    • Rate limit : facultatif, pour limiter la bande passante.
  5. Validez avec Create.
  6. La première synchronisation se lance : suivez-la dans la colonne Status (état OK une fois terminée).
💡 Comment ça marche Proxmox envoie un snapshot ZFS initial complet, puis seulement les deltas à chaque planification. Le CT reste donc disponible sur PVE-2 dans un état récent, prêt pour une bascule.

Tester la bascule (migration)

Réplication active = bascule quasi instantanée car les données sont déjà sur PVE-2.

  1. Bascule planifiée : clic droit sur le CT > Migrate > cible PVE-2. Comme le CT est déjà répliqué, seul un petit delta est transféré.
  2. Vérifiez que le CT démarre et fonctionne sur PVE-2.
  3. Le sens de réplication s'inverse automatiquement (PVE-2 ➜ PVE-1).
⚠ Panne réelle d'un nœud (2 nœuds) Si PVE-1 tombe vraiment, un cluster à 2 nœuds n'est plus quorate : impossible de démarrer le CT sur PVE-2 sans intervention. Pour une vraie haute disponibilité (HA automatique), ajoutez un QDevice témoin et activez le service HA (Datacenter > HA).

Sauvegarder le CT vers PBS et restaurer

La réplication protège contre la panne d'un nœud ; le backup PBS protège contre la perte de données (suppression, corruption). Les deux sont complémentaires.

  1. Ajoutez PBS comme stockage si ce n'est pas fait : Datacenter > Storage > Add > Proxmox Backup Server (voir le tuto PBS).
  2. Backup manuel : sélectionnez le CT 200 > onglet Backup > Backup now. Choisissez le stockage PBS et le mode Snapshot, puis lancez.
  3. Suivez la tâche jusqu'à TASK OK.
  4. Test de restauration : sélectionnez le stockage PBS > onglet Backups > choisissez le snapshot du CT 200 > Restore.
  5. Restaurez sous un nouvel ID (ex : 201) pour ne pas écraser l'original, puis démarrez-le pour valider.
✔ Résultat Vous avez un BCP complet : le CT est répliqué entre deux nœuds (continuité de service) et sauvegardé/restaurable via PBS (protection des données).