Proxmox-Cluster aufbauen: Quorum, Ceph und HA ohne böse Überraschungen
Über deine Verfügbarkeit entscheidet nicht der Hypervisor, sondern das Cluster-Design darunter. Drei Nodes für ein stabiles Quorum, getrenntes Netz für Corosync und ein Ceph-Layout, das einen Node-Ausfall aushält, sind die Mindestausstattung.
Warum Proxmox-Cluster im Alltag scheitern
Ein Proxmox-Cluster ist schnell erzeugt. Mit pvecm create und pvecm add stehen drei Nodes in wenigen Minuten, das Web-Interface zeigt alle Hosts grün, und die erste Live-Migration läuft auf Anhieb. Die Probleme kommen später, meist beim ersten ungeplanten Ausfall oder beim ersten Wartungsfenster mit Reboot. Dann stellt sich heraus, dass das Cluster zwar zusammensteht, aber nie für den Fehlerfall ausgelegt wurde.
Die Klassiker wiederholen sich: Ein Zwei-Node-Cluster ohne QDevice verliert beim Ausfall eines Hosts das Quorum, der verbleibende Node setzt sich read-only und startet keine VM mehr. Corosync läuft über dieselbe Leitung wie Migrations- und Backup-Traffic, sodass ein voller Link Latenzspitzen erzeugt und Nodes sich gegenseitig als tot markieren. Oder HA ist aktiviert, die VM-Disks liegen aber auf lokalem LVM-Thin, womit ein Failover technisch gar nicht möglich ist und der HA-Manager die Maschine nur endlos neu zu starten versucht.
Dazu kommen Betriebsdetails, die erst unter Last auffallen. Ceph mit drei Nodes und der Default-Regel size=3, min_size=2 verträgt genau einen Ausfall, und wer beim Wartungs-Reboot den noout-Flag vergisst, löst ein unnötiges Rebalancing über das Produktivnetz aus. Fencing über den Proxmox-Watchdog funktioniert nur, wenn der HA-Stack konsistent konfiguriert ist. Und CPU-Modelle wie host statt x86-64-v2-AES verhindern die Live-Migration auf Hardware anderer Generation. Das sind alles keine exotischen Fälle, sondern die Standardstolpersteine der ersten Betriebsmonate.
Sechs Schritte zum belastbaren Cluster
- 01 Netz trennen
- 02 Nodes und Quorum
- 03 Shared Storage
- 04 HA-Gruppen
- 05 Fencing testen
- 06 Backup und Restore
So planst du ein Cluster, das den Ausfall auch übersteht
Ein belastbares Proxmox-Cluster entsteht aus wenigen, aber konsequenten Entscheidungen zu Netz, Quorum und Storage. Die folgenden Punkte sind die Reihenfolge, in der du sie treffen solltest, bevor die erste produktive VM darauf läuft.
Netz zuerst, Cluster danach
Corosync bekommt ein eigenes, möglichst redundantes Netz mit niedriger Latenz. Über den zweiten Ring, konfiguriert als link1 in der corosync.conf, hast du einen Ausweichpfad, wenn ein Switch oder ein Uplink ausfällt. Migration, Backup und Ceph-Replikation gehören auf getrennte Interfaces, sonst bestimmt der Backup-Job die Stabilität der Cluster-Kommunikation.
Quorum ehrlich rechnen
Drei Nodes sind das sinnvolle Minimum, weil ein Ausfall dann noch zwei von drei Stimmen übrig lässt. Wenn du aus Budgetgründen bei zwei Hosts bleibst, brauchst du ein QDevice auf einem dritten, kleinen System als Tiebreaker. Von manuell gesetzten expected votes solltest du die Finger lassen, das verschiebt das Problem nur in Richtung Split-Brain.
Shared Storage passend zur Größe wählen
HA und Live-Migration ohne Downtime brauchen Speicher, den alle Nodes sehen. Ceph ist die integrierte Variante und lohnt sich ab drei Nodes mit ausreichend OSDs und dediziertem Netz. Bestehendes SAN über iSCSI oder Fibre Channel mit LVM darüber ist genauso legitim, und ZFS mit Replikation ist eine Option, wenn du einen Datenverlust im Minutenbereich akzeptieren kannst.
HA-Gruppen und Fencing bewusst konfigurieren
Lege HA-Gruppen mit Prioritäten fest, damit klar ist, wo eine VM bevorzugt läuft und wohin sie im Fehlerfall wandert. Der Watchdog fenced einen Node, der das Quorum verliert, hart. Teste das, indem du im Wartungsfenster gezielt einen Host vom Netz nimmst, statt darauf zu vertrauen, dass es im Ernstfall passt.
Wartung als eigenen Prozess definieren
Für Updates und Reboots brauchst du eine feste Reihenfolge: Node in den Ceph-Maintenance-Modus mit noout, VMs per Live-Migration abziehen, patchen, Health prüfen, erst dann den nächsten Host anfassen. Mit einer solchen Routine bleiben Kernel-Updates unspektakulär.
Backup und Restore mitdenken
Ein Cluster ersetzt kein Backup. Der Proxmox Backup Server mit Deduplizierung und geprüften Restores gehört von Anfang an dazu, und der Restore-Test ist Teil der Inbetriebnahme, nicht eine Aufgabe für später.
Kurse zu Hochverfügbarkeit mit Proxmox bei cmt
Diese Kurse vertiefen genau das, an echten Systemen statt nur an Folien. Als Präsenz oder Live-Online, auf Wunsch auch Inhouse für dein Team.
Häufige Fragen zu Hochverfügbarkeit mit Proxmox
Noch etwas offen? Wir sind ohne Warteschleife für dich da.
Frag uns direktWie viele Nodes braucht ein Proxmox-Cluster mindestens?
Was passiert, wenn ein Proxmox-Cluster das Quorum verliert?
Brauche ich Ceph für Proxmox HA?
Warum schlägt die Live-Migration zwischen meinen Nodes fehl?
Wie aktualisiere ich ein Proxmox-Cluster ohne Ausfall?
Zuletzt geprüft am 26. Juli 2026.
Verwandte Linux-Themen
Alle Linux-Themen im ÜberblickEchte Stimmen aus unseren IT-Kursen
Sehr intensiver Lehrgang, hat mich für meine Arbeit ein gutes Stück voran gebracht.
Es war eine sehr gute Lernatmosphäre und der Trainer verstand sein Thema sehr gut.
Deine Ansprechpartner
Du bist dir nicht sicher, welcher Kurs oder welches Level zu dir passt? Wir beraten dich persönlich und kostenlos.
Yves Hoppe
Weiterbildung & Beratung
Hilft dir, aus dem Linux-Programm den passenden Kurs oder Lernpfad zu finden.
Norbert Jansen
Beratung & Inhouse
Plant mit dir Inhouse-Trainings, die exakt auf eure Systemlandschaft und Distributionen zugeschnitten sind.
Cluster-Design gemeinsam durchgehen
Im Proxmox Aufbaukurs zu Cluster, Ceph und High Availability baust du die hier beschriebene Umgebung selbst auf, provozierst Node-Ausfälle im Labor und siehst, wie sich Quorum, Fencing und Ceph dabei verhalten. Wenn dir noch die Basis fehlt, fängst du mit dem Proxmox Grundkurs zu KVM, LXC, Storage und Backup an, und wer gerade von VMware kommt, findet im Kurs zur Migration von VMware zu Proxmox den passenden Einstieg. Alle Termine gibt es als Präsenz- und Live-Online-Schulung, auf Wunsch auch als Inhouse-Training auf deiner eigenen Hardware. Sprich uns an, dann klären wir vorab, welche Variante zu deiner Umgebung passt.