# Hochverfügbarkeit und Clusterbetrieb

> Failover Cluster, Quorum, Wartung und Kapazität so beurteilen, dass ein Ausfall nicht zum Kontrollverlust wird.

Track: [Windows Server Administration](https://physar.tech/learn/windows-server-administration)  
Kanonische Fassung: https://physar.tech/learn/windows-server-administration/high-availability  
Stand: 2026-07-28  
Interaktiver Teil: 4 Checks (nur im Browser)

## Hochverfügbarkeit und Clusterbetrieb

### HA ist keine Zusage ohne Fehlerdomäne

Ein Failover Cluster kann Ausfälle begrenzen, aber nicht jede Abhängigkeit magisch entfernen. Quorum, gemeinsame oder replizierte Storage-Architektur, Netzpfade, Kapazitätsreserve und die Anwendung entscheiden, ob ein Failover wirklich einen Dienst erhält.

> **Lernziel:** Du kannst Quorum- und Kapazitätsentscheidungen von einer simplen „mehr Knoten“-Annahme trennen und Clusterwartung mit kontrollierter Dienstwirkung planen.

### Worauf ein Cluster vertraut

|  |  |
| --- | --- |
| **Quorum** | Bestimmt, ob eine Teilmenge des Clusters autoritativ weiterarbeiten darf; es schützt vor konkurrierenden Mehrheiten. |
| **Storage und Netzwerk** | Müssen zur gewählten Architektur passen und redundante Pfade mit der gleichen Fehlerdomäne vermeiden. |
| **Kapazität** | Restknoten brauchen genug CPU, Arbeitsspeicher und Storageleistung für den Ausfallfall. |
| **Workload** | Muss Failover und die gewählte Storageform tatsächlich unterstützen. |

> **Betriebsregel:** Nie eine Quorum- oder Witness-Änderung nur deshalb vornehmen, weil ein Knoten temporär nicht erreichbar ist. Erst Ausfallbild, verbleibende Stimmen und Runbook prüfen.

### Wartung ist ein geplanter Failover

Cluster- und Workload-Gesundheit sowie Kapazitätsreserve prüfen → Knoten kontrolliert drainen und Rollenbewegung überwachen → Knoten warten, rebooten und vor Rückkehr validieren → Rollen nur mit Dienst- und Client-Evidenz wieder verteilen

### Im Check

- Quorum als Autoritäts- und nicht als Leistungsmechanismus behandeln.
- Storage-, Netz- und Compute-Resilienz getrennt bewerten.
- Clusterwartung erst nach Workload- und Clienttest schließen.

## Quellen

- learn.microsoft.com/en-us/windows-server/failo…-clustering/overview — https://learn.microsoft.com/en-us/windows-server/failover-clustering/overview
- learn.microsoft.com/en-us/windows-server/failo…-clustering-overview — https://learn.microsoft.com/en-us/windows-server/failover-clustering/windows-server-failover-clustering-overview
- learn.microsoft.com/en-us/windows-server/failo…torage-architectures — https://learn.microsoft.com/en-us/windows-server/failover-clustering/storage-architectures
- learn.microsoft.com/en-us/windows-server/failo…ster-and-pool-quorum — https://learn.microsoft.com/en-us/windows-server/failover-clustering/understand-cluster-and-pool-quorum
- learn.microsoft.com/en-us/windows-server/failo…ate-failover-cluster — https://learn.microsoft.com/en-us/windows-server/failover-clustering/create-failover-cluster
