19/08/2026
Seien wir doch mal ehrlich: Die gesamte Branche lügt sich bei Hochverfügbarkeit tagtäglich schamlos in die eigene Tasche.
Es widert mich regelrecht an, wie viele Unternehmen Millionen in redundante Rechenzentren, NetApp MetroCluster, Ceph-Verbünde oder gigantische VMware- und Proxmox-Cluster pumpen – nur um sich dann in einer völlig absurden Scheinsicherheit zu sonnen. Auf Folien sieht das alles unfassbar brillant aus: synchrone Spiegelung, automatische Failover-Mechanismen, null Ausfallzeit. Die Chefs nicken zufrieden, die Architekten klopfen sich auf die Schulter und alle fühlen sich unantastbar.
Aber wann hat irgendjemand das letzte Mal den Mut gehabt, einem Standort im laufenden Betrieb einfach eiskalt den Saft abzudrehen?
Niemand. Aus purer, lähmender Angst.
Man zittert vor Split-Brain-Szenarien, fürchtet korrupte Quorum-Entscheidungen und hat panische Angst davor, dass der automatische Switchover im Chaos versinkt. Also schiebt man den Test jahrelang vor sich her, erfindet Ausreden über die Produktionsstabilität und betet im Stillen, dass niemals ein Bagger die Glasfaser trassenseitig durchtrennt oder eine Brandmeldeanlage auslöst. Diese feige Verdrängung ist ein gigantischer Betrug am eigenen Budget. Eine Hochverfügbarkeit, die man sich nicht zu testen traut, existiert in der Realität schlichtweg nicht.
Dabei gibt es im gesamten IT-Leben kein befreienderes, geileres Gefühl als den Moment, in dem die Hauptseite stirbt – und der Cluster ohne einen einzigen Schluckauf übernimmt. Wenn der Puls von 180 schlagartig abfällt, die Anspannung aus dem Nacken weicht und sich diese unbeschreibliche Erleichterung breit macht, weil Ceph sauber rebalanciert, der MetroCluster ohne Datenverlust umschaltet und die VMs auf Proxmox oder VMware einfach weiterrennen. Das ist der Moment, in dem aus teurem Blech echte Ausfallsicherheit wird.
Wer diesen Schmerz und diese Erlösung nie im kontrollierten Chaos erlebt hat, wird bei der ersten echten Havarie unter Tränen zusehen, wie sein Millionengrab vor der gesamten Geschäftsführung kollabiert.
Wann habt ihr eurem Cluster das letzte Mal wirklich das Licht ausgeknipst?