Aufgrund einer Clusterstörung in unserer Virtualisierungsumgebung sind einige der bei uns gehosteten VMs aktuell nicht erreichbar. Wir arbeiten bereits an einer Lösung und bitten die Unannehmlichkeiten zu entschuldigen.
--
Update 15.09.2026, 14:45 Uhr
Alle virtuellen Maschinen wurde erfolgreich wieder in das Selbstbedienungsportal manage.intern.hs-duesseldorf.de eingepflegt und sind dort wieder verfügbar. Wir werden nun abschließend weitere Nacharbeiten durchführen.
--
Update 14.09.2026, 10:30 Uhr
Alle virtuellen Maschinen konnten wiederhergestellt werden. Die betroffenen VMs befinden sich derzeit im Status „gestoppt“. Die weiteren Schritte werden aktuell mit den zuständigen Fachadministratoren abgestimmt. Parallel arbeiten wir an der Aufnahme der Systeme in das Selbstbedienungsportal manage.hs-duesseldorf.de.
--
Update 12.09.2026, 16:30 Uhr
Die Wiederherstellungsarbeiten verlaufen weiterhin planmäßig. Der laufende Verarbeitungsprozess zeigt Fortschritte, sodass sich die Prognose gegenüber dem letzten Status verbessert hat.
Nach aktuellem Stand erwarten wir den Abschluss der laufenden Arbeiten Sonntag Morgen. Erst danach kann belastbar bewertet werden, welche Systeme direkt wieder in Betrieb genommen werden können und bei welchen Systemen weitere Maßnahmen erforderlich sind.
Die Überwachung des Vorgangs erfolgt weiterhin auch außerhalb der regulären Betriebszeiten.
Das nächste Update veröffentlichen wir, sobald neue belastbare Erkenntnisse vorliegen.
--
Update 11.09.2026, 16:00 Uhr
Der Repair-Job läuft weiterhin stabil. Nach aktueller Auswertung der Datenträgerstatistik beträgt die prognostizierte Restlaufzeit rund 65 Stunden. Unter den derzeitigen Bedingungen wird der Abschluss des Rebuilds daher für Montagvormittag (ca. 08:00 bis 12:00 Uhr) erwartet.
Eine belastbare Aussage zum vollständigen Wiederherstellungsumfang ist erst nach Abschluss des Repair-Jobs möglich.
Wir überwachen den Fortschritt über das Wochenende.
Das nächste Status-Update erfolgt bei neuen Erkenntnissen oder spätestens am Montagvormittag.
--
Zwischenstand vom 11.09.2026 – 10:00 Uhr
Wir betreiben unsere VMs auf Clustern. Am Montag ist laut Monitoring gegen kurz vor 9 der erste Clusterknoten ausgefallen. Dabei ist das Cluster in den Read-Only Modus verfallen, und eine Stunde später dann in einen Neustartzyklus. Seitdem sind die betroffenen Virtuellen Maschinen nicht verfügbar.
Die Störungsbehebung haben wir priorisiert. Deshalb kommt dieses Statusupdate verspätet. Ich bitte um Entschuldigung.
Betroffen sind 10% aller Virtuellen Maschinen in der Campus IT. Wir haben während der Störungsbehebung folgende Services als betroffen wahrgenommen:
- Ausfall des Webservers
- Ausfall des Ticketsystems der Campus IT
- Einschränkungen bei der Kommunikation des Campus Managements mit externen Stellen
- Beeinträchtigung der Webseitenstatistik
- Ausfall eines Behördenpostfachs
- Beeinträchtigung des Aufrufsystems im Studierendenservice
Mehrere Dienste konnten aufgrund bestehender Hochverfügbarkeitsmechanismen eingeschränkt weiterbetrieben werden.
Wir haben mehrere Reparaturansätze verfolgt und durchgeführt:
- Bereitstellung und Räumung eines neueren Ersatzclusters.
- Migration der Datenträger aus dem betroffenen Cluster in die neue Clusterumgebung.
- Erneuerung der vollständigen Hardwareplattform mit Ausnahme der vorhandenen NVMe-, SSD- und HDD-Datenträger.
- Wiederherstellung verfügbarer Backups auf alternativen Plattformen.
- Wiederinbetriebnahme kritischer Dienste aus dem Backup auf Ersatzinfrastruktur.
- Nutzung der Expertise durch einen auf Storage Spaces Direct spezialisierten Microsoft MVP.
Die Datenbestände des ursprünglichen Clusters sind grundsätzlich sichtbar und werden analysiert.
Derzeit läuft ein umfangreicher Reparatur- und Synchronisationsprozess des Speichersystems. Die Wiederherstellung einzelner Datenträgerbereiche schreitet voran, erfolgt jedoch aufgrund der geringen Synchronisationsgeschwindigkeit deutlich langsamer als erwartet.
Mehrere kritische Systeme konnten bereits wieder bereitgestellt werden, darunter:
- Ticketsystem
- Behördenpostfach Dezernat 2
- Siemens EMA
- CAFM
Der Fortschritt der Speicherreparatur wird kontinuierlich überwacht.
Wir haben eine defekte Netzwerkkarte erneuert. Ohne diese Netzwerkkarte war der Clusterknoten nicht erreichbar.
Vermutlich gibt es weitere zusätzliche Datenträgerprobleme innerhalb des Clusters, die dann auch das Betriebssystem betrafen. Die endgültige Bewertung wird erst nach Abschluss der laufenden Speicherreparatur möglich sein.
Zum aktuellen Zeitpunkt bestehen weiterhin Risiken:
- Nicht alle virtuellen Maschinen konnten bislang erfolgreich wiederhergestellt werden.
- Für einzelne Systeme kann derzeit ein Datenverlust nicht ausgeschlossen werden.
- Hochverfügbare Dienste laufen teilweise mit reduzierter Redundanz.
- Der Erfolg der vollständigen Reparatur einzelner Storage-Volumes kann nicht verlässlich prognostiziert werden.
Wir haben folgende Schritte geplant:
- Fortführung des laufenden Repair- und Rebuild-Prozesses.
- Überwachung der Fortschritte auf Volume-Ebene.
- Wiederherstellung weiterer virtueller Maschinen, sobald die zugrunde liegenden Daten verfügbar sind.
- Bewertung der Integrität aller Storage-Volumes nach Abschluss der Synchronisation.
Ein weiterer Zwischenstand wird nach Auswertung des aktuellen Reparaturfortschritts im Laufe des Nachmittags veröffentlicht.