Zusammenfassung
- AWS zufolge können einige Ressourcen, die ausschließlich in Bahrain oder in einer betroffenen Availability Zone in den UAE gehostet wurden, nach konfliktbedingten Infrastrukturschäden nicht wiederhergestellt werden
- Die Schäden in Bahrain erstreckten sich über mehrere Availability Zones; als die Region nicht mehr verfügbar war, blieb den Kunden kein Wiederherstellungsweg innerhalb der Region
Die Fakten
Amazon Web Services teilte am 15. September mit, dass das Unternehmen den Zugriff auf einige Ressourcen und Daten nicht wiederherstellen könne, die ausschließlich in der AWS-Region Naher Osten (Bahrain) oder in einer betroffenen Availability Zone in den Vereinigten Arabischen Emiraten gehostet wurden.
Nach Angaben von AWS erstreckten sich die physischen Schäden in Bahrain über mehrere Availability Zones und überstiegen das Ausmaß, für das die regionalen und Multi-AZ-Dienste des Unternehmens ausgelegt waren. Nach früheren Schäden hatte das Unternehmen seinen Kunden geraten, kritische Workloads zu verlagern. Die meisten hatten dies getan, bevor eine weitere Störung dazu führte, dass die Region im April nicht mehr verfügbar war.
In den UAE bleiben Ressourcen und Daten, die ausschließlich in der betroffenen Availability Zone gespeichert waren, unzugänglich, während die Wiederherstellungsarbeiten in anderen Teilen der Region fortgesetzt werden. AWS zufolge haben die meisten betroffenen Kunden ihren Betrieb mithilfe von Sicherungskopien oder außerhalb der beschädigten Infrastruktur verfügbaren Ressourcen wieder aufgenommen.
Das Unternehmen plant in den kommenden Monaten weitere Aktualisierungen zur Wiederherstellung in den UAE und Anfang 2027 zu Bahrain.
Die Einordnung
Der Ausfall in Bahrain zeigt, wo die Redundanz innerhalb einer einzelnen Cloud-Region an ihre Grenzen stößt. Die Verteilung einer Anwendung auf mehrere Availability Zones kann vor vielen lokalen Ausfällen schützen, bietet jedoch keinen Wiederherstellungsweg, wenn Schäden mehrere Zonen betreffen und die Region selbst nicht mehr verfügbar ist.
Workloads, die einen solchen Ausfall überstehen müssen, benötigen bereits vor dem Ausfall nutzbare Kopien an anderer Stelle. Für eine sekundäre Region reicht freie Rechenkapazität allein nicht aus: Auch Daten, Zugangsdaten, Netzwerkkonfigurationen und andere Abhängigkeiten müssen verfügbar und getestet sein, damit die Anwendung neu gestartet werden kann.
Für die BTW-Leserschaft liegt der entscheidende praktische Unterschied zwischen Redundanz innerhalb einer Region und Wiederherstellung außerhalb dieser Region. Aus einer Multi-AZ-Architektur geht nicht hervor, ob ein Workload den Ausfall einer Region überstehen kann; das hängt davon ab, was bereits an anderer Stelle repliziert, gesichert und getestet wurde.
Worauf zu achten ist
Zu beobachten sind die nächsten Aktualisierungen von AWS zu Bahrain und den UAE, insbesondere die Fortschritte bei der Wiederherstellung regionaler Dienste. Kundenberichte nach dem Vorfall zu Wiederherstellungszeiten, außerhalb der Region gespeicherten Kopien und Abhängigkeiten, die den Failover verzögerten, werden die klarsten Belege dafür liefern, wie sich unterschiedliche Resilienzkonzepte bewährt haben, als eine gesamte Region nicht mehr verfügbar war.
Mitgliederbriefing
Detaillierter Profilkontext
Melden Sie sich mit der richtigen Mitgliedschaftsstufe an, um das vollständige Briefing und die Quellennotizen freizuschalten.
Nur für Strategic Circle
Strategic Circle
Offen für alle Leser. Schalten Sie Profil-Briefings nach Beitritt und Anmeldung frei.
Strategic Circle beitretenNur für Leadership Alliance
Leadership Alliance
Für qualifizierte Inhaber von IP-Assets und Management; melden Sie sich an, um Leadership-Alliance-Briefings freizuschalten.
Leadership Alliance beitreten

