- AWS afirma que algunos recursos alojados únicamente en Baréin o en una Zona de disponibilidad afectada en los Emiratos Árabes Unidos no pueden restaurarse tras daños en la infraestructura relacionados con el conflicto
- Los daños en Baréin se extendieron por varias Zonas de disponibilidad y dejaron a los clientes sin una vía de recuperación dentro de la Región cuando esta dejó de estar disponible
El hecho
Amazon Web Services afirmó el 15 de septiembre que no puede restablecer el acceso a algunos recursos y datos alojados exclusivamente en su Región de Oriente Medio (Baréin) o en una Zona de disponibilidad afectada en los Emiratos Árabes Unidos. En Baréin, AWS afirmó que los daños físicos se extendieron por varias Zonas de disponibilidad y superaron la capacidad de resistencia prevista en el diseño de sus servicios regionales y multi-AZ.
La empresa había recomendado a los clientes que migraran las cargas de trabajo críticas tras daños anteriores, y la mayoría ya lo había hecho antes de que otra interrupción dejara la Región fuera de servicio en abril.
En los Emiratos Árabes Unidos, los recursos y datos almacenados exclusivamente en la Zona de disponibilidad afectada siguen siendo inaccesibles, mientras continúan las labores de recuperación en otras partes de la Región. AWS afirmó que la mayoría de los clientes afectados ha restablecido sus operaciones utilizando copias de seguridad o recursos disponibles fuera de la infraestructura dañada. La empresa prevé ofrecer nuevas actualizaciones sobre la recuperación en los Emiratos Árabes Unidos durante los próximos meses y sobre Baréin a principios de 2027.
La evaluación
La interrupción de Baréin muestra el límite de la redundancia dentro de una única Región de la nube. Distribuir una aplicación entre Zonas de disponibilidad puede protegerla frente a muchos fallos locales, pero no ofrece una vía de recuperación cuando los daños afectan a varias zonas y la propia Región deja de estar disponible.
Las cargas de trabajo que deban sobrevivir a ese fallo necesitan copias utilizables en otros lugares antes de que se produzca la interrupción. Una Región secundaria necesita algo más que capacidad de computación de reserva: los datos, las credenciales, la configuración de red y otras dependencias también deben estar disponibles y haberse probado para que la aplicación pueda reiniciarse.
Para los lectores de BTW, la distinción práctica está entre la redundancia dentro de una Región y la recuperación fuera de ella. Un diseño multi-AZ no indica si una carga de trabajo puede sobrevivir a la pérdida de una Región; eso depende de lo que ya se haya replicado, guardado en copias de seguridad y probado en otro lugar.
Qué hay que vigilar
Habrá que seguir las próximas actualizaciones de AWS sobre Baréin y los Emiratos Árabes Unidos para conocer los avances en el restablecimiento de los servicios regionales. Los informes de los clientes tras el incidente sobre los tiempos de recuperación, las copias fuera de la Región y las dependencias que retrasaron la conmutación por error aportarán la evidencia más clara de cómo funcionaron los distintos diseños de resiliencia cuando una Región completa dejó de estar disponible.
Informe para miembros
Contexto ampliado del perfil
Inicia sesión con el nivel de membresía adecuado para desbloquear el informe completo y las notas de las fuentes.
Solo para Strategic Circle
Strategic Circle
Abierto a todos los lectores. Desbloquea informes de perfil después de unirte e iniciar sesión.
Únete a Strategic CircleSolo para Leadership Alliance
Leadership Alliance
Para propietarios y directivos cualificados de activos de propiedad intelectual; inicia sesión para desbloquear los informes de la alianza.
Unirse a Leadership Alliance

