Resumen

  • Una revisión externa concluyó que Telstra no había tratado la sincronización de la red como una capacidad crítica y detectó deficiencias en la responsabilidad, la supervisión, los conocimientos especializados y los controles operativos
  • Telstra ha trasladado los servicios a su sistema estratégico de sincronización y está comprobando si existen deficiencias similares en otras funciones críticas de red

Los hechos

Telstra ha comenzado a revisar otras funciones críticas de red después de que una investigación externa sobre la interrupción de julio concluyera que la sincronización de la red no se había gestionado como una capacidad crítica. Technology Audit Partners confirmó que el sistema de sincronización causó la interrupción y detectó una responsabilidad poco clara, una supervisión integral limitada, una insuficiente especialización técnica y deficiencias en la gestión de cambios, el control de la configuración, la documentación y la gestión de incidentes, según Telstra.

Telstra afirmó que desde entonces ha migrado los servicios de los anteriores servidores NTP a su sistema estratégico de sincronización en los tres emplazamientos, ha añadido funciones de monitorización y alarma y ha ampliado las pruebas de laboratorio antes de introducir cambios en la red. Está en marcha un programa de corrección para toda la empresa, mientras el operador examina también otras funciones críticas de red para detectar deficiencias similares. La revisión se produce tras la interrupción de julio, que afectó a los servicios móviles y de línea fija en toda Australia, así como a otros servicios que dependían de la red de Telstra.

La evaluación

El fallo de julio fue técnico, pero la revisión apunta a un problema en la forma en que se gestionaba la función de sincronización antes de que se produjera la avería. Telstra no la había tratado como una capacidad crítica con una responsabilidad integral claramente definida y los controles que exigiría esa clasificación. Dado que la sincronización sustenta numerosos elementos de la red, las deficiencias en su mantenimiento o supervisión pueden pasar inadvertidas hasta que un cambio las pone de manifiesto.

El traslado de los servicios al sistema estratégico de sincronización aborda el entorno inmediato. La revisión más amplia es importante porque Telstra se pregunta ahora si otras funciones esenciales de red presentan deficiencias similares en materia de responsabilidad, documentación, monitorización o asistencia especializada. Este trabajo podría revelar problemas antes de que otro cambio rutinario los convierta en una interrupción.

Para los lectores de BTW, el cambio importante es el alcance. Telstra ya no considera lo ocurrido en julio únicamente como el fallo de un componente de sincronización; está utilizando el incidente para examinar cómo se clasifican, mantienen y asignan las responsabilidades de otras funciones críticas en toda la red.

Qué observar

Habrá que observar si Telstra identifica otras funciones de red incluidas en la revisión y comunica qué cambios realiza. La asignación de responsables, la actualización de los documentos de mantenimiento, la nueva monitorización, las pruebas de laboratorio y la finalización de las migraciones aportarían evidencia de que el programa está avanzando más allá del fallo original de sincronización. La detección de deficiencias similares en otros ámbitos mostraría hasta qué punto el problema se extendía más allá del incidente de julio.