• F5 于 9 月 6 日解决了 Distributed Cloud Global Log Receiver 服务降级问题;该事件自前一天起仅影响单个客户
  • 客户流量和 Distributed Cloud Console 服务始终保持正常运行,但 F5 未说明受影响的日志是延迟送达、丢失,还是后来得以恢复

事实

F5 于 9 月 6 日 07:54(UTC)解决了一起影响其 Distributed Cloud Global Log Receiver 的事件。自 9 月 5 日起,该公司一直在调查有关服务降级的报告。

F5 表示,影响仅限于单个客户,并已直接联系该客户。该公司还表示,客户流量未受影响,Distributed Cloud Console 服务始终保持正常运行。Global Log Receiver 用于接收日志数据,因此此次报告的问题涉及日志传输,而非底层应用流量。

一家第三方状态跟踪服务的记录显示,从发现问题到解决约间隔 12 小时 50 分钟。这段时间代表事件监测窗口,并不意味着客户流量在同样长的时间内不可用。

分析

对受影响的客户而言,问题并非应用流量无法通过 F5,而是无法收到用于观察和调查该流量相关情况的日志。应用可能仍然可用,而安全和运营团队所依赖的信息却受到影响。

因此,恢复不仅是让接收器重新上线。客户还需要了解事件期间生成的日志究竟发生了什么:是延迟到达、被丢弃,还是在服务恢复后才重新可用。F5 的状态更新没有提供这些细节,因此无法据此确认任何日志数据已永久丢失。

对 BTW 读者而言,如果只看流量可用性,就会漏掉这起事件。如果这些记录用于安全调查或运营检查,使用该服务的团队就需要单独监测日志传输。

后续关注

关注 F5 是否会说明事件期间生成的日志是延迟到达、被丢弃,还是在服务恢复后重新可用,以及是否会公布根本原因。若 Global Log Receiver 再次出现服务降级,也将有助于判断这是仅影响单个客户的孤立事件,还是反复发生的服务问题。