• ChatGPT、Claude 和 Perplexity 等平台受到此次中断的影响。
  • 此事件凸显了互联网规模服务中集中式流量和机器人缓解系统的风险。

发生了什么:Cloudflare 遭受重大网络故障,导致全球服务中断

周二,Cloudflare承认其网络于 UTC 时间约 11:20 发生故障,导致其基础设施广泛出现 500 错误信息。该异常由“异常流量激增”引发,导致其中一个机器人缓解系统崩溃,进而引发多项服务的连锁故障。依赖 Cloudflare 网络的平台——估计处理约 20% 的全球网络流量——访问受到影响,包括ChatGPT、Claude、X(原 Twitter)以及各种在线游戏和零售服务。虽然 Cloudflare 确认问题在数小时后“已解决”,但警告称在继续监控网络期间,残余错误率可能持续存在。

另请阅读:Indosat、 Nokia & NVIDIA 在印度尼西亚开设 AI‑RAN 中心
另请阅读:Sparkle 推出量子安全工具,提供面向未来的加密

为何重要

此次中断鲜明地提醒我们,互联网的韧性依赖于少数基础设施提供商。Cloudflare 的全球网络中断暴露了一个事实:从 AI 助手到游戏服务等各种平台,都依赖于共同的流量管理系统。这一影响表明,单一的配置故障如何在数字生态系统中引发连锁反应,挑战关于冗余和去中心化的假设。对于依赖云边缘架构的企业和开发者而言,此事件引发了风险缓解方面的问题:架构是否应该超越主要提供商进行多样化,还是要求它们提供更高的透明度和应急方案?

此外,从监管和政策角度看,此事件可能促使政府和监管机构审查基础设施平台的市场主导地位及其在更广泛网络安全韧性中的作用。此次中断再次强调,在 AI、云和多服务网络平台时代,“隐藏”的基础设施与其所支撑的应用同样至关重要。