亚马逊AWS云服务故障导致 “半个互联网”一度瘫痪

当地时间7月24日,美国亚马逊云服务(Amazon Web Services,简称AWS)发生区域性网络故障,导致数十个热门网站和在线服务无法正常访问,被外界形容为“半个互联网”陷入瘫痪,数百万用户受到影响。

根据网络故障监测网站 Downdetector 数据,问题大约于美国东部时间上午6时40分开始浮现,受影响的平台包括 Apple Pay、DoorDash、Reddit、Hulu 等多个知名网站和应用。

AWS随后证实,其位于美国俄勒冈州(Oregon)的 US-West-2 数据中心出现网络连接问题,并于美国东部时间上午9点后不久宣布故障已基本修复。

故障波及7项核心云服务

AWS最初于太平洋时间凌晨4时40分(美东时间上午7时40分)首次公开承认正在调查故障,不过实际中断时间可能早于官方公告。

此次事故最终影响了7项AWS核心服务,包括:

  • AWS Direct Connect(专线连接)
  • Global Accelerator(全球加速)
  • Internet Connectivity(互联网连接)
  • IoT Core(物联网服务)
  • Amazon API Gateway(API网关)
  • Amazon EC2(弹性云服务器)
  • Elastic Container Service(容器服务)

AWS是全球最大的云计算平台之一,为大量网站、移动应用及企业提供服务器和基础设施支持,因此即使只是单一区域发生故障,也可能导致大量看似毫无关联的网站同时瘫痪。

其中,Amazon EC2负责提供网站和应用运行所需的虚拟服务器,而API Gateway则负责不同网络服务之间的数据通信。

此外,Internet Connectivity和Direct Connect出现异常后,即使网站本身仍在正常运行,用户也可能无法连接到部署在受影响区域的服务。

多家公司发文致歉

AWS发言人向媒体证实,公司俄勒冈数据中心确实发生网络连接问题,不过相关故障已于上午9点后恢复。

在事故调查过程中,AWS将受影响服务数量由最初的5项扩大至7项,新增Global Accelerator和Elastic Container Service,显示此次故障涉及AWS网络基础设施的多个层面,而不仅仅是单一产品。

AWS将此次事件定级为**“Impacted(受到影响)”**,确认客户服务受到影响,但强调目前没有迹象显示数据丢失,也并非AWS全球网络全面瘫痪。

多家依赖AWS的平台随后在社交平台X发文向用户致歉。

其中一家公司表示:

“美国发生了大规模AWS故障,导致我们的服务受到影响。”

用户:互联网都坏了

大量用户也在社交媒体表达不满。

有人写道:

“AWS宕机了,几乎把整个互联网都弄瘫了,大家只能耐心等待。”

另一位网友则表示:

“这不是演习,AWS的US-West-2区域已经全面离线。”

游戏玩家同样受到影响。

多名PlayStation用户表示,当天上午正在游戏过程中突然被强制断线。

一位玩家写道:

“有人和我一样PlayStation连不上吗?刚准备开始直播,现在游戏根本进不去。”

用户报告集中在AWS多个区域

根据Downdetector统计:

  • 30% 的用户表示Amazon EC2出现问题;
  • 29% 的用户报告俄勒冈州US-West-2区域发生故障;
  • 23% 的用户则反映弗吉尼亚州北部(US-East-1)区域也出现异常。

目前AWS表示,故障已经恢复,但尚未公布此次事故的具体原因。此次事件再次凸显全球大量互联网服务高度依赖云计算基础设施,一旦大型云平台发生故障,便可能迅速引发连锁反应,影响数百万用户正常使用网络服务。