本文于 10 月 20 日太平洋夏令时下午 6:15 更新。
事件概述与恢复进展
10 月 19 日太平洋夏令时晚上 11:49 至 10 月 20 日凌晨 2:24,AWS 美国东部 1 区(US-EAST-1)服务错误率上升,波及 Amazon.com、亚马逊子公司及 AWS 支持运营。
经排查,故障系区域 DynamoDB 服务端点 DNS 解析问题所致。该问题于凌晨 2:24 前缓解,随后 AWS 服务逐步恢复,但部分内部子系统仍受影响。为保障全面恢复,我们暂时限制了 EC2 实例启动等操作。
截至 10 月 20 日中午 12:28,多数 AWS 客户及服务已显著恢复;下午 3:01,所有 AWS 服务恢复正常运营。目前正持续减轻剩余影响并逐步解除 EC2 新实例启动限流。
建议客户继续参考 AWS Health Dashboard 获取最新动态:https://health.aws.amazon.com/health/status
详细事后总结现已发布:https://aws.amazon.com/message/101925/

