10 月 20 日(星期一)下午,全球最大云服务提供商亚马逊云科技(AWS)突发大规模故障,新加坡区域自下午 2 时 30 分起出现错误率飙升、服务延迟加剧的情况,多款热门应用、游戏及媒体服务陷入瘫痪,直至当晚 7 时后才逐步恢复正常。

此次故障迅速引发用户投诉潮。故障监测平台 Down Detector 数据显示,短时间内涌入数千起故障报告,新加坡用户反馈尤为集中。下午 2 时 40 分起,设计工具 Canva、办公协作软件 Zoom、社交平台 Snapchat 与 Reddit 等日常工具相继 “罢工”;游戏领域更受重创,Pokemon Go、《部落战争》(Clash of Clans)、《堡垒之夜》(Fortnite)及青少年热门平台 Roblox 均显示系统错误,玩家被迫中断体验。
本地媒体服务也未能幸免。亚洲新闻台(CNA)在脸书发文证实,受 AWS 故障影响,新传媒旗下部分数码服务,包括网页与 App 端的直播及视频点播功能暂时失效,直至晚上 7 时 15 分才恢复正常。
这场故障的影响范围远超新加坡。美国加密货币交易平台 Coinbase、在线交易平台罗宾汉(Robinhood)均公开表示服务受波及;AI 初创公司 Perplexity 也通报网站稳定性因云服务中断受损。更严重的是,美国达美航空、联合航空等航司的 App 与官网无法正常运作,乘客在线值机、查询预订受阻,甚至有航班降落后因系统问题无法停靠廊桥,被迫在跑道等待。
AWS 在事发约四小时后发布进展通报,确认已解决域名系统(DNS)背后的根本问题,并指出故障源于内部监控系统异常引发的网络连锁反应,排除了网络攻击可能。至当晚 7 时 30 分,绝大多数服务恢复正常,但部分地区仍存在较高错误率,公司建议用户通过清除浏览器缓存解决残留问题。
作为全球云计算领域的龙头企业,AWS 为政府、企业及个人提供计算能力、数据存储等核心数码基础设施,其稳定性直接关系到全球数万家机构的运营。互联网性能监控公司估算,此次故障造成的全球财务损失可能高达数十亿美元。值得注意的是,AWS 与谷歌云、微软 Azure 构成全球云计算市场的 “三巨头”,此次大规模故障也再次引发行业对单一云服务依赖风险的讨论。截至发稿,AWS 尚未披露具体损失及后续预防措施。
























