阿里云崩“出圈”了,什么情况?

在今年双十一落幕之际,阿里云发生全球性大故障,导致阿里全系产品服务异常,相关话题迅速登上热搜,经工程师紧急处理后服务恢复。 以下是具体情况分析:

2023年11月12日17:44起,阿里云产品控制台访问及API调用出现使用异常。此次故障并非某个可用区的问题,而是全球大故障,受影响地域广泛,涵盖北京、乌兰察布、青岛、杭州、印度孟买、美国硅谷等地区。受影响的产品众多,包括企业级分布式应用服务、消息队列MQ、微服务引擎、机器学习、图像搜索、智能推荐AlRec、智能开放搜索OpenSearch、云行情、数据总线DataHub等。

阿里旗下众多应用受到影响,淘宝、闲鱼、饿了么、天猫精灵等应用出现服务异常,微博上“阿里全系产品崩了”“淘宝又崩了”“闲鱼崩了”“钉钉崩了”“阿里云盘崩了”等话题相继登上热搜,广大网友反应强烈,有人调侃“钉钉有本事下周打卡给我崩一周”。

从企业用户层面看,目前我国上云企业累计超过380万家,且在2023云栖大会上阿里巴巴集团主席蔡崇信指出,目前中国80%的科技企业和一半的大模型公司都跑在阿里云上,此次故障波及面极广,不光是阿里云自有的业务区域受影响,对外服务的金融云、政务云也未能幸免。

阿里云崩“出圈”了,什么情况?

阿里云相关管理员在故障发生后及时发布公告,称工程师正在紧急介入排查。经工程师紧急处理,21:11阿里旗下淘宝、钉钉、阿里云盘等APP已全面恢复。

阿里云崩“出圈”了,什么情况?

在社交媒体上对此次阿里云故障原因讨论广泛。有人说这是P1级事故(最高P0),从事后暴露的信息看很可能已升级至P0级别,还有人戏称“估计是上一轮裁的人太多,一不小心把真正干活的人给开了”,也有人分析“阿里目前的技术水平饱受质疑,这一波故障,大概率是存储层的问题”。

不过多位业内专家表示,目前这些都只是猜测,具体原因要看阿里云公布。某业内人士称,出现这样级别的故障,一定是系统性的问题,对于生产核心业务系统要做多云级别的高可用。

阿里云崩“出圈”了,什么情况?

对阿里云的影响

此次重大事故对阿里云未来的市场开拓负面影响非常大。作为国内云计算的拓荒者,阿里云曾长时间处于领先位置,但经此一役,从用户角度,阿里云不再是高性能、高可用的代名词,在众多公有云服务商竞争的情况下,用户选择增多,阿里云面临更大竞争压力,对于在缓慢爬坡的阿里云来说,这无疑是当头一棒,其能否保住领先优势充满不确定性。

阿里云崩“出圈”了,什么情况?