亚马逊云服务(AWS)正在调查其中东(阿联酋)地区发生的重大服务中断事件,起因是"不明物体"撞击了数据中心设施,引发火灾并导致电力系统关闭。
服务中断详情
3月1日的状态更新中,AWS表示:"大约在太平洋标准时间凌晨4:30,我们的一个可用区(mec1-az2)遭到物体撞击,产生火花并引发火灾。消防部门在扑灭火灾的过程中关闭了设施的电力供应和发电机。"
这次中断最初影响了ME-CENTRAL-1地区的单个可用区,导致EC2实例、EBS卷和RDS数据库无法使用,并使其他服务的错误率升高。AWS表示,在多个可用区冗余运行工作负载的客户未受影响。
后续更新确认,局部电力问题还影响了另一个可用区(mec1-az3),而剩余区域(mec1-az1)的客户报告了EC2 API错误增加和实例启动失败的问题。
截至发稿时,AWS表示无法在该地区启动新实例,但未受影响区域中的现有实例仍在正常运行。
受影响的AWS服务
在事件最严重时,AWS列出亚马逊弹性计算云(EC2)服务中断,包括Amazon DynamoDB、Amazon Cognito和Amazon关系数据库服务(RDS)在内的服务出现性能下降。
近60项额外服务被标记为受影响,包括AWS Lambda、Amazon简单存储服务(S3)、Amazon弹性Kubernetes服务(EKS)、Amazon Redshift和Amazon CloudWatch。
AWS建议客户尽可能使用备用可用区或故障转移到其他地区。公司表示电力恢复和完全修复需要数小时时间。
另外,AWS还报告了ME-SOUTH-1(巴林)地区的连接和API错误率问题,单个可用区的局部电力问题导致包括EC2和RDS在内的50多项服务出现错误增加。AWS表示正在将流量从受影响区域重新路由。
原因调查中
AWS尚未提供关于其状态更新中提及的"物体"的更多详细信息,也未将此次事件归因于任何外部行为者。公司将此次中断描述为物体撞击设施引发火灾后导致的局部电力问题。
这似乎是AWS自2025年10月以来最严重的服务中断,当时该公司位于北弗吉尼亚州的US-EAST-1地区发生运营问题,导致全球服务中断数小时。
这是一个正在发展的事件,数据中心知识网将在获得更多信息时更新此文章。
Q&A
Q1:AWS中东数据中心发生了什么事故?
A:AWS中东(阿联酋)地区的数据中心遭到不明物体撞击,引发火灾。消防部门为扑灭火灾关闭了设施的电力供应和发电机,导致大规模服务中断。事故发生在太平洋标准时间凌晨4:30左右。
Q2:这次AWS中断影响了哪些服务?
A:主要影响了Amazon EC2服务中断,Amazon DynamoDB、Amazon Cognito、Amazon RDS等服务性能下降。总共近60项服务受到影响,包括AWS Lambda、Amazon S3、Amazon EKS、Amazon Redshift和Amazon CloudWatch等。
Q3:用户如何应对AWS中东地区服务中断?
A:AWS建议客户尽可能使用备用可用区或故障转移到其他地区。在多个可用区冗余运行工作负载的客户未受影响,但无法在该地区启动新实例。AWS表示电力恢复和完全修复需要数小时时间。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。