我们完全没有客户 我们正在调查这个问题 并且正在撤回部署.
- investigating
我们目前正在调查这一问题.
- investigating
我们正在继续调查这一问题.
- investigating
倒转似乎已经完全解决了错误. 我们正在密切监控,但用户应该能够再次访问Asana.
- monitoring
一项措施已经执行,我们正在监测结果.
- resolved
这一事件已经得到解决.
- postmortem
事件:一个负责在我们的一个计算集群中自动缩放后端服务器容量的内部系统停止了更换在例行维护中被循环淘汰的能力. 这导致现有能力在几个小时内逐渐减少。 随后的部署因能力不足而启动,导致计算组的所有新请求都失败。 为了减轻这种影响,我们恢复了先前的版本修订,该版本仍然有足够的能力。 影响:在大约30分钟的时间里,由这个计算组处理流量的客户看到完全停机;其他客户没有受到影响。 没有丢失客户数据。 前进:我们增加了额外的监测,以便更早地发现这种能力扩能故障,并增加了保障措施,以防止部署人员在证实有足够的健康能力之前转移交通。 我们的度量衡考虑的是每个数据中心用户经历的升起时间加权平均值. 显示故障时间的分数反映了这一加权平均值。
自动翻译自官方事件更新。