お客様にはご満足いただけるサービスをご提供しております。 課題を調査し、展開を振り返ります.
- investigating
現在、この問題を調査中です.
- investigating
今後もこの問題について調査を続けてまいります.
- investigating
ロールバックは完全にエラーを解決しているようです。 密接に監視していますが、再びAsanaにアクセスできるはずです.
- monitoring
修正を実装し、結果を監視しています.
- resolved
この事件は解決しました.
- postmortem
インシデント:コンピュートクラスターの1つに自動的にバックエンドサーバー容量をスケーリングする責任の社内システムが、定期的なメンテナンス中にサイクルアウトされた容量を交換しなくなりました。 これにより、数時間以上使用可能な容量のグラデーション削減が発生しました。 その後のデプロイメントは、不十分な容量で有効化され、そのコンピュートクラスターが失敗するすべての新しいリクエストを引き起こしました。 インパクトを緩和するためには、以前のリリースリビジョンに戻り、まだ十分な容量を持ちました。 影響:約30分、このコンピュートクラスターが十分にダウンタイムを見たことでトラフィックを処理した顧客は、他の顧客は影響を受けませんでした。 顧客データが失われない 転送先: このタイプの容量のスケーリング障害をはるかに前に検出するために追加の監視を追加し、十分な健康容量が確認される前に、展開がトラフィックをシフトするのを防ぐための保護策を追加しました。 当社のメトリックは、各データセンターのユーザーによって経験される重みのある稼働時間の平均を考慮します。 ダウンタイムの分数がこの重み平均を反映しています。
公式のインシデント更新を自動翻訳しています。