Nous sommes complètement à la baisse pour un sous-ensemble de clients. Nous enquêtons sur la question, et nous repartons en déploiement.
- investigating
Nous enquêtons actuellement sur cette question.
- investigating
Nous continuons d'enquêter sur cette question.
- investigating
Le revers semble avoir complètement résolu les erreurs. Nous suivons de près, mais les utilisateurs devraient pouvoir accéder à nouveau à Asana.
- monitoring
Un correctif a été mis en place et nous suivons les résultats.
- resolved
Cet incident a été résolu.
- postmortem
Incident : Un système interne responsable de l'échelle automatique de la capacité du serveur de backend dans un de nos clusters de calcul a cessé de remplacer la capacité qui avait été cycleé pendant la maintenance courante. Cela a entraîné une réduction progressive de la capacité disponible sur plusieurs heures. Un déploiement ultérieur a été déclenché avec une capacité insuffisante, ce qui a entraîné l'échec de toutes les nouvelles demandes pour ce groupe de calcul. Pour atténuer l'impact, nous sommes revenus à une précédente révision de la version, qui avait encore une capacité suffisante. Impact: Pendant environ 30 minutes, les clients dont le trafic a été géré par ce cluster de calcul ont vu des temps d'arrêt complets; d'autres clients n'ont pas été touchés. Aucune donnée client n'a été perdue. Aller de l'avant: Nous avons ajouté une surveillance supplémentaire pour détecter ce type de défaillance d'échelle de capacité beaucoup plus tôt, et nous avons ajouté des mesures de protection pour empêcher les déploiements de déplacer le trafic avant que la capacité saine suffisante soit confirmée. Notre métrique considère une moyenne pondérée de temps d'arrêt vécu par les utilisateurs dans chaque centre de données. Le nombre de minutes d'arrêt indiqué reflète cette moyenne pondérée.
Traduit automatiquement depuis la mise à jour officielle de l'incident.