Siamo completamente giù per un sottoinsieme di clienti. Stiamo indagando sul problema, e stiamo dispiegando.
- investigating
Stiamo attualmente indagando su questo problema.
- investigating
Stiamo continuando a indagare su questo problema.
- investigating
Il rollback sembra aver risolto completamente gli errori. Stiamo monitorando da vicino, ma gli utenti dovrebbero poter accedere di nuovo ad Asana.
- monitoring
Una soluzione è stata implementata e stiamo monitorando i risultati.
- resolved
Questo incidente è stato risolto.
- postmortem
Incidente: Un sistema interno responsabile della capacità del server di backend di scaling automatico in uno dei nostri cluster di calcolo ha smesso di sostituire la capacità che era stata ciclizzata durante la manutenzione di routine. Ciò ha provocato una riduzione graduale della capacità disponibile in diverse ore. Una distribuzione successiva è stata attivata con una capacità insufficiente, causando il fallimento di tutte le nuove richieste del cluster di calcolo. Per mitigare l'impatto, siamo tornati a una precedente revisione di rilascio, che aveva ancora una capacità sufficiente. Impatto: Per circa 30 minuti, i clienti il cui traffico è stato gestito da questo cluster di calcolo ha visto i tempi di inattività; altri clienti non sono stati colpiti. Nessun dato del cliente è stato perso. Avanzamento: Abbiamo aggiunto un ulteriore monitoraggio per rilevare questo tipo di guasto di aumento della capacità molto prima, e hanno aggiunto garanzie per evitare che le distribuzioni di spostamento del traffico prima che venga confermata una sufficiente capacità sana. La nostra metrica considera una media ponderata di uptime sperimentata dagli utenti in ogni data center. Il numero di minuti di inattività mostra riflette questa media ponderata.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.