Estamos totalmente para baixo para um subconjunto de clientes. Estamos a investigar o problema, e estamos a adiar uma missão.
- investigating
Estamos actualmente a investigar esta questão.
- investigating
Continuamos a investigar esta questão.
- investigating
O retrocesso parece ter resolvido completamente os erros. Estamos a monitorizar de perto, mas os utilizadores devem poder aceder novamente à Asana.
- monitoring
Foi implementada uma correção e estamos monitorando os resultados.
- resolved
Este incidente foi resolvido.
- postmortem
Incidente: Um sistema interno responsável por escalar automaticamente a capacidade do servidor de infraestrutura em um de nossos clusters de computação parou de substituir a capacidade que tinha sido ciclada durante a manutenção de rotina. Isto causou uma redução gradual da capacidade disponível durante várias horas. Uma posterior implantação foi ativada com capacidade insuficiente, fazendo com que todos os novos pedidos para que o cluster de computação falhar. Para mitigar o impacto, voltamos a uma revisão de lançamento anterior, que ainda tinha capacidade suficiente. Impacto: Durante aproximadamente 30 minutos, os clientes cujo tráfego foi tratado por este cluster de computação viram o tempo de inatividade total; outros clientes não foram afetados. Nenhum dado do cliente foi perdido. Avançando: Adicionamos monitoramento adicional para detectar este tipo de falha de escala de capacidade muito antes, e adicionamos salvaguardas para evitar que as implantações mudem o tráfego antes que seja confirmada capacidade saudável suficiente. Nossa métrica considera uma média ponderada de tempo de trabalho experimentado pelos usuários em cada data center. O número de minutos de inatividade apresentados reflete esta média ponderada.
Traduzido automaticamente da atualização oficial do incidente.