Estamos investigando relatórios de desempenho impactado para alguns serviços do GitHub.
resolved
Este incidente foi resolvido. Obrigado pela vossa paciência e compreensão ao abordarmos esta questão. Uma análise detalhada da causa raiz será compartilhada assim que estiver disponível.
Traduzido automaticamente da atualização oficial do incidente.
Disrupção com revisão de código co-piloto
Início 4 Gwengolo 2026 da 20:39 UTC · 1h 48m
OutageMajor incident
investigating
Estamos investigando relatórios de desempenho impactado para alguns serviços do GitHub.
investigating
Alguns usuários podem estar tendo falhas ao usar a revisão de código Copilot. Nós identificamos a causa raiz e estamos trabalhando em uma mitigação.
investigating
Estamos aplicando a mitigação e esperamos recuperação em aproximadamente 30 minutos.
monitoring
A degradação foi atenuada. Estamos a monitorizar para garantir a estabilidade.
resolved
Este incidente foi resolvido. Obrigado pela vossa paciência e compreensão ao abordarmos esta questão. Uma análise detalhada da causa raiz será compartilhada assim que estiver disponível.
Traduzido automaticamente da atualização oficial do incidente.
Incidente com Grok Copilot AI Model Provider
Início 3 Gwengolo 2026 da 14:17 UTC · 2h 54m
IssuesMinor incident
Componentes afetados
Copilot AI Model Providers
investigating
Estamos investigando relatórios de desempenho degradado para fornecedores de modelos de IA Copilot
investigating
Estamos experimentando disponibilidade degradada para o modelo Grok 4.6 em bate-papo copiloto, código VS e outros produtos Copilot. Isso é devido a um problema com um provedor de modelo upstream. Estamos a trabalhar com eles para resolver a questão.
investigating
O modelo Grok 4.5 também degrada a disponibilidade. Estamos a trabalhar com o fornecedor a montante para resolver o problema.
investigating
Os problemas com nosso fornecedor de modelos upstream foram resolvidos, e os modelos Grok estão novamente disponíveis em produtos Copilot e superfícies IDE.
Continuaremos a monitorizar para garantir a estabilidade, mas a mitigação está completa.
resolved
Este incidente foi resolvido. Obrigado pela vossa paciência e compreensão ao abordarmos esta questão. Uma análise detalhada da causa raiz será compartilhada assim que estiver disponível.
Traduzido automaticamente da atualização oficial do incidente.
Atrasos no processamento de commits
Início 1 Gwengolo 2026 da 15:00 UTC · 1h 1m
IssuesMinor incident
Componentes afetados
Pull Requests
investigating
Estamos investigando relatórios de desempenho degradado para Pedidos de Pull
investigating
As diferenças na visualização de RP podem estar estagnadas por vários minutos. Estamos a investigar e a aumentar os recursos.
investigating
O tempo para atualizar as diferenças de solicitação de pull melhorou para limiares normais.
resolved
Este incidente foi resolvido. Obrigado pela vossa paciência e compreensão ao abordarmos esta questão. Uma análise detalhada da causa raiz será compartilhada assim que estiver disponível.
Traduzido automaticamente da atualização oficial do incidente.
Taxa elevada de erros para os modelos OpenAI fornecidos pelo Copilot
Início 31 Eost 2026 da 09:15 UTC · 42m
IssuesMinor incident
Componentes afetados
Copilot AI Model Providers
investigating
Estamos investigando relatórios de desempenho degradado para fornecedores de modelos de IA Copilot
investigating
Copilot está experimentando uma maior taxa de erros para modelos OpenAI, incluindo gpt-5.2, gpt-5.3-codex, gpt-5.4, gpt-5.4, e a família de modelos gpt-5.6. Outros modelos não são impactados.
investigating
Um dos nossos fornecedores de modelos confirmou um incidente. Nós fornecemos-lhes detalhes para ajudar a identificar o problema. Estamos a começar a ver recuperação.
monitoring
A degradação que afeta os fornecedores de modelos de IA copiloto foi atenuada. Estamos a monitorizar para garantir a estabilidade.
monitoring
Os problemas com nosso provedor de modelos upstream foram resolvidos, e gpt-5.3-codex, gpt-5.4-mini, gpt-5.4-nano, gpt-5.5, e a família de modelos gpt-5.6 estão novamente disponíveis em produtos Copilot e superfícies IDE.
Continuaremos a monitorizar para garantir a estabilidade, mas a mitigação está completa.
resolved
Entre 08:37 e 09:41 UTC em 31 de agosto de 2026, GitHub Copilot experimentou degradação afetando vários modelos GPT, incluindo gpt-5.2, gpt-5.3, gpt-5.4, gpt-5.4-mini, gpt-5.4-nano e a família gpt-5.6 (Luna, Sol e Terra). Os usuários encontraram taxas de erro elevadas e interromperam as respostas de streaming. Outros modelos não foram afetados.
A degradação foi causada por um problema com um fornecedor de modelos a montante. Os engenheiros do GitHub detectaram o problema através do monitoramento automatizado, exibiram avisos de produtos para os modelos afetados e coordenaram com o provedor. O serviço voltou ao normal após o prestador ter implementado uma mitigação.
Traduzido automaticamente da atualização oficial do incidente.
Incidente com fornecedores de modelos de IA copiloto
Início 27 Eost 2026 da 10:04 UTC · 2h 8m
OutageCritical incident
Componentes afetados
Copilot AI Model Providers
investigating
Estamos investigando relatórios de disponibilidade degradada para fornecedores de modelos de IA Copilot
investigating
Estamos experimentando disponibilidade degradada para o modelo Kimi K3 em produtos Copilot e superfícies IDE. Isso é devido a um problema com um provedor de modelo upstream. Enquanto trabalhamos com eles para resolver o problema, recomendamos escolher outro modelo ou selecionar 'Auto' para continuar usando o Copilot.
investigating
Copilot AI Model Providers está experimentando desempenho degradado. Continuamos a investigar.
investigating
Os problemas com o nosso fornecedor de modelos upstream foram mitigados, e Kimi K3 está novamente disponível em produtos Copilot e superfícies IDE.
Continuaremos a acompanhar para garantir a estabilidade.
resolved
Em 27 de agosto de 2026, entre aproximadamente 09:20 e 12:14 UTC, o serviço Copilot experimentou uma degradação do modelo Kimi K3 devido a um problema com o nosso fornecedor upstream. Os usuários encontraram taxas de erro elevadas ao usar Kimi K3. Nenhum outro modelo foi impactado.
A questão foi resolvida por uma mitigação criada pelo nosso fornecedor. A GitHub está trabalhando com nosso provedor para melhorar ainda mais a resiliência do serviço para evitar incidentes semelhantes no futuro.
Traduzido automaticamente da atualização oficial do incidente.
Incidente com Ações e Pedidos de Puxe
Início 26 Eost 2026 da 22:56 UTC · 1h 30m
IssuesMinor incident
Componentes afetados
Pull RequestsActions
investigating
Estamos investigando relatórios de desempenho degradado para ações e pedidos de pull
investigating
Estamos investigando altos atrasos e timeouts que afetam as operações de fluxo de trabalho de ações desencadeadas por eventos de solicitação de puxar. 20% das corridas de ações atrasaram o início de mais de 5 minutos e até 4% das corridas não deflagraram. Estamos trabalhando ativamente em mitigação e forneceremos atualizações conforme aprendermos mais.
investigating
Aplicamos mitigação e estamos vendo recuperação no fluxo de trabalho Actions e bloqueamos mesclagens de requisição. Estamos a continuar a monitorizar a saúde sustentada do compromisso de fusão cria antes de resolver.
investigating
Confirmamos recuperação completa a partir das 23:58 UTC. O fluxo de trabalho de ações é executado e as mesclagens de requisição de pull estão funcionando normalmente. Vamos agora resolver o incidente enquanto continuamos a monitorar a saúde dos serviços.
monitoring
A degradação que afeta ações e pedidos de pull foi atenuada. Estamos a monitorizar para garantir a estabilidade.
resolved
Em 26 de agosto de 2026, das 21:55 UTC às 23:58 UTC, 2,6% das operações de fluxo de trabalho desencadeadas por eventos de pedido de pull foram adiadas, com o impacto aumentando até 25% em seu pico. Alguns usuários também experimentaram atrasos na geração de mesclagem-compromisso de requisição, informações de mesclabilidade e disponibilidade de botões de mesclagem. Ações e Pedidos de Puxe totalmente recuperados por 23:58 UTC; o incidente foi resolvido às 00:26 UTC após a operação normal ter sido confirmada.
Trabalhos de fundo que processam atualizações de requisição e geram commits de mesclagem foram impactados por timeouts atingindo uma única partição de dados git. Isso resultou em um backlog no processamento de merge-commit de request pull, atrasando os fluxos de trabalho do GitHub Actions e algumas informações de mesclabilidade.
Reduzimos a carga de trabalho, desviamos o tráfego da infraestrutura afetada e restauramos o componente de serviço afetado para um estado saudável. Juntos, essas ações ajudaram a drenar o atraso e restaurar as operações normais.
Estamos trabalhando para melhorar a detecção de saturação de recursos e para eliminar o impacto do cliente neste cenário, isolando o impacto, colocando limites melhores em repetições e fortalecendo a contrapressão para tornar nossos sistemas mais resilientes sob carga.
Traduzido automaticamente da atualização oficial do incidente.
Interrupção com o GitHub Billing
Início 26 Eost 2026 da 20:40 UTC · 4h 11m
IssuesMinor incident
investigating
Estamos investigando relatórios de desempenho impactado para alguns serviços do GitHub.
investigating
Atualmente estamos investigando erros crescentes com os serviços de faturamento. Os clientes podem observar cargas falhadas na página de faturamento de orçamento, e os usuários do Copilot CLI podem observar falhas iniciando ou continuando sessões.
investigating
Aplicámos uma mitigação para desbloquear o uso do Copilot e observamos recuperação para este impacto em particular. Continuamos a investigar e aplicar mitigação para a interrupção da página de faturamento enquanto monitoramos para garantir que o Copilot permaneça recuperado.
investigating
Continuamos a acompanhar a mitigação que temos solicitado para o rompimento da página de faturamento.
investigating
Nossa mitigação ainda se mantém enquanto continuamos a investigar para encontrar a causa raiz.
investigating
A nossa mitigação continua a manter-se, e as condições de serviço permanecem estáveis. Continuamos a investigar a carga de trabalho concentrada responsável pela questão e a preparar melhorias preventivas adicionais. Não identificamos uma mudança material no impacto do cliente desde a atualização anterior. Providenciaremos outra atualização à medida que a investigação avança.
investigating
Nenhuma mudança de material desde a atualização anterior. As condições de serviço permanecem estáveis após a mitigação, e não observamos nenhum impacto adicional no cliente. Estamos monitorando ativamente o serviço enquanto implementamos correções direcionadas para lidar com a causa raiz subjacente.
resolved
Em 26 de agosto de 2026, entre 20:40 UTC e 00:51 UTC em 27 de agosto, GitHub Billing experimentou desempenho degradado afetando páginas de faturamento e sessões de CLI Copiloto GitHub. Clientes afetados encontraram cargas ou falhas de página de orçamento falhadas ao iniciar ou continuar as sessões de CLI. Confirmamos esse impacto para um pequeno número de clientes (<1%).
Isso foi causado por uma carga de trabalho concentrada que criou atrasos no processamento em nossa camada de armazenamento de dados. As repetições automatizadas aumentaram a carga e prolongaram a degradação. Reduzimos o incidente reequilibrando o tráfego dentro de nossa infraestrutura.
Estamos melhorando o isolamento da carga de trabalho, o comportamento de repetição e a detecção de carga concentrada para reduzir a probabilidade de recorrência e encurtar nosso tempo para detectar e mitigar incidentes semelhantes.
Traduzido automaticamente da atualização oficial do incidente.
Incidente com ações
Início 26 Eost 2026 da 15:11 UTC · 2h 50m
OutageCritical incident
Componentes afetados
ActionsPages
investigating
Estamos investigando relatos de disponibilidade degradada para ações
investigating
Páginas estão experimentando desempenho degradado. Continuamos a investigar.
investigating
Identificámos um problema com uma base de dados primária e estamos a falhar numa réplica imediatamente
investigating
failover primário rapidamente melhorou o desempenho, mas não mitigou completamente, nós aceleramos o tráfego de entrada e estamos investigando as questões de Vitess a montante
investigating
Acreditamos que identificamos e abordamos a questão e estamos acelerando o tráfego lentamente para garantir que não se repita. Alguns clientes continuarão a ver atrasos à medida que aumentamos.
investigating
Páginas estão funcionando normalmente.
investigating
Continuamos a observar a recuperação e as filas atrasadas estão a arder. Alguns clientes continuarão a ver atrasos aumentados até que todo o trabalho de aceleração tenha sido concluído - esperamos que isso dentro da próxima hora.
investigating
Continuamos observando a recuperação e esperamos que as filas de entrada de ações voltem ao normal em <30min. O trabalho continuará a fluir através do sistema sujeito a limites de concorrência por cliente.
monitoring
A degradação que afecta as acções foi atenuada. Estamos a monitorizar para garantir a estabilidade.
monitoring
Todas as filas de entrada foram recuperadas e as ações estão funcionando como esperado. 3,7% dos trabalhos atribuídos a corredores maiores durante a fase inicial deste incidente estão presos à espera de atribuição de corredores. Eles serão cancelados dentro de uma hora. Outros corredores estão processando com sucesso todos os novos trabalhos.
resolved
Em 26 de agosto de 2026 de 15:02 a 15:45 UTC, os trabalhos de Actions não começaram. As seguintes 2 horas até 17:40 UTC, Actions runs foram adiadas a partir de mais de 5 minutos, quando o sistema pegou com carga atrasada. Esse impacto foi desencadeado pela saturação de escrita para o banco de dados primário utilizado pelos gatilhos de processamento de serviços para fluxos de trabalho Actions. O primário falhou, mas o sistema não se recuperou completamente. A saturação foi causada pelo aumento da carga de pico diária combinada com uma edição a montante na infraestrutura de processamento de eventos do GitHub, https://www.githubstatus.com/incidents/hcbtzksccj2f, que causou amplificação de ruptura de carga já alta. Os aceleradores que mais tarde foram usados para recuperar foram ajustados ~10% demasiado alto para proteger o sistema.
Às 15:45 UTC, estrangulamento combinado com o serviço reinicia recuperou a saúde central do serviço. Esses aceleradores foram gradualmente levantados entre 15:54 e 17:22 para restaurar o processamento completo do webhook para ações. Esta rampa foi deliberadamente lenta para garantir que não re-overwhelm o sistema dado o nosso estrangulamento original era agora conhecido por ser incorretamente definido. A fila de eventos webhook foi totalmente incendiada às 17:40 UTC.
3,7% dos trabalhos de maior porte, juntamente com alguns trabalhos auto-hospedados em escala, permaneceram presos na fila ou “esperando por corredor” estado. Implementamos uma mudança para empregos de força-revoke neste estado, e eles passaram a falhar às 18:40 UTC, cerca de 50 minutos após a mitigação do incidente. Liberar esses trabalhos também libertou a concorrência hospedada para trabalhos de maior alcance.
Os clientes que usavam grupos de concorrência tiveram maior impacto devido a um problema separado, onde corredores atribuídos a um subconjunto de tarefas desconectados antes da mitigação de força-revoke foi implantado, o que impediu a aquisição de corredores de progredir e deixou trabalhos em um estado de espera-for-runner. Isso foi resolvido às 01:00 UTC em 27 de agosto.
Algumas execuções desencadeadas durante a janela incidente 15:02-15:45 UTC encontrou um bug que os deixou mostrando como na fila mesmo após a recuperação do serviço. Na infra- estrutura, estas execuções já tinham falhado e irão automaticamente mover-se para o estado cancelado 24 horas após a criação. Como acompanhamento, nós estamos fixando a causa raiz deste estado em fila e melhorando nossa capacidade de bulk-cancelar corridas afetadas.
Diversas mudanças para melhorar a escalabilidade geral desta parte das Ações já estavam completas e a implantação na produção. O lançamento dessas alterações estará concluído nas próximas 24 horas. Outros trabalhos para melhorar a escala, resiliência e degradação mais graciosa dos fluxos de trabalho de ações estão em voo. Também estamos tomando um item de reparo para acelerar a limpeza de postos de trabalho em fila de espera ou em casos futuros semelhantes.
Traduzido automaticamente da atualização oficial do incidente.
Interrupção com alguns serviços do GitHub
Início 26 Eost 2026 da 15:09 UTC · 59m
IssuesMinor incident
investigating
Estamos investigando relatórios de desempenho impactado para alguns serviços do GitHub.
resolved
Por favor, consulte o resumo combinado neste incidente relacionado: https://www.githubstatus.com/incidents/y1t7p9fzrlj2
Traduzido automaticamente da atualização oficial do incidente.
Ações atrasam as partidas
Início 24 Eost 2026 da 13:33 UTC · 31m
IssuesMinor incident
Componentes afetados
Actions
investigating
Estamos investigando relatórios de desempenho degradado para ações
investigating
Falhas ao fazer fila e executar trabalhos de ações para um subconjunto de clientes estão agora resolvendo. Estamos a monitorizar a recuperação total.
monitoring
A degradação que afecta as acções foi atenuada. Estamos a monitorizar para garantir a estabilidade.
resolved
Em 24 de agosto de 2026, entre 13:33 UTC e 14:04 UTC, 3,8% das Actions executa atrasos de início experimentados ao longo de 5 minutos, com 1,25% das Actions falham totalmente.
O incidente foi causado por uma falha de disco em um nó hospedando uma das muitas instâncias de serviço responsáveis pelo processamento de eventos de atribuição de corredor. Tipicamente, pods em nós não saudáveis são removidos e substituídos automaticamente sem impacto. Neste caso, embora o nó estivesse severamente degradado e incapaz de realizar operações em disco, continuou enviando sinais saudáveis, impedindo que o sistema se deslocasse imediatamente para outro lugar. Durante esse período, os eventos atribuídos ao componente afetado acumularam-se até que um reequilíbrio automático redirecionou o processamento para componentes saudáveis às 13:54 UTC. O backlog da fila foi limpo às 14:00 UTC, e o processamento voltou ao normal às 14:04 UTC.
Para evitar uma recorrência, estamos melhorando a detecção e remediação automatizada para nós não saudáveis que não estão totalmente offline. Também estamos fortalecendo a resiliência de nível de aplicação, então os consumidores parados são automaticamente removidos rapidamente e seu trabalho reatribuído sem esperar que o nó afetado se recupere.
Traduzido automaticamente da atualização oficial do incidente.
Erros elevados no Fable 5 devido ao provedor upstream
Início 24 Eost 2026 da 07:12 UTC · 47m
OutageMajor incident
Componentes afetados
Copilot AI Model Providers
investigating
Estamos investigando relatórios de disponibilidade degradada para fornecedores de modelos de IA Copilot
investigating
Estamos experimentando disponibilidade degradada para o modelo Fable em produtos Copilot e superfícies IDE. Isso é devido a um problema com o provedor de modelo upstream. Enquanto trabalhamos com eles para resolver o problema, recomendamos escolher outro modelo ou selecionar 'Auto' para continuar usando o Copilot.
resolved
Em 24 de agosto de 2026, entre aproximadamente 06:35 e 07:25 UTC, o serviço Copilot experimentou uma degradação do modelo Claude Fable 5 devido a um problema com o nosso fornecedor upstream. Os usuários encontraram elevadas taxas de erro ao usar Claude Fable 5, com solicitações às vezes falhando no meio da resposta. Nenhum outro modelo foi impactado.
A questão foi resolvida por uma mitigação criada pelo nosso fornecedor. A GitHub está trabalhando com nosso provedor para melhorar ainda mais a resiliência do serviço para evitar incidentes semelhantes no futuro.
Traduzido automaticamente da atualização oficial do incidente.
Operações Git Degradadas sobre SSH
Início 21 Eost 2026 da 14:00 UTC · 7m
Pending
resolved
Em 21 de agosto de 2026, entre 14:00 e 14:07 UTC, dotcom As operações de git sobre SSH foram degradadas. Sucesso As operações do Git sobre o SSH caíram em mais de 95% durante a janela de impacto de pico, fazendo clonar, buscar ou empurrar o SSH efetivamente indisponível para a maioria dos usuários por aproximadamente quatro minutos. As operações Git sobre HTTPS não foram afetadas.
O incidente foi causado por um defeito de software em nossa infraestrutura de balanceamento de carga que foi desencadeada por uma mudança de configuração. O defeito só ocorreu quando as conexões passaram por múltiplas camadas de balanceadores de carga executando a nova configuração, o que significou que não foi detectado durante o teste canário.
Amenizamos o incidente ao retroceder a mudança de configuração.
Estamos adicionando cobertura de regressão para configurações de balanceador de carga multicamadas e melhorando o monitoramento e alerta para operações Git sobre SSH para reduzir nosso tempo para detecção e mitigação de problemas semelhantes no futuro.
Traduzido automaticamente da atualização oficial do incidente.
Falhas intermitentes na criação de tarefas de agentes
Início 20 Eost 2026 da 14:43 UTC · 9h 54m
OutageCritical incident
investigating
Estamos investigando relatórios de desempenho impactado para alguns serviços do GitHub.
investigating
Os usuários podem ter atrasos ao iniciar tarefas usando o Copilot Cloud Agent. Estamos investigando ativamente o problema e forneceremos atualizações conforme aprendermos mais.
investigating
Nós identificamos o componente problemático e estamos trabalhando para falhar em uma instância saudável. Atualizações adicionais serão fornecidas à medida que realizamos mitigação.
investigating
Estamos tendo problemas com as tarefas do Copilot Cloud Agent, resultando em tarefas recém-iniciadas que não exibem adequadamente o progresso contínuo. Essas tarefas do Copilot Cloud Agent ainda estão sendo concluídas corretamente, mas não têm visibilidade adequada. Estamos investigando ativamente o problema e forneceremos atualizações conforme aprendermos mais.
investigating
Os usuários estão passando por atrasos ao iniciar tarefas usando o Copilot Cloud Agent e não são capazes de ver o status dessas tarefas. As tarefas do Copilot Cloud Agent ainda estão sendo concluídas. Identificamos a causa da questão e estamos colocando mitigação em vigor para retornar o serviço aos níveis normais. Nós forneceremos outra atualização sobre o tempo de recuperação esperado em breve.
investigating
Estamos vendo sinais de recuperação para a visibilidade do status da tarefa do Copilot Cloud Agent, mas essa recuperação é mais lenta do que o esperado. Prosseguimos medidas adicionais de atenuação para acelerar a recuperação.
investigating
Estamos observando recuperação gradual para a visibilidade do status da tarefa do Copilot Cloud Agent, com a saída da sessão atrasada aproximadamente 1 hora. Tomamos medidas adicionais para acelerar a recuperação e continuamos a acompanhar o impacto.
investigating
Continuamos a observar a recuperação gradual da visibilidade do estado da tarefa do Copilot Cloud Agent, com a saída da sessão atrasada em aproximadamente 1 hora. Tomamos medidas adicionais para acelerar a recuperação e continuamos a acompanhar o impacto.
investigating
Continuamos a observar a recuperação gradual da visibilidade do estado da tarefa do Copilot Cloud Agent, com a saída da sessão atrasada em aproximadamente 1 hora. Tomámos medidas adicionais para acelerar a recuperação e esperamos que esta tenha efeitos na próxima hora.
investigating
Continuamos observando a recuperação gradual da visibilidade do status da tarefa do Copilot Cloud Agent. A saída da sessão continua a ser adiada por aproximadamente 1 hora quando nossas medidas de remediação entram em vigor.
investigating
Estamos vendo uma recuperação gradual na visibilidade do status da tarefa do Copilot Cloud Agent enquanto implementamos uma correção para a causa raiz. A saída da sessão permanece atrasada aproximadamente uma hora enquanto a remediação continua.
resolved
Entre 13:57 UTC em 20 e 00:37 UTC em 21 de agosto de 2026, alguns usuários do Copilot Cloud Agent tiveram atrasos de até 60 a 90 minutos para ver o status e os resultados de suas tarefas de agente. As próprias tarefas do agente continuaram a ser executadas e completadas durante esse tempo; apenas a visibilidade de seu status foi adiada.
A causa foi uma falha regional em um serviço de banco de dados em nuvem de terceiros que o Copilot usa para armazenar o status de tarefa do agente. Falhamos no banco de dados afetado em uma região saudável, adicionamos capacidade de processamento para trabalhar através do backlog e restauramos a operação normal uma vez que o serviço subjacente recuperado. Nenhum dado da tarefa foi perdido durante o incidente.
Para evitar a repetição de incidentes semelhantes, estamos removendo a configuração do banco de dados que nos tornou vulneráveis a esta falha regional e melhorando nossos procedimentos de failover banco de dados.
Traduzido automaticamente da atualização oficial do incidente.
Falhas intermitentes nas páginas de permissões relacionadas a grupos de corredores e corredores
Início 18 Eost 2026 da 05:02 UTC · 6h 28m
IssuesMinor incident
investigating
Estamos investigando relatórios de desempenho impactado para alguns serviços do GitHub.
monitoring
Estamos investigando relatos de falha em carregar grupos de corredores e permissões relacionadas a corredores para clientes usando corredores maiores.
monitoring
Identificamos a fonte de uma questão de comunicação entre os serviços de Ações e estamos trabalhando para a mitigação. Os clientes podem ter falhas na carga de grupos de corredores e problemas de permissões relacionadas com corredores ao usar Corredores Maiores.
monitoring
Aplicámos uma atenuação e estamos a ver sinais de recuperação. Continuaremos monitorando a recuperação e fornecendo atualizações.
resolved
Em 18 de agosto de 2026, entre 05:02 UTC e 11:30 UTC, os clientes não foram capazes de visualizar ou gerenciar Actions Runners e Runner Groups através do GitHub UI e API.
O problema foi causado por falhas nas solicitações de backend lendo dados de corredor e grupo corredor. As falhas foram causadas por um certificado de autenticação expirado exclusivo deste serviço. O certificado tinha sido rodado em KeyVault, mas um passo para habilitar o uso em tempo de execução tinha sido pausado para evitar a recorrência de incidentes anteriores desencadeados por esta operação.
O impacto foi atenuado por completar a habilitação do novo certificado no sistema de infraestrutura. Adicionámos um acompanhamento adicional a este e a outros certificados. Este serviço também está em processo de ser substituído como parte de nosso trabalho de disponibilidade e escala, trazendo este caminho de autenticação e gerenciamento secreto de acordo com padrões em todos os serviços GitHub.
Traduzido automaticamente da atualização oficial do incidente.
Incidente com ações
Início 18 Eost 2026 da 05:02 UTC · 6h 28m
OutageMajor incident
investigating
Estamos investigando relatórios de desempenho impactado para alguns serviços do GitHub.
resolved
Em 18 de agosto de 2026, entre 05:02 UTC e 11:30 UTC, os clientes foram incapazes de executar trabalhos em Actions Large Runners e não foram capazes de visualizar ou gerenciar Actions Runners e Runner Groups através do GitHub UI e API.
Esses problemas foram causados por falhas nas solicitações de backend resolvendo metadados essenciais para iniciar as execuções de fluxo de trabalho do Larger Runner e para ler os dados do grupo corredor e corredor. As falhas foram causadas por um certificado de autenticação expirado exclusivo deste serviço. O certificado tinha sido rodado em KeyVault, mas um passo para permitir o uso em tempo de execução tinha sido pausado para evitar a recorrência de incidentes anteriores que haviam sido desencadeados por esta operação.
Reduzimos as questões completando a habilitação do novo certificado no sistema de infraestrutura. Adicionámos um acompanhamento adicional a este e a outros certificados. O serviço relevante também está em processo de ser substituído como parte da nossa disponibilidade e trabalho de escala, trazendo este caminho de autenticação e gerenciamento secreto em linha com padrões em todos os serviços GitHub.
Traduzido automaticamente da atualização oficial do incidente.
Estamos investigando relatórios de desempenho impactado para alguns serviços do GitHub.
investigating
Os pedidos de API estão experimentando desempenho degradado. Continuamos a investigar.
investigating
As ações estão experimentando desempenho degradado. Continuamos a investigar.
investigating
Estamos vendo uma taxa de erro de aproximadamente 20% em inúmeras experiências, incluindo Pedidos de Puxe, Problemas e outros. As investigações estão em curso e vamos publicar actualizações à medida que estiverem disponíveis
investigating
O Pull Requests está a sofrer um desempenho degradado. Continuamos a investigar.
investigating
Estamos tendo altas taxas de erro em torno de 20% para experiências na web e tráfego api. Downloads de arquivos e downloads de conteúdo de repositório bruto estão tendo uma taxa de erro de aproximadamente 50%. As investigações estão em curso na causa raiz, e as atualizações continuarão a ser fornecidas enquanto investigamos.
investigating
Estamos tendo altas taxas de erro em torno de 20% para experiências na web e tráfego api. Downloads de arquivos e downloads de conteúdo de repositório bruto estão tendo uma taxa de erro de aproximadamente 50%. A autenticação SAML e OIDC, SCIM e Team Sync também são impactadas. As investigações estão em andamento e continuaremos a fornecer atualizações à medida que descobrirmos mais informações.
investigating
O co-piloto está a ter uma disponibilidade degradada. Continuamos a investigar.
investigating
Problemas estão passando por uma disponibilidade degradada. Continuamos a investigar.
investigating
O Pull Requests está a ter uma disponibilidade degradada. Continuamos a investigar.
investigating
As ações estão experimentando disponibilidade degradada. Continuamos a investigar.
investigating
Estamos tendo altas taxas de erro em torno de 20% para experiências na web e tráfego api. Downloads de arquivos e downloads de conteúdo de repositório bruto estão tendo uma taxa de erro de aproximadamente 50%. A autenticação SAML e OIDC, SCIM e Team Sync também são impactadas. Atualmente estamos realizando mitigação com base em nossa investigação até agora e estamos monitorando para melhoria.
investigating
Webhooks está experimentando disponibilidade degradada. Continuamos a investigar.
investigating
Páginas estão experimentando desempenho degradado. Continuamos a investigar.
investigating
Webhooks está experimentando desempenho degradado. Continuamos a investigar.
investigating
Estamos tendo altas taxas de erro em torno de 20% para experiências na web e tráfego api. Downloads de arquivos e downloads de conteúdo de repositório bruto estão tendo uma taxa de erro de aproximadamente 50%. A autenticação SAML e OIDC, SCIM e Team Sync também são impactadas. Atualmente estamos realizando mitigação e vamos postar atualizações à medida que avançamos.
investigating
Estamos tendo altas taxas de erro em torno de 20% para experiências na web e tráfego api. Downloads de arquivos e downloads de conteúdo de repositório bruto estão tendo uma taxa de erro de aproximadamente 50%. A autenticação SAML e OIDC, SCIM e Team Sync também são impactadas. Ainda estamos trabalhando para identificar a causa raiz e vamos continuar a postar atualizações como aprendemos mais e executar mitigação.
investigating
Identificamos o componente problemático e tomamos medidas corretivas. Há fortes sinais de recuperação, mas ainda estamos trabalhando para restaurar completamente o serviço, com taxas de erro ainda permanecem ligeiramente elevados. Publicaremos novas atualizações à medida que a recuperação continuar.
investigating
A degradação que afeta Pedidos de API, Ações, Operações Git, Problemas, Páginas, Pedidos Pull e Webhooks foi atenuada. Estamos a monitorizar para garantir a estabilidade.
investigating
Git Operations está experimentando desempenho degradado. Continuamos a investigar.
investigating
Identificámos o componente problemático e tomámos medidas corretivas, mas estamos a ver o impacto residual em numerosos serviços. Continuamos a aplicar mitigação adicional e a investigar o impacto restante.
investigating
As questões estão experimentando desempenho degradado. Continuamos a investigar.
investigating
Identificamos o componente problemático e tomamos medidas corretivas, mas estamos vendo impacto residual na forma de falhas de autenticação esporádicas. Continuamos a aplicar mitigação adicional e a investigar o impacto restante.
investigating
A degradação que afecta as Operações Git foi atenuada. Estamos a monitorizar para garantir a estabilidade.
investigating
Pedidos de API está experimentando disponibilidade degradada. Continuamos a investigar.
investigating
Os pedidos de API estão funcionando normalmente.
investigating
Continuamos a investigar falhas de autenticação esporádicas. Nós desactivamos parcialmente as tentativas de autenticação e assistimos a melhorias, e estamos a monitorizar o impacto antes de aplicarmos plenamente esta mitigação.
investigating
Continuamos a investigar falhas esporádicas que afetam a autenticação do Copilot em algumas aplicações. O uso do co-piloto através da aplicação GitHub CLI e GitHub não são afetados.
investigating
As questões estão a funcionar normalmente.
investigating
Continuamos a aplicar mitigação para resolver falhas de autenticação co-piloto esporádicas em algumas aplicações. Esperamos recuperação total nos próximos 30 minutos. O uso do co-piloto através da aplicação GitHub CLI e GitHub não são afetados.
resolved
Em 17 de agosto de 2026, de 13:28 a 21:15 UTC (7h 47m), GitHub.com experimentou elevados erros e latência em Problemas, Pedidos de Puxe, APIs, Ações e Copiloto. No pico, as taxas de erro web/API foram de aproximadamente 20%, enquanto os downloads de arquivo e conteúdo bruto atingiram aproximadamente 50%. A autenticação SAML/OIDC, SCIM e Team Sync também foram afetadas, bem como fluxos de trabalho Actions no GHEC com a Residência de Dados que dependem das definições de passo de fluxo de trabalho público hospedadas no GitHub.com. A maioria dos serviços recuperados até 16:36 UTC como nosso centro de dados dos EUA Central recuperado; Ações foi degradada até aproximadamente 18:03 UTC; e Copilot Token Service totalmente recuperado até 21:02.
Alguns dos tráfegos falhantes foram movidos do centro dos EUA para o norte da Virgínia, onde foi servido com sucesso até que a falha de rede no centro dos EUA foi depurada e resolvida. Respostas tardias a um único endpoint interno desencadearam um erro de repetição latente no VS Code que ampliou o tráfego em aproximadamente 10x e causou recuperação tardia para o Serviço de Token Copilot.
A causa imediata da falha foi saturação da rede em balanças de carga na US Central devido a um novo pico de tráfego. Originalmente isso foi causado por uma cápsula de sidecar Istio atingindo seus limites de concorrência e falhando em escala automática corretamente por causa de uma política mal configurada que assistiu ao serviço de host, mas não limites de sidecar. Uma falha em cascata para mais e, eventualmente, quatro nós HAProxy esgotaram seus limites de fluxo, degradando o caminho de autenticação do gateway e causando latência de autenticação generalizada e falhas. O problema foi agravado pela lógica de repetição otimista que sobrecarregava os balanceadores internos de carga. Pausando HAProxy nesses nós simultaneamente produziu recuperação ampla imediata.
A tempestade de repetição no norte da VA foi corrigida por 1) reduzir temporariamente a lógica de repetição de gateway com um PR e 2) bloquear as solicitações de token token token token para os balanceadores de carga com um 403, e, em seguida, gradualmente, aumentando o tráfego por local para permitir que as chamadas tenham sucesso.
Falhas de autenticação residual do Copilot continuaram porque o comportamento de repetição do cliente amplificava a carga: uma operação falida do token poderia gerar muitos pedidos extras e inserir um loop de repetição. O tráfego do serviço Token Copilot aumentou de um RPS normal de 7–9K para 70–100K RPS. Reduzindo a autenticação de gateway tenta e bloqueando respostas de repetição de gatilho estabilizado Serviço Token Copilot e recuperação concluída.
Fatores complicados que impediram a recuperação incluíram uma série de ataques de raspagem em terminais de carga de código.
Para evitar recorrência, nossas ações de acompanhamento incluem:
- Corrigindo políticas de auto-escalamento para dar conta de serviço-mesh sidecar concorrência e capacidade.
- Auditoria de solicitação do Istio, concorrência e limites de escala entre os serviços afetados.
- Revisão de limites de repetição e comportamento backoff entre gateways e clientes.
- Abordando o comportamento de repetição do Código VS que amplificou o tráfego de fichas Copilot.
- Melhorar o controlo da capacidade de equilíbrio de carga e as salvaguardas regionais de falhas.
Traduzido automaticamente da atualização oficial do incidente.
Disrupção com o GHEC Team Sync
Início 13 Eost 2026 da 16:21 UTC · 2h 6m
IssuesMinor incident
investigating
Estamos investigando relatórios de desempenho impactado para alguns serviços do GitHub.
investigating
O GHEC Team Sync está atualmente degradado para empresas com contas pessoais, causando atrasos na sincronização de equipes para grupos de IdP. Identificamos a causa dos atrasos e estamos a trabalhar numa mitigação. Nós forneceremos uma atualização sobre o nosso progresso às 20:00 UTC.
investigating
Implementámos uma mitigação. Neste momento, o GHEC Team Sync recuperou para empresas com contas pessoais. As equipas sincronizadas com grupos IdP voltaram à sua cadência normal.
resolved
Em 13 de agosto de 2026, das 15:31:21 UTC às 18:27:55 UTC, a sincronização da equipe da GitHub Enterprise Cloud foi degradada para empresas usando contas pessoais. As equipes de organização sofreram atrasos de até 3 a 13 horas (mediana de 8 horas) ao sincronizar com grupos de IdP, resultando em bolsas de acesso ou remoções atrasadas para usuários corporativos em 2,8% das equipes.
Uma mudança temporária introduzida para resolver um problema anterior devido ao aumento do uso deste recurso permaneceu ativa após a intenção de ser removida, causando atrasos na sincronização durante períodos de alto volume. Removemos a mudança temporária e fornecemos recursos adicionais para lidar com o volume aumentado.
Traduzido automaticamente da atualização oficial do incidente.
Incidente com Webhooks
Início 13 Eost 2026 da 14:45 UTC · 51m
IssuesMinor incident
Componentes afetados
IssuesPackagesPull RequestsWebhooksGit Operations
investigating
Estamos investigando relatórios de desempenho degradado para Webhooks
investigating
O Pull Requests está a sofrer um desempenho degradado. Continuamos a investigar.
investigating
As questões estão experimentando desempenho degradado. Continuamos a investigar.
investigating
Git Operations está experimentando desempenho degradado. Continuamos a investigar.
investigating
Os pacotes estão a sofrer um desempenho degradado. Continuamos a investigar.
investigating
Atualmente estamos investigando uma breve degradação do serviço para operações Git (especificamente empurra), problemas, pedidos de pull, registro de pacotes e webhooks entre 14:32 e 14:46 UTC. Identificamos a fonte da degradação e investigamos estratégias de mitigação para prevenir recorrência.
monitoring
A degradação que afeta Git Operations, Issues, Packages, Pull Requests e Webhooks foi atenuada. Estamos a monitorizar para garantir a estabilidade.
monitoring
Desactivamos temporariamente um trabalho de base que causou o impacto. Neste momento, o impacto é totalmente atenuado.
resolved
Entre 14:24 e 14:53 UTC em 13 de agosto de 2026, um trabalho de rotina para apagar uma organização oprimiu uma base de dados compartilhada chave, fazendo com que vários serviços GitHub retornassem rapidamente erros elevados e respostas mais lentas. O mais afetado foi a API de gerenciamento do webhook, com menor impacto nas operações do Git, requisições, problemas, pacotes, login e Copilot. Impacto limpo por conta própria em cerca de 14:53 UTC uma vez que o trabalho terminou; resolvemos o incidente em 15:36 UTC.
Usuários afetados podem ter experimentado um breve aumento de erros e respostas mais lentas, principalmente ao criar, listar ou atualizar webhooks, com impactos menores para puxar solicitações, problemas, pacotes e operações Git. As falhas atingiram cerca de 1% durante vários minutos em torno das 14:37 UTC.
Para evitar futuros incidentes, já enviamos uma atualização que ativa o caminho de exclusão mais seguro para as organizações, juntamente com os limites de exclusão nos bancos de dados. Com base nessas mudanças, estamos auditando todos os trabalhos de eliminação e limpeza que escrevem para bases de dados compartilhadas para evitar problemas semelhantes no futuro.
Traduzido automaticamente da atualização oficial do incidente.
Erros com o modelo Fable 5 no co-piloto
Início 13 Eost 2026 da 14:43 UTC · 1h 4m
IssuesMinor incident
Componentes afetados
Copilot AI Model Providers
investigating
Estamos investigando relatórios de desempenho degradado para fornecedores de modelos de IA Copilot
investigating
Estamos experimentando disponibilidade degradada para o modelo Fable 5 em produtos Copilot e superfícies IDE. Isso é devido a um problema com um provedor de modelo upstream. Enquanto trabalhamos com eles para resolver o problema, recomendamos escolher outro modelo ou selecionar 'Auto' para continuar usando o Copilot.
investigating
Estamos vendo uma recuperação modesta, mas ainda estamos experimentando uma disponibilidade degradada para o modelo Fable 5 em produtos Copilot e superfícies IDE. Isso é devido a um problema com um provedor de modelo upstream. Enquanto trabalhamos com eles para resolver o problema, recomendamos escolher outro modelo ou selecionar 'Auto' para continuar usando o Copilot.
investigating
Os problemas com o nosso fornecedor de modelos upstream foram resolvidos, e a Fable 5 está novamente disponível em produtos Copilot e superfícies IDE.
Continuaremos a monitorizar para garantir a estabilidade, mas a mitigação está completa.
resolved
Em 13 de agosto de 2026, entre cerca de 14:06 e 15:47 UTC, o serviço Copilot experimentou uma degradação do modelo Claude Fable 5 devido a um problema com o nosso fornecedor a montante. Os usuários encontraram elevadas taxas de erro, com pico de 43% e média de 12%. Usuários que selecionaram Auto ou modelos alternativos não foram afetados.
A questão foi resolvida por uma mitigação criada pelo nosso fornecedor. A GitHub está trabalhando com nosso provedor para melhorar ainda mais a resiliência do serviço para evitar incidentes semelhantes no futuro.
Traduzido automaticamente da atualização oficial do incidente.