Comenzó 4 de septiembre de 2026 a las 22:02 UTC · 21m
IssuesIncidente menor
investigating
Estamos investigando informes de rendimiento impactado para algunos servicios de GitHub.
resolved
Este incidente ha sido resuelto. Gracias por su paciencia y comprensión mientras abordamos este tema. Un análisis detallado de la causa raíz se compartirá tan pronto como esté disponible.
Traducido automáticamente desde la actualización oficial del incidente.
Disrupción con Copilot Code Review
Comenzó 4 de septiembre de 2026 a las 20:39 UTC · 1h 48m
OutageIncidente mayor
investigating
Estamos investigando informes de rendimiento impactado para algunos servicios de GitHub.
investigating
Algunos usuarios pueden estar experimentando fallos al utilizar la revisión del código Copilot. Hemos identificado la causa raíz y estamos trabajando en una mitigación.
investigating
Estamos aplicando la mitigación y esperamos la recuperación en aproximadamente 30 minutos.
monitoring
La degradación ha sido mitigada. Estamos monitoreando para asegurar la estabilidad.
resolved
Este incidente ha sido resuelto. Gracias por su paciencia y comprensión mientras abordamos este tema. Un análisis detallado de la causa raíz se compartirá tan pronto como esté disponible.
Traducido automáticamente desde la actualización oficial del incidente.
Incident with Grok Copilot AI Model Provider
Comenzó 3 de septiembre de 2026 a las 14:17 UTC · 2h 54m
IssuesIncidente menor
Componentes afectados
Copilot AI Model Providers
investigating
Estamos investigando informes de rendimiento degradado para los proveedores de modelos Copilot AI
investigating
Estamos experimentando disponibilidad degradada para el modelo Grok 4.6 en Copilot Chat, VS Code y otros productos Copilot. Esto se debe a un problema con un proveedor de modelos de corriente avanzada. Estamos trabajando con ellos para resolver el problema.
investigating
El modelo Grok 4.5 también ha degradado la disponibilidad. Estamos trabajando con el proveedor para resolver el problema.
investigating
Los problemas con nuestro proveedor de modelos se han resuelto, y los modelos Grok están disponibles una vez más en productos Copilot y superficies IDE.
Seguiremos vigilando para asegurar la estabilidad, pero la mitigación está completa.
resolved
Este incidente ha sido resuelto. Gracias por su paciencia y comprensión mientras abordamos este tema. Un análisis detallado de la causa raíz se compartirá tan pronto como esté disponible.
Traducido automáticamente desde la actualización oficial del incidente.
Delays in commit processing
Comenzó 1 de septiembre de 2026 a las 15:00 UTC · 1h 1m
IssuesIncidente menor
Componentes afectados
Pull Requests
investigating
Estamos investigando informes de rendimiento degradado para Pull Solicita
investigating
Diffs in the PR view may be stale for several minutes. Estamos investigando y escalando recursos.
investigating
El tiempo para actualizar la solicitud de eliminación de diffs ha mejorado a los umbrales normales.
resolved
Este incidente ha sido resuelto. Gracias por su paciencia y comprensión mientras abordamos este tema. Un análisis detallado de la causa raíz se compartirá tan pronto como esté disponible.
Traducido automáticamente desde la actualización oficial del incidente.
Elevated rate of errors for OpenAI models provided by Copilot
Comenzó 31 de agosto de 2026 a las 9:15 UTC · 42m
IssuesIncidente menor
Componentes afectados
Copilot AI Model Providers
investigating
Estamos investigando informes de rendimiento degradado para los proveedores de modelos Copilot AI
investigating
Copilot está experimentando una tasa más alta de errores para los modelos OpenAI, incluyendo gpt-5.2, gpt-5.3-codex, gpt-5.4, gpt-5.4, y la familia de modelos gpt-5.6. Otros modelos no están impactados.
investigating
Uno de nuestros proveedores de modelos ha confirmado un incidente al final. Les hemos proporcionado detalles para ayudar a identificar la cuestión. Estamos empezando a ver recuperación.
monitoring
Se ha mitigado la degradación que afecta a los proveedores de modelos Copilot AI. Estamos monitoreando para asegurar la estabilidad.
monitoring
Se han resuelto los problemas con nuestro proveedor de modelos aguas arriba, y el gpt-5.3-codex, gpt-5.4-mini, gpt-5.4-nano, gpt-5.5, y la familia de modelos gpt-5.6 están nuevamente disponibles en productos Copilot y superficies IDE.
Seguiremos vigilando para asegurar la estabilidad, pero la mitigación está completa.
resolved
Entre las 08:37 y las 09:41 UTC el 31 de agosto de 2026, GitHub Copilot experimentó degradación afectando varios modelos GPT, incluyendo gpt-5.2, gpt-5.3-codex, gpt-5.4, gpt-5.4-mini, gpt-5.4-nano, y la familia gpt-5.6 (Luna, Sol y Terra). Los usuarios encontraron tasas de error elevadas e interrumpieron las respuestas de streaming. Otros modelos no se vieron afectados.
The degradation was caused by an issue with an upstream model provider. Los ingenieros de GitHub detectaron el problema mediante el monitoreo automatizado, mostraron advertencias en el producto para los modelos afectados, y coordinaron con el proveedor. El servicio volvió a la normalidad después de que el proveedor implementara una mitigación.
Traducido automáticamente desde la actualización oficial del incidente.
Incident with Copilot AI Model Providers
Comenzó 27 de agosto de 2026 a las 10:04 UTC · 2h 8m
OutageIncidente crítico
Componentes afectados
Copilot AI Model Providers
investigating
Estamos investigando informes de disponibilidad degradada para los proveedores de modelos Copilot AI
investigating
Estamos experimentando disponibilidad degradada para el modelo Kimi K3 en productos Copilot y superficies IDE. Esto se debe a un problema con un proveedor de modelos de corriente avanzada. Mientras trabajamos con ellos para resolver el problema, recomendamos elegir otro modelo o seleccionar 'Auto' para continuar utilizando Copilot.
investigating
Copilot AI Model Providers está experimentando un rendimiento degradado. Continuamos investigando.
investigating
Los problemas con nuestro proveedor de modelos han sido mitigados, y Kimi K3 está de nuevo disponible en productos Copilot y superficies IDE.
Seguiremos vigilando para asegurar la estabilidad.
resolved
El 27 de agosto de 2026, entre aproximadamente 09:20 y 12:14 UTC, el servicio Copilot experimentó una degradación del modelo Kimi K3 debido a un problema con nuestro proveedor de corriente. Los usuarios encontraron altas tasas de error al utilizar Kimi K3. No se impactaron otros modelos.
El problema fue resuelto por una mitigación puesta en marcha por nuestro proveedor. GitHub está trabajando con nuestro proveedor para mejorar aún más la resiliencia del servicio para prevenir incidentes similares en el futuro.
Traducido automáticamente desde la actualización oficial del incidente.
Incident with Actions and Pull Solicita
Comenzó 26 de agosto de 2026 a las 22:56 UTC · 1h 30m
IssuesIncidente menor
Componentes afectados
Pull RequestsActions
investigating
Estamos investigando informes de rendimiento degradado para Acciones y Pull Solicita
investigating
Estamos investigando retrasos elevados y plazos que afectan a los flujos de trabajo de Acciones desencadenados por los eventos de solicitud de atracción. El 20% de las acciones se han retrasado los inicios de más de 5 minutos y hasta el 4% de las carreras no se activaron. Estamos trabajando activamente en la mitigación y proporcionaremos actualizaciones mientras aprendemos más.
investigating
Hemos aplicado atenuaciones y estamos viendo la recuperación en las carreras de flujo de trabajo de Acciones y bloqueado la solicitud de pull fusiones. Seguimos monitoreando por la salud sostenida de fusionar el compromiso crea antes de resolverlo.
investigating
Confirmamos la recuperación completa a partir de las 23:58 UTC. Los flujos de trabajo de acciones se ejecutan y las fusiones de solicitud de tirado funcionan normalmente. Ahora resolveremos el incidente mientras seguimos vigilando la salud de los servicios.
monitoring
Se ha mitigado la degradación que afecta a las Acciones y las Solicitudes de Tiro. Estamos monitoreando para asegurar la estabilidad.
resolved
El 26 de agosto de 2026, de 21:55 UTC a 23:58 UTC, el 2,6% de los flujos de trabajo activados por los eventos de solicitud de freno se retrasaron, con el impacto subiendo hasta el 25% en su pico. Algunos usuarios también experimentaron retrasos en la generación de merge-commit de la solicitud, información de fusión, y disponibilidad de merge-button. Actions and Pull Request fully recovered by 23:58 UTC; the incident was resolved at 00:26 UTC after normal operation was confirmed.
Trabajos de fondo que procesan actualizaciones de solicitud y generan compromisos de fusión fueron impactados por los timeouts alcanzando una sola partición de datos de git. Esto dio lugar a un atraso en el procesamiento de solicitud de tirada de fusión, retrasando los flujos de trabajo de GitHub Actions y alguna información de fusión.
Disminuimos la carga de trabajo, apartamos el tráfico de la infraestructura afectada y restauramos el componente de servicio afectado a un estado saludable. Juntos, estas acciones ayudaron a drenar el atraso y restaurar operaciones normales.
Estamos trabajando para mejorar la detección de saturación de recursos y para eliminar el impacto del cliente en este escenario aislando el impacto, colocando mejores límites en las retries, y fortaleciendo la retropresión para hacer nuestros sistemas más resistentes bajo carga.
Traducido automáticamente desde la actualización oficial del incidente.
Disrupción con GitHub Billing
Comenzó 26 de agosto de 2026 a las 20:40 UTC · 4h 11m
IssuesIncidente menor
investigating
Estamos investigando informes de rendimiento impactado para algunos servicios de GitHub.
investigating
Actualmente estamos investigando mayores errores con los servicios de facturación. Los clientes pueden observar cargas de la página de presupuesto de facturación fallidas, y los usuarios del Copilot CLI pueden observar fallos iniciando o continuando sesiones.
investigating
Hemos aplicado una mitigación para desbloquear el uso de Copilot y hemos observado recuperación para este impacto particular. Continuamos investigando y aplicando atenuaciones para la interrupción de la página de facturación mientras monitorizamos para asegurar que Copilot permanezca recuperado.
investigating
Continuamos monitoreando la mitigación que hemos aplicado para la interrupción de la página de facturación.
investigating
Nuestra mitigación sigue sosteniendo mientras seguimos investigando para encontrar la causa raíz.
investigating
Nuestra mitigación continúa manteniendo, y las condiciones de servicio permanecen estables. Seguimos investigando el volumen de trabajo concentrado responsable de la cuestión y estamos preparando mejoras preventivas adicionales. No hemos identificado un cambio material en el impacto del cliente desde la actualización anterior. Proporcionaremos otra actualización a medida que avance la investigación.
investigating
No hay cambios materiales desde la actualización anterior. Las condiciones de servicio siguen estables tras la mitigación, y no hemos observado ningún impacto adicional del cliente. Estamos monitoreando activamente el servicio mientras implementamos soluciones específicas para abordar la causa raíz subyacente.
resolved
El 26 de agosto de 2026, entre 20:40 UTC y 00:51 UTC el 27 de agosto, GitHub Billing experimentó un rendimiento degradado que afecta a las páginas presupuestarias de facturación y las sesiones de GitHub Copilot CLI. Los clientes afectados encontraron cargas o fracasos de la página presupuestaria fallidos al iniciar o continuar las sesiones de CLI. Confirmamos este impacto para un pequeño número de clientes (asignado1%).
Esto fue causado por una carga de trabajo concentrada que creó retrasos de procesamiento en nuestra capa de almacenamiento de datos. Los registros automatizados aumentaron la carga y prolongaron la degradación. Mitigamos el incidente reequilibrando el tráfico dentro de nuestra infraestructura.
Estamos mejorando el aislamiento de carga de trabajo, el comportamiento de reingreso y la detección de carga concentrada para reducir la probabilidad de recurrencia y acortar nuestro tiempo para detectar y mitigar incidentes similares.
Traducido automáticamente desde la actualización oficial del incidente.
Incident with Actions
Comenzó 26 de agosto de 2026 a las 15:11 UTC · 2h 50m
OutageIncidente crítico
Componentes afectados
ActionsPages
investigating
Estamos investigando informes de disponibilidad degradada para Acciones
investigating
Las páginas están experimentando un rendimiento degradado. Continuamos investigando.
investigating
Hemos identificado un problema con una base de datos primaria y estamos fallando en una réplica inmediatamente
investigating
falla primaria brevemente mejoró el rendimiento, pero no mitigó completamente, hemos acelerado el tráfico de entrada y estamos investigando los problemas de Vitess
investigating
Creemos que hemos identificado y abordado el problema y estamos devolviendo el tráfico lentamente para asegurar que no se repita. Algunos clientes continuarán viendo retrasos mientras avanzamos.
investigating
Las páginas funcionan normalmente.
investigating
Continuamos observando la recuperación y las colas retrasadas están ardiendo. Algunos clientes continuarán viendo mayores retrasos hasta que se haya completado todo el trabajo acelerado - esperamos esto dentro de la hora siguiente.
investigating
Continuamos observando la recuperación y esperamos que las acciones inbound colas vuelvan a la normalidad en 030min. El trabajo seguirá fluyendo a través del sistema sujeto a límites de concurrencia por cliente.
monitoring
Se ha mitigado la degradación que afecta a las medidas. Estamos monitoreando para asegurar la estabilidad.
monitoring
Todas las colas de entrada se han recuperado y las Acciones están operando como se espera. El 3,7% de los trabajos asignados a corredores más grandes durante la primera etapa de este incidente están atascados esperando la asignación de corredores. Esas serán canceladas dentro de la hora. Otros corredores están procesando con éxito todos los nuevos empleos.
resolved
El 26 de agosto de 2026 de 15:02 a 15:45 UTC, los trabajos de Acciones no comenzaron. Las siguientes 2 horas hasta las 17:40 UTC, Acciones se retrasaron a partir de más de 5 minutos cuando el sistema se puso al día con carga retardada. Este impacto fue provocado por la saturación de escritos a la base de datos primaria utilizada por los desencadenantes de procesamiento de servicios para los flujos de trabajo de Acciones. La primaria no se superó, pero el sistema no se recuperó completamente. The saturation was caused by growing daily peak load combined with an upstream issue in GitHub’s event processing infrastructure, https://www.githubstatus.com/incidents/hcbtzksccj2f, which caused blast amplification of already-high load. Los aceleradores de aguas abajo que se utilizaron posteriormente para recuperar se establecieron ~10% demasiado alto para proteger el sistema.
A las 15:45 UTC, la lucha combinada con reiniciamientos de servicio recuperó la salud básica del servicio. Estos aceleradores se elevaron gradualmente entre 15:54 y 17:22 para restaurar el procesamiento completo de Webhook para las Acciones corre. Esta rampa fue deliberadamente lenta para asegurarnos de que no reelaboramos el sistema dado nuestro tronquizo original ahora se sabe que está incorrectamente establecido. La cola de los eventos webhook se quemó completamente a las 17:40 UTC.
El 3,7% de los puestos de trabajo más grandes, junto con algunos puestos de trabajo autoanfitriona de escala, permanecieron atrapados en el estado desconcertado o “esperando por corredor”. Desplegamos un cambio en los empleos de revocación de la fuerza en este estado, y pasaron a fallar a las 18:40 UTC, unos 50 minutos después de la mitigación de incidentes. La liberación de estos trabajos también liberó la concurrencia alojada para trabajos más grandes.
Los clientes que utilizan grupos de concurrencia vieron un mayor impacto debido a un problema separado en el que los corredores asignados a un subconjunto de puestos de trabajo desconectados antes de que se desplegara la mitigación de la revocación de la fuerza, lo que impidió que la adquisición de corredores progresara y dejara puestos de trabajo en un estado de espera por corredor. Esto se resolvió a las 01:00 UTC el 27 de agosto.
Algunas carreras activadas durante la ventana de incidencias de 15:02-15:45 UTC encontraron un error que los dejó mostrando como apagado incluso después de la recuperación del servicio. En el backend, estas carreras ya habían fallado y se moverán automáticamente para cancelar el estado 24 horas después de la creación. Como seguimiento, estamos arreglando la causa raíz de este estado desconcertado y mejorando nuestra capacidad para las carreras afectadas por el voltaje.
Varios cambios para mejorar la escalabilidad general de esta parte de las Acciones ya estaban completos e implementados a la producción. El despliegue de esos cambios se completará en las próximas 24 horas. Se están realizando nuevos trabajos para mejorar la escala, la resiliencia y la degradación más agraciada de los flujos de trabajo de Acciones. También estamos tomando un artículo de reparación para acelerar la limpieza de puestos de trabajo en espera o en casos similares futuros.
Traducido automáticamente desde la actualización oficial del incidente.
Disrupción con algunos servicios de GitHub
Comenzó 26 de agosto de 2026 a las 15:09 UTC · 59m
IssuesIncidente menor
investigating
Estamos investigando informes de rendimiento impactado para algunos servicios de GitHub.
resolved
Sírvanse consultar el resumen combinado de este incidente conexo: https://www.githubstatus.com/incidents/y1t7p9fzrlj2
Traducido automáticamente desde la actualización oficial del incidente.
Las acciones retrasan las carreras iniciales
Comenzó 24 de agosto de 2026 a las 13:33 UTC · 31m
IssuesIncidente menor
Componentes afectados
Actions
investigating
Estamos investigando informes de resultados degradados para las Acciones
investigating
Los fracasos mientras buscan y ejecutan trabajos de Acciones para un subconjunto de clientes se están resolviendo. Estamos monitoreando para la recuperación completa.
monitoring
Se ha mitigado la degradación que afecta a las medidas. Estamos monitoreando para asegurar la estabilidad.
resolved
El 24 de agosto de 2026, entre 13:33 UTC y 14:04 UTC, el 3,8% de Acciones corre retrasos de inicio experimentados más de 5 minutos con el 1,25% de las Acciones se corre sin salida.
El incidente fue causado por un fallo de disco en un nodo que alberga una de las muchas instancias de servicio responsables de procesar eventos de asignación de corredores. Típicamente, las cápsulas en los nodos no saludables se eliminan y se reemplazan automáticamente sin impacto. En este caso, aunque el nodo fue severamente degradado y no pudo realizar operaciones de disco, continuó enviando señales saludables, impidiendo que el sistema moviera inmediatamente su trabajo en otro lugar. Durante este período, los eventos asignados al componente afectado se acumularon hasta que un reequilibrio automático redireccionó el procesamiento a componentes sanos a las 13:54 UTC. El atraso de la cola fue despejado a las 14:00 UTC, y el procesamiento devuelto a la normalidad por 14:04 UTC.
Para evitar una recurrencia, estamos mejorando la detección y la remediación automatizada para nodos no saludables que no están completamente fuera de línea. También estamos fortaleciendo la resiliencia de nivel de aplicación, por lo que los consumidores estancados se eliminan automáticamente rápidamente y su trabajo reasignado sin esperar que el nodo afectado se recupere.
Traducido automáticamente desde la actualización oficial del incidente.
Errores elevados en Fable 5 debido al proveedor de corriente
Comenzó 24 de agosto de 2026 a las 7:12 UTC · 47m
OutageIncidente mayor
Componentes afectados
Copilot AI Model Providers
investigating
Estamos investigando informes de disponibilidad degradada para los proveedores de modelos Copilot AI
investigating
Estamos experimentando disponibilidad degradada para el modelo Fable en productos Copilot y superficies IDE. Esto se debe a un problema con el proveedor de modelos de corriente avanzada. Mientras trabajamos con ellos para resolver el problema, recomendamos elegir otro modelo o seleccionar 'Auto' para continuar utilizando Copilot.
resolved
El 24 de agosto de 2026, entre aproximadamente 06:35 y 07:25 UTC, el servicio Copilot experimentó una degradación del modelo Claude Fable 5 debido a un problema con nuestro proveedor de corriente. Los usuarios encontraron altas tasas de error al utilizar Claude Fable 5, con solicitudes que a veces fallan en la respuesta media. No se impactaron otros modelos.
El problema fue resuelto por una mitigación puesta en marcha por nuestro proveedor. GitHub está trabajando con nuestro proveedor para mejorar aún más la resiliencia del servicio para prevenir incidentes similares en el futuro.
Traducido automáticamente desde la actualización oficial del incidente.
Operaciones de Git degradadas sobre SSH
Comenzó 21 de agosto de 2026 a las 14:00 UTC · 7m
Pending
resolved
El 21 de agosto de 2026, entre 14:00 y 14:07 UTC, dotcom Las operaciones de Git sobre SSH fueron degradadas. Éxito Las operaciones de Git sobre SSH cayeron en más del 95% durante la ventana de impacto pico, haciendo clon, capturar o empujar sobre SSH efectivamente no disponible a la mayoría de los usuarios durante aproximadamente cuatro minutos. Las operaciones de Git sobre HTTPS no se vieron afectadas.
El incidente fue causado por un defecto de software en nuestra infraestructura de reducción de carga que fue desencadenada por un cambio de configuración. El defecto sólo ocurrió cuando las conexiones pasaron a través de múltiples capas de balanceadores de carga que ejecutan la nueva configuración, lo que significa que no fue detectado durante pruebas canarias.
Mitigamos el incidente revolviendo el cambio de configuración.
Estamos agregando cobertura de regresión para configuraciones multicapa de balanceador de carga y mejorando el monitoreo y alerta para las operaciones de Git sobre SSH para reducir nuestro tiempo para la detección y mitigación de problemas similares en el futuro.
Traducido automáticamente desde la actualización oficial del incidente.
Fallos intermitentes creando tareas de agente
Comenzó 20 de agosto de 2026 a las 14:43 UTC · 9h 54m
OutageIncidente crítico
investigating
Estamos investigando informes de rendimiento impactado para algunos servicios de GitHub.
investigating
Los usuarios pueden experimentar retrasos al iniciar tareas utilizando Copilot Cloud Agent. Estamos investigando activamente el tema y proporcionaremos actualizaciones mientras aprendemos más.
investigating
Hemos identificado el componente problemático y estamos trabajando para fracasar en una instancia sana. Se proporcionarán nuevas actualizaciones mientras realizamos las mitigacións.
investigating
Estamos experimentando problemas con las tareas de Copilot Cloud Agent, resultando en tareas recién iniciadas que no muestran adecuadamente el progreso en curso. Estas tareas de Copilot Cloud Agent aún están siendo completadas correctamente pero no tienen la debida visibilidad. Estamos investigando activamente el tema y proporcionaremos actualizaciones mientras aprendemos más.
investigating
Los usuarios están experimentando retrasos al iniciar tareas utilizando Copilot Cloud Agent y no pueden ver el estado de estas tareas. Las tareas de Copilot Cloud Agent aún están siendo completadas. Hemos identificado la causa de la cuestión y estamos poniendo en marcha mitigacións para devolver el servicio a niveles normales. Proporcionaremos otra actualización sobre el tiempo de recuperación esperado en breve.
investigating
Estamos viendo signos de recuperación para la visibilidad del estado de tarea de Copilot Cloud Agent, pero esta recuperación es más lenta de lo previsto. Estamos adoptando medidas adicionales de mitigación para acelerar la recuperación.
investigating
Estamos observando la recuperación gradual para la visibilidad del estado de tarea de Copilot Cloud Agent, con la salida de sesión retrasada aproximadamente 1 hora. Hemos adoptado medidas adicionales para acelerar la recuperación y seguimos vigilando el impacto.
investigating
Seguimos observando la recuperación gradual para la visibilidad del estado de tarea de Copilot Cloud Agent, con la producción de sesión retrasada aproximadamente 1 hora. Hemos adoptado medidas adicionales para acelerar la recuperación y seguimos vigilando el impacto.
investigating
Seguimos observando la recuperación gradual para la visibilidad del estado de tarea de Copilot Cloud Agent, con la producción de sesión retrasada aproximadamente 1 hora. Hemos tomado medidas adicionales para acelerar la recuperación y esperamos que esto surta efecto en la próxima hora.
investigating
Continuamos observando la recuperación gradual para la visibilidad del estado de tarea de Copilot Cloud Agent. La producción de la sesión sigue retrasada aproximadamente 1 hora a medida que nuestras medidas de rehabilitación surtan efecto.
investigating
Estamos viendo la recuperación gradual en la visibilidad del estado de tarea de Copilot Cloud Agent a medida que implementamos una solución para la causa raíz. La producción de la sesión sigue retrasada aproximadamente una hora mientras continúa la rehabilitación.
resolved
Entre 13:57 UTC los días 20 y 00:37 UTC el 21 de agosto de 2026, algunos usuarios del Copilot Cloud Agent experimentaron retrasos de hasta 60 a 90 minutos para ver el estado y los resultados de sus tareas de agente. Las propias tareas del agente continuaron funcionando y completando durante este tiempo; sólo se retrasó la visibilidad de su estado.
La causa fue un outage regional en un servicio de base de datos de nube de terceros que Copilot utiliza para almacenar el estado de tarea de agente. Hemos fallado sobre la base de datos afectada en una región sana, hemos añadido capacidad de procesamiento para trabajar a través del atraso y restaurado el funcionamiento normal una vez que el servicio subyacente se recuperó. No se perdieron datos de tareas durante el incidente.
Para evitar la repetición de incidentes similares, estamos eliminando la configuración de la base de datos que nos hizo vulnerables a esta salida regional y mejorando nuestros procedimientos de falla de la base de datos.
Traducido automáticamente desde la actualización oficial del incidente.
Fallos intermitentes en el grupo de corredores y páginas de permisos relacionados con corredores
Comenzó 18 de agosto de 2026 a las 5:02 UTC · 6h 28m
IssuesIncidente menor
investigating
Estamos investigando informes de rendimiento impactado para algunos servicios de GitHub.
monitoring
Estamos investigando informes de no cargar grupos de corredores y permisos relacionados con corredores para clientes que utilizan corredores más grandes.
monitoring
Hemos identificado la fuente de una cuestión de comunicación entre los servicios de Acciones y estamos trabajando para la mitigación. Los clientes pueden experimentar fallos en la carga de grupos de corredores y problemas de permisos relacionados con corredores al utilizar Bigr Runners.
monitoring
Hemos aplicado una mitigación y estamos viendo señales de recuperación. Seguiremos monitoreando la recuperación y proporcionando actualizaciones.
resolved
El 18 de agosto de 2026, entre las 05:02 UTC y las 11:30 UTC, los clientes no pudieron ver o gestionar Actions Runners y Runner Groups a través de la interfaz de usuario GitHub y API.
El problema fue causado por fracasos en solicitudes de backend lectura de datos de corredores y grupos de corredores. Los fallos fueron causados por un certificado de autenticación caducado único a este servicio. El certificado había sido rotado en KeyVault, pero se había detenido un paso para permitir el uso en tiempo de ejecución para evitar la repetición de incidentes anteriores desencadenados por esta operación.
El impacto se mitigó completando la habilitación del nuevo certificado en el sistema de backend. Hemos añadido monitoreo adicional a este y otros certificados. Este servicio también está en proceso de ser reemplazado como parte de nuestro trabajo de disponibilidad y escala, trayendo esta ruta de autenticación y gestión secreta en consonancia con patrones en todos los servicios de GitHub.
Traducido automáticamente desde la actualización oficial del incidente.
Incident with Actions
Comenzó 18 de agosto de 2026 a las 5:02 UTC · 6h 28m
OutageIncidente mayor
investigating
Estamos investigando informes de rendimiento impactado para algunos servicios de GitHub.
resolved
El 18 de agosto de 2026, entre las 05:02 UTC y las 11:30 UTC, los clientes no pudieron realizar trabajos en Actions Larger Runners y no pudieron ver o gestionar Actions Runners y Runner Groups a través de GitHub UI y API.
Estos problemas fueron causados por fracasos en solicitudes de backend que resolvieron metadatos esenciales para iniciar carreras de flujo de trabajo de Big Runner y para leer datos de grupos de corredores y corredores. Los fallos fueron causados por un certificado de autenticación caducado único a este servicio. El certificado había sido rotado en KeyVault, pero se había detenido un paso para permitir el uso en tiempo de ejecución para evitar la repetición de incidentes anteriores que habían sido desencadenados por esta operación.
Mitigamos las cuestiones completando la habilitación del nuevo certificado en el sistema de backend. Hemos añadido monitoreo adicional a este y otros certificados. El servicio relevante también está en proceso de ser reemplazado como parte de nuestro trabajo de disponibilidad y escala, trayendo esta ruta de autenticación y gestión secreta en consonancia con patrones en todos los servicios de GitHub.
Traducido automáticamente desde la actualización oficial del incidente.
Incident with GitHub.com
Comenzó 17 de agosto de 2026 a las 13:40 UTC · 7h 36m
Estamos investigando informes de rendimiento impactado para algunos servicios de GitHub.
investigating
Las solicitudes de API están experimentando un rendimiento degradado. Continuamos investigando.
investigating
Las acciones están experimentando un rendimiento degradado. Continuamos investigando.
investigating
Estamos viendo una tasa aproximada de error del 20% en numerosas experiencias incluyendo Pull Solicita, Problemas y otros. Actualmente se están llevando a cabo investigaciones y publicaremos actualizaciones cuando estén disponibles
investigating
Pull Solicita está experimentando un rendimiento degradado. Continuamos investigando.
investigating
Estamos experimentando altas tasas de error alrededor del 20% para experiencias web y tráfico api. Descargas de archivos y descargas de contenido de repositorio crudo están experimentando una tasa de error aproximada del 50%. Las investigaciones están en curso en la causa raíz, y las actualizaciones seguirán siendo proporcionadas mientras investigamos.
investigating
Estamos experimentando altas tasas de error alrededor del 20% para experiencias web y tráfico api. Descargas de archivos y descargas de contenido de repositorio crudo están experimentando una tasa de error aproximada del 50%. También se impactan la autenticación SAML y OIDC, SCIM y Team Sync. Las investigaciones están en marcha y seguiremos proporcionando actualizaciones mientras descubrimos más información.
investigating
Copilot está experimentando disponibilidad degradada. Continuamos investigando.
investigating
Las cuestiones están experimentando una disponibilidad degradada. Continuamos investigando.
investigating
Pull Solicita está experimentando disponibilidad degradada. Continuamos investigando.
investigating
Las acciones están experimentando disponibilidad degradada. Continuamos investigando.
investigating
Estamos experimentando altas tasas de error alrededor del 20% para experiencias web y tráfico api. Descargas de archivos y descargas de contenido de repositorio crudo están experimentando una tasa de error aproximada del 50%. También se impactan la autenticación SAML y OIDC, SCIM y Team Sync. Actualmente estamos realizando mitigacións basadas en nuestra investigación hasta ahora y estamos monitoreando para mejorar.
investigating
Webhooks está experimentando disponibilidad degradada. Continuamos investigando.
investigating
Las páginas están experimentando un rendimiento degradado. Continuamos investigando.
investigating
Webhooks está experimentando un rendimiento degradado. Continuamos investigando.
investigating
Estamos experimentando altas tasas de error alrededor del 20% para experiencias web y tráfico api. Descargas de archivos y descargas de contenido de repositorio crudo están experimentando una tasa de error aproximada del 50%. También se impactan la autenticación SAML y OIDC, SCIM y Team Sync. Actualmente estamos realizando mitigacións y publicaremos actualizaciones a medida que avanzamos.
investigating
Estamos experimentando altas tasas de error alrededor del 20% para experiencias web y tráfico api. Descargas de archivos y descargas de contenido de repositorio crudo están experimentando una tasa de error aproximada del 50%. También se impactan la autenticación SAML y OIDC, SCIM y Team Sync. Todavía estamos trabajando para identificar la causa raíz y seguiremos publicando actualizaciones mientras aprendemos más y realizamos la mitigación.
investigating
Identificamos el componente problemático y hemos adoptado medidas correctivas. Hay signos fuertes de recuperación, pero todavía estamos trabajando para restaurar completamente el servicio, con tasas de error todavía ligeramente elevadas. Publicaremos nuevas actualizaciones a medida que continúe la recuperación.
investigating
Se ha mitigado la degradación que afecta a las solicitudes de API, Acciones, Operaciones de Git, Problemas, Páginas, Solicitudes de Tiro y Webhooks. Estamos monitoreando para asegurar la estabilidad.
investigating
Git Operations está experimentando un rendimiento degradado. Continuamos investigando.
investigating
Identificamos el componente problemático y hemos adoptado medidas correctivas, pero estamos viendo impacto residual en numerosos servicios. Seguimos aplicando atenuaciones adicionales e investigando el impacto restante.
investigating
Los problemas están experimentando un rendimiento degradado. Continuamos investigando.
investigating
Identificamos el componente problemático y hemos tomado acciones correctivas, pero estamos viendo impacto residual en la forma de fallas de autenticación esporádica. Seguimos aplicando atenuaciones adicionales e investigando el impacto restante.
investigating
The degradation affecting Git Operations has been mitigated. Estamos monitoreando para asegurar la estabilidad.
investigating
API Solicitudes está experimentando disponibilidad degradada. Continuamos investigando.
investigating
Las solicitudes de API funcionan normalmente.
investigating
Continuamos investigando fallas de autenticación esporádica. Tenemos registros de autenticación parcialmente deshabilitados y hemos visto mejoras, y estamos monitoreando el impacto antes de aplicar plenamente esta mitigación.
investigating
Continuamos investigando fallos esporádicos que afectan la autenticación de Copilot en algunas aplicaciones. El uso de copiloto a través de GitHub CLI y GitHub App no son afectados.
investigating
Los problemas funcionan normalmente.
investigating
Seguimos aplicando mitigacións para abordar fallas esporádicas de autenticación Copilot en algunas aplicaciones. Esperamos una recuperación completa en los próximos 30 minutos. El uso de copiloto a través de GitHub CLI y GitHub App no son afectados.
resolved
El 17 de agosto de 2026, de 13:28 a 21:15 UTC (7h 47m), GitHub.com experimentó errores elevados y latencia a través de Problemas, Pull Solicita, APIs, Acciones y Copilot. En el pico, las tasas de error web/API fueron aproximadamente del 20%, mientras que las descargas de archivos y contenido bruto alcanzaron aproximadamente el 50%. La autenticación SAML/OIDC, SCIM y Team Sync también se vieron afectados, así como los flujos de trabajo de Acciones en GHEC con Data Residency que dependen de las definiciones de paso del flujo de trabajo público alojadas en GitHub.com. La mayoría de los servicios recuperados por 16:36 UTC como nuestro centro de datos de EE.UU. Central se recuperó; Acciones fueron degradadas hasta aproximadamente 18:03 UTC; y Copilot Token Service se recuperó completamente por 21:02.
Algunos de los tráficos fallidos fueron trasladados de EE.UU. Central al norte de Virginia donde se sirvió con éxito hasta que el fallo de la red en EE.UU. Central fue depurado y resuelto. Las respuestas tardías a un único punto final interno desencadenaron un error de retry latente en el código VS que amplificaba el tráfico alrededor de 10x y ocasionaba una recuperación retardada para el servicio Copilot Token.
La causa inmediata del fracaso fue la saturación de la red en los balanceadores de carga en Estados Unidos Central debido a un nuevo pico de tráfico. Originalmente esto fue causado por una vaina de Istio sidecar alcanzando sus límites de concurrencia y no a escala automática correctamente debido a una política errónea que observaba el servicio de host pero no límites de sidecar. Un fracaso cortó a más y eventualmente cuatro nodos HAProxy agotaron sus límites de flujo, degradando el camino de entrada auth y causando latencia de autenticación generalizada y fracasos. El problema fue agravado por la lógica de retry optimista que sobrecarga los balanceadores internos de carga. Pausar HAProxy en esos nodos produjo simultáneamente una recuperación amplia inmediata.
La tormenta de reingreso en el norte de VA fue fijada por 1) reducir temporalmente la lógica de reingreso de la puerta con un PR y 2) bloquear las solicitudes de señalización de Copilot Token Service en los balanceadores de carga con un 403, y luego desenrollar gradualmente el tráfico por sitio para permitir que los usuarios tengan éxito.
Las fallas de autenticación de Copiloto Residual continuaron porque el comportamiento de reingreso del cliente amplificaba la carga: una operación de token fallida podría generar muchas solicitudes adicionales y entrar en un bucle de retry. El tráfico de Copilot Token Service aumentó de un RPS normal de 7-9K a 70–100K RPS. Reducing gateway autation retries and blocking retry-triggering responsestabild Copilot Token Service and completed recovery.
Entre los factores complicados que obstaculizaron la recuperación figuraban varios ataques de desguace en los puntos finales de codeload.
Para evitar la recurrencia, nuestras acciones de seguimiento incluyen:
- Corregir políticas de autoescalamiento para dar cuenta de la concurrencia y capacidad de servicio de malla.
- Auditoría de la solicitud de Istio, concurrencia y ampliación de los límites de los servicios afectados.
- Revisar los límites de retry y el comportamiento de backoff a través de portales y clientes.
- Abordar el comportamiento de reingreso del Código VS que amplifica el tráfico de token Copilot.
- Mejorar la vigilancia de la capacidad de carga y las salvaguardias regionales de reducción de la carga.
Traducido automáticamente desde la actualización oficial del incidente.
Disrupción con GHEC Team Sync
Comenzó 13 de agosto de 2026 a las 16:21 UTC · 2h 6m
IssuesIncidente menor
investigating
Estamos investigando informes de rendimiento impactado para algunos servicios de GitHub.
investigating
GHEC Team Sync está actualmente degradado para empresas con cuentas personales, causando retrasos al sincronizar equipos a grupos IdP. Hemos identificado la causa de los retrasos y estamos trabajando en una mitigación. Proporcionaremos información actualizada sobre nuestro progreso a las 20:00 UTC.
investigating
Hemos desplegado una mitigación. En este momento GHEC Team Sync se ha recuperado para empresas con cuentas personales. Los equipos que se sincronizan con grupos de IdP han regresado a su cadencia normal.
resolved
El 13 de agosto de 2026, de 15:31:21 UTC a 18:27:55 UTC, GitHub Enterprise Cloud se degrada la sincronización del equipo para las empresas utilizando cuentas personales. Los equipos de organización experimentaron retrasos de hasta 3 a 13 horas (medianas 8 horas) cuando se sincronizaron con grupos de IdP, lo que dio lugar a subsidios de acceso retardado o mudanzas para usuarios de empresas en el 2,8% de los equipos.
Un cambio temporal introducido para abordar una cuestión anterior debido al aumento del uso de esta característica siguió activo después de que se pretendía eliminarla, causando retrasos en la sincronización durante períodos de alto volumen. Se eliminó el cambio temporal y se proporcionaron recursos adicionales para manejar el aumento del volumen.
Traducido automáticamente desde la actualización oficial del incidente.
Incident with Webhooks
Comenzó 13 de agosto de 2026 a las 14:45 UTC · 51m
IssuesIncidente menor
Componentes afectados
IssuesPackagesPull RequestsWebhooksGit Operations
investigating
Estamos investigando informes de rendimiento degradado para Webhooks
investigating
Pull Solicita está experimentando un rendimiento degradado. Continuamos investigando.
investigating
Los problemas están experimentando un rendimiento degradado. Continuamos investigando.
investigating
Git Operations está experimentando un rendimiento degradado. Continuamos investigando.
investigating
Los paquetes están experimentando un rendimiento degradado. Continuamos investigando.
investigating
Actualmente estamos investigando una breve degradación del servicio para las operaciones de Git (específicamente empujes), problemas, solicitudes de tiradas, registro de paquetes y juegos web entre 14:32 y 14:46 UTC. Hemos identificado la fuente de la degradación y estamos investigando estrategias de mitigación para prevenir la recurrencia.
monitoring
Se ha mitigado la degradación que afecta a Git Operations, Issues, Package Solicita y Webhooks. Estamos monitoreando para asegurar la estabilidad.
monitoring
Hemos discapacitado temporalmente un trabajo de fondo que causó el impacto. En este momento el impacto se mitiga completamente.
resolved
Entre 14:24 y 14:53 UTC el 13 de agosto de 2026, un trabajo de antecedentes rutinario para eliminar una organización superó una base de datos compartida clave, causando que varios servicios de GitHub devolvieran brevemente errores elevados y respuestas más lentas. La mayoría de los afectados fue la API de gestión webhook, con menor impacto en las operaciones de Git, solicitudes de pull, problemas, paquetes, inicio de sesión y Copilot. Impacto despejado por sí solo a las 14:53 UTC una vez terminado el trabajo; resolvimos el incidente a las 15:36 UTC.
Los usuarios afectados pueden haber experimentado un breve aumento de errores y respuestas más lentas, principalmente al crear, enumerar o actualizar webhooks, con menores impactos para extraer solicitudes, problemas, paquetes y operaciones Git. Los fracasos alcanzaron alrededor del 1% durante varios minutos alrededor de 14:37 UTC.
Para prevenir futuros incidentes, ya hemos enviado una actualización que gira en el camino de eliminación más seguro para las organizaciones, junto con tapas en la eliminación de las bases de datos. Basándonos en estos cambios, estamos auditando todos los trabajos de eliminación y limpieza a granel que escriben en bases de datos compartidas para evitar problemas similares en el futuro.
Traducido automáticamente desde la actualización oficial del incidente.
Errores con el modelo Fable 5 en Copilot
Comenzó 13 de agosto de 2026 a las 14:43 UTC · 1h 4m
IssuesIncidente menor
Componentes afectados
Copilot AI Model Providers
investigating
Estamos investigando informes de rendimiento degradado para los proveedores de modelos Copilot AI
investigating
Estamos experimentando disponibilidad degradada para el modelo Fable 5 en productos Copilot y superficies IDE. Esto se debe a un problema con un proveedor de modelos de corriente avanzada. Mientras trabajamos con ellos para resolver el problema, recomendamos elegir otro modelo o seleccionar 'Auto' para continuar utilizando Copilot.
investigating
Estamos viendo una modesta recuperación, pero todavía están experimentando disponibilidad degradada para el modelo Fable 5 en productos Copilot y superficies IDE. Esto se debe a un problema con un proveedor de modelos de corriente avanzada. Mientras trabajamos con ellos para resolver el problema, recomendamos elegir otro modelo o seleccionar 'Auto' para continuar utilizando Copilot.
investigating
Los problemas con nuestro proveedor de modelos se han resuelto, y Fable 5 está de nuevo disponible en productos Copilot y superficies IDE.
Seguiremos vigilando para asegurar la estabilidad, pero la mitigación está completa.
resolved
El 13 de agosto de 2026, entre aproximadamente 14:06 y 15:47 UTC, el servicio Copilot experimentó una degradación del modelo Claude Fable 5 debido a un problema con nuestro proveedor de corriente. Los usuarios encontraron tasas de error elevadas, alcanzando el 43% y promediando el 12%. Los usuarios que seleccionaron modelos Auto o alternativos no fueron afectados.
El problema fue resuelto por una mitigación puesta en marcha por nuestro proveedor. GitHub está trabajando con nuestro proveedor para mejorar aún más la resiliencia del servicio para prevenir incidentes similares en el futuro.
Traducido automáticamente desde la actualización oficial del incidente.