Мы расследуем сообщения о воздействии на производительность некоторых сервисов GitHub.
resolved
Этот инцидент был урегулирован. Спасибо за ваше терпение и понимание, когда мы рассматривали этот вопрос. Подробный анализ первопричины будет опубликован, как только он будет доступен.
Автоматический перевод официального обновления инцидента.
Обсуждение Copilot Code
Начало 4 сентября 2026 г. в 20:39 UTC · 1h 48m
OutageСерьёзный инцидент
investigating
Мы расследуем сообщения о воздействии на производительность некоторых сервисов GitHub.
investigating
Некоторые пользователи могут испытывать сбои при использовании обзора кода Copilot. Мы определили первопричину и работаем над смягчением последствий.
investigating
Мы применяем смягчение и ожидаем восстановления в течение примерно 30 минут.
monitoring
Деградация была смягчена. Мы проводим мониторинг для обеспечения стабильности.
resolved
Этот инцидент был урегулирован. Спасибо за ваше терпение и понимание, когда мы рассматривали этот вопрос. Подробный анализ первопричины будет опубликован, как только он будет доступен.
Автоматический перевод официального обновления инцидента.
Инцидент с поставщиком моделей Grok Copilot AI
Начало 3 сентября 2026 г. в 14:17 UTC · 2h 54m
IssuesНезначительный инцидент
Затронутые компоненты
Copilot AI Model Providers
investigating
Мы расследуем сообщения о ухудшении производительности для поставщиков моделей Copilot AI
investigating
Мы испытываем ухудшение доступности модели Grok 4.6 в чатах Copilot, VS Code и других продуктах Copilot. Это связано с проблемой с поставщиком восходящей модели. Мы работаем с ними, чтобы решить этот вопрос.
investigating
Модель Grok 4.5 также ухудшила доступность. Мы работаем с провайдером, чтобы решить эту проблему.
investigating
Проблемы с нашим поставщиком моделей были решены, и модели Grok снова доступны в продуктах Copilot и поверхностях IDE.
Мы продолжим мониторинг, чтобы обеспечить стабильность, но смягчение последствий завершено.
resolved
Этот инцидент был урегулирован. Спасибо за ваше терпение и понимание, когда мы рассматривали этот вопрос. Подробный анализ первопричины будет опубликован, как только он будет доступен.
Автоматический перевод официального обновления инцидента.
Задержки в обработке обязательств
Начало 1 сентября 2026 г. в 15:00 UTC · 1h 1m
IssuesНезначительный инцидент
Затронутые компоненты
Pull Requests
investigating
Мы расследуем сообщения о ухудшении производительности для Pull Requests
investigating
Диффы в PR-виде могут быть застойными в течение нескольких минут. Мы расследуем и наращиваем ресурсы.
investigating
Время обновления диффов запросов на вытягивание улучшилось до нормальных порогов.
resolved
Этот инцидент был урегулирован. Спасибо за ваше терпение и понимание, когда мы рассматривали этот вопрос. Подробный анализ первопричины будет опубликован, как только он будет доступен.
Автоматический перевод официального обновления инцидента.
Повышенная частота ошибок для моделей OpenAI от Copilot
Начало 31 августа 2026 г. в 09:15 UTC · 42m
IssuesНезначительный инцидент
Затронутые компоненты
Copilot AI Model Providers
investigating
Мы расследуем сообщения о ухудшении производительности для поставщиков моделей Copilot AI
investigating
Копилот испытывает более высокий уровень ошибок для моделей OpenAI, включая gpt-5.2, gpt-5.3-codex, gpt-5.4, gpt-5.4 и семейство моделей gpt-5.6. Другие модели не подвержены влиянию.
investigating
Один из наших поставщиков моделей подтвердил инцидент. Мы предоставили им детали, чтобы помочь определить проблему. Мы начинаем видеть восстановление.
monitoring
Деградация, затрагивающая поставщиков моделей Copilot AI, была смягчена. Мы проводим мониторинг для обеспечения стабильности.
monitoring
Проблемы с нашим поставщиком моделей были решены, и gpt-5.3-codex, gpt-5.4-mini, gpt-5.4-nano, gpt-5.5 и семейство моделей gpt-5.6 снова доступны в продуктах Copilot и поверхностях IDE.
Мы продолжим мониторинг, чтобы обеспечить стабильность, но смягчение последствий завершено.
resolved
Между 08:37 и 09:41 UTC 31 августа 2026 года GitHub Copilot испытал деградацию, затрагивающую несколько моделей GPT, включая gpt-5.2, gpt-5.3-codex, gpt-5.4, gpt-5.4-mini, gpt-5.4-nano и семейство gpt-5.6 (Luna, Sol и Terra). Пользователи сталкивались с повышенными показателями ошибок и прерывали потоковые ответы. Другие модели не пострадали.
Деградация была вызвана проблемой с поставщиком восходящей модели. Инженеры GitHub обнаружили проблему с помощью автоматизированного мониторинга, отображали предупреждения о побочных продуктах для пострадавших моделей и координировали с поставщиком. Обслуживание вернулось к норме после того, как провайдер реализовал смягчение.
Автоматический перевод официального обновления инцидента.
Случай с поставщиками моделей Copilot AI
Начало 27 августа 2026 г. в 10:04 UTC · 2h 8m
OutageКритический инцидент
Затронутые компоненты
Copilot AI Model Providers
investigating
Мы расследуем сообщения о ухудшении доступности для поставщиков моделей Copilot AI
investigating
Мы испытываем ухудшение доступности модели Kimi K3 в продуктах Copilot и поверхностях IDE. Это связано с проблемой с поставщиком восходящей модели. Пока мы работаем с ними, чтобы решить проблему, мы рекомендуем выбрать другую модель или выбрать Auto, чтобы продолжить использовать Copilot.
investigating
Поставщики моделей Copilot AI испытывают ухудшение производительности. Мы продолжаем расследование.
investigating
Проблемы с нашим поставщиком моделей были смягчены, и Kimi K3 снова доступен в продуктах Copilot и поверхностях IDE.
Мы продолжим мониторинг для обеспечения стабильности.
resolved
27 августа 2026 года, примерно между 09:20 и 12:14 UTC, сервис Copilot испытал деградацию модели Kimi K3 из-за проблемы с нашим провайдером. Пользователи столкнулись с повышенными показателями ошибок при использовании Kimi K3. Никакие другие модели не пострадали.
Проблема была решена путем смягчения, введенного в действие нашим поставщиком. GitHub работает с нашим провайдером для дальнейшего повышения отказоустойчивости сервиса для предотвращения подобных инцидентов в будущем.
Автоматический перевод официального обновления инцидента.
Инцидент с действиями и оттягивание запросов
Начало 26 августа 2026 г. в 22:56 UTC · 1h 30m
IssuesНезначительный инцидент
Затронутые компоненты
Pull RequestsActions
investigating
Мы расследуем сообщения о деградировавшей производительности для действий и запросов на оттягивание
investigating
Мы расследуем повышенные задержки и тайм-ауты, влияющие на рабочие процессы действий, вызванные событиями запроса тяги. 20% запусков задерживаются более чем на 5 минут, а до 4% не срабатывают. Мы активно работаем над смягчением последствий и будем предоставлять обновления, поскольку мы узнаем больше.
investigating
Мы применили смягчения и наблюдаем восстановление в рабочих процессах Actions и блокировали слияние запросов на вытягивание. Мы продолжаем следить за устойчивым здоровьем, которое создает слияние перед решением.
investigating
Мы подтвердили полное восстановление, начиная с 23:58 UTC. Рабочий процесс действий и слияние запросов тянуть работают нормально. Теперь мы устраним инцидент, продолжая следить за состоянием здоровья.
monitoring
Деградация, затрагивающая действия и запросы, была смягчена. Мы проводим мониторинг для обеспечения стабильности.
resolved
26 августа 2026 года, с 21:55 UTC до 23:58 UTC, 2,6% рабочих процессов, вызванных событиями запроса на тягу, были отложены, а воздействие выросло до 25% на пике. Некоторые пользователи также испытывали задержки с генерацией запросов на слияние, информацией о слиянии и доступностью кнопок слияния. Действия и запросы на вытягивание полностью восстановились к 23:58 UTC; инцидент был разрешен в 00:26 UTC после подтверждения нормальной работы.
На фоновые задания, которые обрабатывают обновления запросов и генерируют слияния, повлияли тайм-ауты, достигающие одного раздела данных git. Это привело к отставанию в обработке запросов на слияние, задержке рабочих процессов GitHub Actions и некоторой информации о слиянии.
Мы сократили рабочую нагрузку, перевели трафик из пострадавшей инфраструктуры и восстановили пострадавшую сервисную составляющую в здоровое состояние. Вместе эти действия помогли истощить отставание и восстановить нормальные операции.
Мы работаем над улучшением обнаружения насыщения ресурсов и устранением воздействия на клиентов в этом сценарии путем изоляции воздействия, установления лучших ограничений на повторные запросы и усиления обратного давления, чтобы сделать наши системы более устойчивыми под нагрузкой.
Автоматический перевод официального обновления инцидента.
Нарушение работы GitHub Billing
Начало 26 августа 2026 г. в 20:40 UTC · 4h 11m
IssuesНезначительный инцидент
investigating
Мы расследуем сообщения о воздействии на производительность некоторых сервисов GitHub.
investigating
В настоящее время мы расследуем увеличение количества ошибок в платежных услугах. Клиенты могут наблюдать за неудавшимися платежами, а пользователи CLI Copilot могут наблюдать сбои в начале или продолжении сеансов.
investigating
Мы применили смягчение для разблокировки использования Copilot и наблюдали восстановление для этого конкретного воздействия. Мы продолжаем расследовать и применять меры по смягчению последствий нарушения биллинговой страницы при мониторинге, чтобы обеспечить восстановление Copilot.
investigating
Мы продолжаем следить за смягчением последствий, которые мы подали на нарушение работы платежной страницы.
investigating
Наше смягчение по-прежнему сохраняется, поскольку мы продолжаем исследовать, чтобы найти первопричину.
investigating
Наше смягчение последствий продолжается, и условия обслуживания остаются стабильными. Мы продолжаем изучать сосредоточенную рабочую нагрузку, связанную с этим вопросом, и готовим дополнительные превентивные улучшения. С момента предыдущего обновления мы не выявили существенного изменения воздействия на клиентов. Мы предоставим еще одно обновление по мере продвижения расследования.
investigating
Никаких существенных изменений со времени предыдущего обновления. Условия обслуживания остаются стабильными после смягчения последствий, и мы не наблюдали никакого дальнейшего воздействия на клиентов. Мы активно отслеживаем сервис при реализации целевых исправлений для устранения основной причины.
resolved
26 августа 2026 года между 20:40 UTC и 00:51 UTC 27 августа GitHub Billing испытал ухудшение производительности, затрагивающее страницы бюджета выставления счетов и сессии CLI GitHub Copilot. Пострадавшие клиенты сталкивались с неудавшимися нагрузками на бюджетные страницы или сбоями при запуске или продолжении сеансов CLI. Мы подтвердили это влияние для небольшого числа клиентов (<1%).
Это было вызвано концентрированной рабочей нагрузкой, которая создавала задержки обработки в нашем уровне хранения данных. Автоматизированные повторы увеличили нагрузку и продлили деградацию. Мы смягчили инцидент, перебалансировав трафик в нашей инфраструктуре.
Мы улучшаем изоляцию рабочей нагрузки, поведение повторных попыток и обнаружение концентрированной нагрузки, чтобы уменьшить вероятность рецидива и сократить наше время для обнаружения и смягчения подобных инцидентов.
Автоматический перевод официального обновления инцидента.
Инцидент с действиями
Начало 26 августа 2026 г. в 15:11 UTC · 2h 50m
OutageКритический инцидент
Затронутые компоненты
ActionsPages
investigating
Мы расследуем сообщения о деградировавшей доступности для действий
investigating
Страницы испытывают ухудшение производительности. Мы продолжаем расследование.
investigating
Мы идентифицировали проблему с первичной базой данных и сразу же не смогли сделать копию
investigating
первичный отказ на короткое время улучшил производительность, но не полностью смягчил, мы задушили входящий трафик и расследуем проблемы Vitess
investigating
Мы считаем, что мы определили и решили проблему и медленно наращиваем трафик, чтобы гарантировать, что он не повторится. Некоторые клиенты будут продолжать видеть задержки по мере роста.
investigating
Страницы работают нормально.
investigating
Мы продолжаем наблюдать за восстановлением, и отсроченные очереди сгорают. Некоторые клиенты будут продолжать видеть увеличенные задержки до тех пор, пока все работы не будут завершены - мы ожидаем этого в течение следующего часа.
investigating
Мы продолжаем наблюдать восстановление и ожидаем, что входящие очереди вернутся к норме через 30 минут. Работа по-прежнему будет проходить через систему с учетом ограничений на параллель между клиентами.
monitoring
Деградация, затрагивающая действия, была смягчена. Мы проводим мониторинг для обеспечения стабильности.
monitoring
Все входящие очереди восстановлены, и действия работают, как и ожидалось. 3,7% рабочих мест, назначенных для более крупных бегунов на ранней стадии этого инцидента, застряли в ожидании назначения бегунов. Они будут отменены в течение часа. Другие бегуны успешно обрабатывают все новые рабочие места.
resolved
26 августа 2026 года с 15:02 до 15:45 UTC рабочие места Actions так и не начались. Следующие 2 часа до 17:40 UTC, запуски Actions были отложены более чем на 5 минут, поскольку система догнала отложенную нагрузку. Это воздействие было вызвано насыщением записей в основной базе данных, используемой триггерами обработки услуг для рабочих процессов Actions. Первичная не удалась, но система не полностью восстановилась. Насыщение было вызвано ростом суточной пиковой нагрузки в сочетании с проблемой восходящего потока в инфраструктуре обработки событий GitHub, https://www.githubstatus.com/incidents/hcbtzksccj2f. Даунстримовые дроссели, которые позже использовались для восстановления, были установлены на 10% слишком высоко для защиты системы.
В 15:45 UTC дросселирование в сочетании с перезагрузкой службы восстановило основное здоровье службы. Эти дроссели были постепенно подняты между 15:54 и 17:22, чтобы восстановить полную обработку веб-хуков. Этот пандус был намеренно медленным, чтобы гарантировать, что мы не переодолеем систему, учитывая, что наше первоначальное дросселирование было неправильно установлено. Очередь событий webhook была полностью сожжена в 17:40 UTC.
3,7% рабочих мест с более крупными рабочими местами, наряду с некоторыми масштабными самостоятельными рабочими местами, оставались в очереди или «ждали бегуна». Мы ввели изменения, чтобы принудительно отменить рабочие места в этом штате, и они перешли к неудаче в 18:40 UTC, примерно через 50 минут после смягчения последствий инцидента. Освобождение этих рабочих мест также освободило организованную параллель для более крупных рабочих мест.
Клиенты, использующие группы параллелизма, увидели более длительное воздействие из-за отдельной проблемы, когда бегуны, назначенные на подмножество рабочих мест, были отключены до того, как было развернуто смягчение последствий, которое предотвратило приобретение бегуна от прогрессирования и оставило рабочие места в состоянии ожидания бегуна. Это было решено в 01:00 UTC 27 августа.
Некоторые пробежки, запущенные во время окна инцидента 15:02-15:45 UTC, столкнулись с ошибкой, которая оставила их в очереди даже после восстановления службы. В бэкэнде эти пробежки уже провалились и автоматически перейдут в отмененное состояние через 24 часа после создания. В качестве последующих действий мы фиксируем первопричину этого состояния очереди и улучшаем нашу способность отменять пораженные пробежки.
Несколько изменений для повышения общей масштабируемости этой части Действий уже были завершены и развернуты в производство. Вывод этих изменений будет завершен в течение следующих 24 часов. Дальнейшая работа по улучшению масштаба, отказоустойчивости и более изящной деградации рабочих процессов Actions находится в полете. Мы также берем предмет ремонта, чтобы ускорить очистку от застрявших в очереди или ожидающих работ в аналогичных будущих случаях.
Автоматический перевод официального обновления инцидента.
Нарушение работы некоторых сервисов GitHub
Начало 26 августа 2026 г. в 15:09 UTC · 59m
IssuesНезначительный инцидент
investigating
Мы расследуем сообщения о воздействии на производительность некоторых сервисов GitHub.
resolved
Пожалуйста, обратитесь к сводному резюме в этом связанном инциденте: https://www.githubstatus.com/incidents/y1t7p9fzrlj2
Автоматический перевод официального обновления инцидента.
Действия, задерживающие запуски
Начало 24 августа 2026 г. в 13:33 UTC · 31m
IssuesНезначительный инцидент
Затронутые компоненты
Actions
investigating
Мы расследуем сообщения о ухудшении результатов деятельности
investigating
Неудачи при очередях и выполнении заданий Actions для подмножества клиентов теперь решаются. Мы контролируем полное восстановление.
monitoring
Деградация, затрагивающая действия, была смягчена. Мы проводим мониторинг для обеспечения стабильности.
resolved
24 августа 2026 года, между 13:33 UTC и 14:04 UTC, 3,8% запусков имели задержки запуска в течение 5 минут, а 1,25 % действий полностью провалились.
Инцидент был вызван отказом диска на узле, на котором размещен один из многих экземпляров службы, ответственных за обработку событий назначения бегуна. Как правило, стручки на нездоровых узлах удаляются и заменяются автоматически без воздействия. При этом, хотя узел был сильно деградирован и не мог выполнять дисковые операции, он продолжал посылать здоровые сигналы, мешая системе немедленно перемещать свою работу в другое место. В течение этого периода события, назначенные пораженному компоненту, накапливались до тех пор, пока автоматический перебаланс не перенаправил обработку на здоровые компоненты в 13:54 UTC. Отставание в очереди было устранено в 14:00 UTC, а обработка вернулась к норме к 14:04 UTC.
Чтобы предотвратить рецидив, мы улучшаем обнаружение и автоматическое восстановление нездоровых узлов, которые не полностью отключены. Мы также усиливаем отказоустойчивость на уровне приложений, поэтому застопорившиеся потребители автоматически удаляются быстро, и их работа переназначается, не дожидаясь восстановления пострадавшего узла.
Автоматический перевод официального обновления инцидента.
Повышенные ошибки в Fable 5 из-за провайдера
Начало 24 августа 2026 г. в 07:12 UTC · 47m
OutageСерьёзный инцидент
Затронутые компоненты
Copilot AI Model Providers
investigating
Мы расследуем сообщения о ухудшении доступности для поставщиков моделей Copilot AI
investigating
Мы испытываем ухудшение доступности модели Fable для продуктов Copilot и поверхностей IDE. Это связано с проблемой с поставщиком восходящей модели. Пока мы работаем с ними, чтобы решить проблему, мы рекомендуем выбрать другую модель или выбрать Auto, чтобы продолжить использовать Copilot.
resolved
24 августа 2026 года, примерно между 06:35 и 07:25 UTC, сервис Copilot испытал деградацию модели Claude Fable 5 из-за проблемы с нашим провайдером. Пользователи сталкивались с повышенными показателями ошибок при использовании Claude Fable 5, при этом запросы иногда отклонялись в середине ответа. Никакие другие модели не пострадали.
Проблема была решена путем смягчения, введенного в действие нашим поставщиком. GitHub работает с нашим провайдером для дальнейшего повышения отказоустойчивости сервиса для предотвращения подобных инцидентов в будущем.
Автоматический перевод официального обновления инцидента.
Деградированные операции Git над SSH
Начало 21 августа 2026 г. в 14:00 UTC · 7m
Pending
resolved
21 августа 2026, между 14:00 и 14:07 UTC, дотком Операции Git над SSH были деградированы. Успешный Операции Git над SSH упали более чем на 95% во время окна пикового удара, что делает клонирование, извлечение или нажатие на SSH фактически недоступными для большинства пользователей в течение примерно четырех минут. Операции Git через HTTPS не были затронуты.
Инцидент был вызван дефектом программного обеспечения в нашей инфраструктуре балансировки нагрузки, который был вызван изменением конфигурации. Дефект возник только тогда, когда соединения проходили через несколько слоев балансировщиков нагрузки, выполняющих новую конфигурацию, что означало, что он не был обнаружен во время канарейных испытаний.
Мы смягчили инцидент, откатив изменение конфигурации.
Мы добавляем регрессионное покрытие для многослойных конфигураций нагрузочного баланса и улучшаем мониторинг и оповещение для операций Git над SSH, чтобы сократить наше время на обнаружение и смягчение подобных проблем в будущем.
Автоматический перевод официального обновления инцидента.
Прерывистые сбои в создании агентских задач
Начало 20 августа 2026 г. в 14:43 UTC · 9h 54m
OutageКритический инцидент
investigating
Мы расследуем сообщения о воздействии на производительность некоторых сервисов GitHub.
investigating
Пользователи могут испытывать задержки при запуске задач с помощью Copilot Cloud Agent. Мы активно изучаем проблему и будем предоставлять обновления по мере того, как мы узнаем больше.
investigating
Мы определили проблемный компонент и работаем над тем, чтобы не привести к здоровому случаю. Дальнейшие обновления будут предоставляться по мере выполнения нами мер по смягчению последствий.
investigating
Мы испытываем проблемы с задачами Copilot Cloud Agent, в результате чего недавно начатые задачи не отображают должным образом текущий прогресс. Эти задачи Copilot Cloud Agent все еще выполняются правильно, но не имеют надлежащей видимости. Мы активно изучаем проблему и будем предоставлять обновления по мере того, как мы узнаем больше.
investigating
Пользователи испытывают задержки при запуске задач с помощью Copilot Cloud Agent и не могут видеть состояние этих задач. Задачи Copilot Cloud Agent продолжаются. Мы определили причину проблемы и принимаем меры по смягчению последствий, чтобы вернуть обслуживание на нормальный уровень. В ближайшее время мы предоставим еще одну информацию о ожидаемом времени восстановления.
investigating
Мы видим признаки восстановления видимости статуса задачи Copilot Cloud Agent, но это восстановление происходит медленнее, чем ожидалось. Мы предпринимаем дополнительные смягчающие меры для ускорения восстановления.
investigating
Мы наблюдаем постепенное восстановление видимости статуса задачи Copilot Cloud Agent, а выход сеанса задерживается примерно на 1 час. Мы предприняли дополнительные шаги для ускорения восстановления и продолжаем следить за последствиями.
investigating
Мы продолжаем наблюдать постепенное восстановление видимости статуса задачи Copilot Cloud Agent с задержкой выхода сеанса примерно на 1 час. Мы предприняли дополнительные шаги для ускорения восстановления и продолжаем следить за последствиями.
investigating
Мы продолжаем наблюдать постепенное восстановление видимости статуса задачи Copilot Cloud Agent с задержкой выхода сеанса примерно на 1 час. Мы предприняли дополнительные шаги для ускорения восстановления и ожидаем, что это вступит в силу в течение следующего часа.
investigating
Мы продолжаем наблюдать постепенное восстановление видимости статуса задачи Copilot Cloud Agent. Выход сеанса по-прежнему задерживается примерно на 1 час, поскольку наши шаги по восстановлению вступают в силу.
investigating
Мы наблюдаем постепенное восстановление видимости статуса задачи Copilot Cloud Agent по мере развертывания исправления основной причины. Выход сеанса задерживается примерно на один час, а восстановление продолжается.
resolved
Между 13:57 UTC 20 августа и 00:37 UTC 21 августа 2026 года некоторые пользователи Copilot Cloud Agent испытывали задержки до 60-90 минут при просмотре статуса и результатов своих агентских задач. Сами задания агентов продолжали выполняться и завершаться в это время; только видимость их статуса задерживалась.
Причиной стало региональное отключение в стороннем облачном сервисе баз данных, который Copilot использует для хранения статуса задачи агента. Мы провалили работу над затронутой базой данных в здоровом регионе, добавили вычислительную мощность для работы через отставание и восстановили нормальную работу после восстановления базовой службы. Во время инцидента никаких данных о задачах не было потеряно.
Чтобы предотвратить повторение подобных инцидентов, мы удаляем конфигурацию базы данных, которая сделала нас уязвимыми для этого регионального отключения, и улучшаем наши процедуры отказоустойчивости базы данных.
Автоматический перевод официального обновления инцидента.
Периодические сбои на страницах разрешений, связанных с раннерами
Начало 18 августа 2026 г. в 05:02 UTC · 6h 28m
IssuesНезначительный инцидент
investigating
Мы расследуем сообщения о воздействии на производительность некоторых сервисов GitHub.
monitoring
Мы расследуем сообщения о неспособности загружать группы бегунов и связанные с бегуном разрешения для клиентов, использующих более крупных бегунов.
monitoring
Мы определили источник проблемы коммуникации между службами Actions и работаем над смягчением последствий. Клиенты могут испытывать неспособность загружать группы бегунов и проблемы с разрешениями бегунов при использовании более крупных бегунов.
monitoring
Мы применили смягчение и видим сигналы восстановления. Мы продолжим следить за восстановлением и предоставлять обновления.
resolved
18 августа 2026 года, между 05:02 UTC и 11:30 UTC, клиенты не смогли просматривать и управлять Actions Runners и Runner Groups через интерфейс GitHub и API.
Проблема была вызвана сбоями в бэкэнд-запросах чтения данных бегунов и бегунов. Сбои были вызваны истекшим сертификатом аутентификации, уникальным для этой службы. Сертификат был повернут в KeyVault, но шаг, позволяющий использовать его во время выполнения, был приостановлен, чтобы предотвратить повторение предыдущих инцидентов, вызванных этой операцией.
Влияние было смягчено завершением включения нового сертификата в бэкэнд-систему. Мы добавили дополнительный мониторинг к этому и другим сертификатам. Эта услуга также находится в процессе замены в рамках нашей работы по доступности и масштабированию, что приводит этот путь аутентификации и тайного управления в соответствие с шаблонами во всех сервисах GitHub.
Автоматический перевод официального обновления инцидента.
Инцидент с действиями
Начало 18 августа 2026 г. в 05:02 UTC · 6h 28m
OutageСерьёзный инцидент
investigating
Мы расследуем сообщения о воздействии на производительность некоторых сервисов GitHub.
resolved
18 августа 2026 года, между 05:02 UTC и 11:30 UTC, клиенты не могли выполнять задания на Actions Larger Runners и не могли просматривать или управлять Actions Runners и Runner Groups через интерфейс GitHub и API.
Эти проблемы были вызваны сбоями в бэкэнд-запросах, разрешающих необходимые метаданные для запуска рабочих процессов Большого Бегущего и для чтения данных группы бегунов и бегунов. Сбои были вызваны истекшим сертификатом аутентификации, уникальным для этой службы. Сертификат был повернут в KeyVault, но шаг, позволяющий использовать его во время выполнения, был приостановлен, чтобы предотвратить повторение предыдущих инцидентов, вызванных этой операцией.
Мы смягчили проблемы, заполнив включение нового сертификата в бэкэнд-системе. Мы добавили дополнительный мониторинг к этому и другим сертификатам. Соответствующий сервис также находится в процессе замены в рамках нашей работы по доступности и масштабированию, что приводит этот путь аутентификации и тайного управления в соответствие с шаблонами во всех сервисах GitHub.
Автоматический перевод официального обновления инцидента.
Мы расследуем сообщения о воздействии на производительность некоторых сервисов GitHub.
investigating
Запросы API испытывают ухудшение производительности. Мы продолжаем расследование.
investigating
Действия испытывают ухудшение производительности. Мы продолжаем расследование.
investigating
Мы наблюдаем примерно 20%-ную частоту ошибок во многих ситуациях, включая запросы на вывод, проблемы и другие. В настоящее время ведутся расследования, и мы будем публиковать обновления по мере их поступления
investigating
Pull Requests испытывает ухудшение производительности. Мы продолжаем расследование.
investigating
Мы испытываем высокий уровень ошибок около 20% для веб-опыта и трафика api. Архивные загрузки и необработанные загрузки содержимого репозитория имеют примерно 50%-ную частоту ошибок. Расследования продолжаются, и обновления будут по-прежнему предоставляться по мере расследования.
investigating
Мы испытываем высокий уровень ошибок около 20% для веб-опыта и трафика api. Архивные загрузки и необработанные загрузки содержимого репозитория имеют примерно 50%-ную частоту ошибок. Также затронуты аутентификация SAML и OIDC, SCIM и Team Sync. Расследования продолжаются, и мы будем продолжать предоставлять обновления по мере обнаружения дополнительной информации.
investigating
Копилот испытывает ухудшение доступности. Мы продолжаем расследование.
investigating
Проблемы испытывают ухудшение доступности. Мы продолжаем расследование.
investigating
Pull Requests испытывает ухудшение доступности. Мы продолжаем расследование.
investigating
Действия испытывают ухудшение доступности. Мы продолжаем расследование.
investigating
Мы испытываем высокий уровень ошибок около 20% для веб-опыта и трафика api. Архивные загрузки и необработанные загрузки содержимого репозитория имеют примерно 50%-ную частоту ошибок. Также затронуты аутентификация SAML и OIDC, SCIM и Team Sync. В настоящее время мы выполняем меры по смягчению последствий, основанные на нашем расследовании, и отслеживаем их улучшение.
investigating
Webhooks испытывает ухудшение доступности. Мы продолжаем расследование.
investigating
Страницы испытывают ухудшение производительности. Мы продолжаем расследование.
investigating
Webhooks испытывает ухудшение производительности. Мы продолжаем расследование.
investigating
Мы испытываем высокий уровень ошибок около 20% для веб-опыта и трафика api. Архивные загрузки и необработанные загрузки содержимого репозитория имеют примерно 50%-ную частоту ошибок. Также затронуты аутентификация SAML и OIDC, SCIM и Team Sync. В настоящее время мы проводим смягчения последствий и будем публиковать обновления по мере продвижения.
investigating
Мы испытываем высокий уровень ошибок около 20% для веб-опыта и трафика api. Архивные загрузки и необработанные загрузки содержимого репозитория имеют примерно 50%-ную частоту ошибок. Также затронуты аутентификация SAML и OIDC, SCIM и Team Sync. Мы все еще работаем над выявлением первопричины и будем продолжать публиковать обновления, поскольку мы узнаем больше и выполняем смягчение последствий.
investigating
Мы определили проблемную составляющую и предприняли корректирующие действия. Есть сильные признаки восстановления, но мы все еще работаем над полным восстановлением сервиса, и уровень ошибок все еще остается немного повышенным. Мы будем публиковать дальнейшие обновления по мере восстановления.
investigating
Деградация, затрагивающая запросы API, действия, операции Git, проблемы, страницы, запросы Pull и веб-хуки, была смягчена. Мы проводим мониторинг для обеспечения стабильности.
investigating
Git Operations испытывает ухудшение производительности. Мы продолжаем расследование.
investigating
Мы определили проблемный компонент и предприняли корректирующие действия, но мы видим остаточное воздействие на многие службы. Мы продолжаем применять дополнительные меры по смягчению последствий и расследовать оставшиеся последствия.
investigating
Проблемы испытывают ухудшение производительности. Мы продолжаем расследование.
investigating
Мы определили проблемный компонент и предприняли корректирующие действия, но мы видим остаточное воздействие в виде спорадических сбоев аутентификации. Мы продолжаем применять дополнительные меры по смягчению последствий и расследовать оставшиеся последствия.
investigating
Деградация, затрагивающая операции Git, была смягчена. Мы проводим мониторинг для обеспечения стабильности.
investigating
Запросы API испытывают ухудшение доступности. Мы продолжаем расследование.
investigating
API-запросы работают нормально.
investigating
Мы продолжаем исследовать спорадические сбои в аутентификации. Мы частично отключили повторы токенов аутентификации и увидели улучшение, и мы отслеживаем влияние, прежде чем полностью применять это смягчение.
investigating
Мы продолжаем исследовать спорадические сбои, влияющие на аутентификацию Copilot в некоторых приложениях. Использование копилота через GitHub CLI и приложение GitHub не затрагивается.
investigating
Проблемы работают нормально.
investigating
Мы продолжаем применять смягчения для устранения спорадических сбоев аутентификации Copilot в некоторых приложениях. Мы ожидаем полного выздоровления в течение следующих 30 минут. Использование копилота через GitHub CLI и приложение GitHub не затрагивается.
resolved
17 августа 2026 года, с 13:28 до 21:15 UTC (7 ч 47 м), GitHub.com испытал повышенные ошибки и задержки в Выпусках, Запросах на вывод, API, Действиях и Копилоте. На пике уровень ошибок web/API составлял около 20%, а загрузка архивов и исходного контента — около 50%. Также были затронуты аутентификация SAML / OIDC, SCIM и Team Sync, а также рабочие процессы в GHEC с резиденцией данных, которые зависят от определений этапов общественного рабочего процесса, размещенных на GitHub.com. Большинство сервисов были восстановлены к 16:36 UTC по мере восстановления нашего центра обработки данных в Центральной Америке; действия были ухудшены примерно до 18:03 UTC; и сервис токенов Copilot полностью восстановился к 21:02.
Часть неисправного трафика была перемещена из Центральной Америки в Северную Вирджинию, где она успешно обслуживалась, пока сетевой сбой в Центральной Америке не был отлажен и устранен. Отложенные ответы на одну внутреннюю конечную точку вызвали скрытую ошибку в VS-коде, которая увеличила трафик примерно в 10 раз и вызвала задержку восстановления для службы токенов Copilot.
Непосредственной причиной сбоя стало насыщение сети на балансировщиках нагрузки в Центральной Америке из-за нового пика трафика. Первоначально это было вызвано тем, что подушка коляски Istio достигла своих параллельных пределов и не смогла правильно масштабироваться из-за неправильно настроенной политики, которая смотрела хост-сервис, но не ограничения коляски. Один сбой каскадировался к большему количеству, и в конечном итоге четыре узла HAProxy исчерпали свои пределы потока, ухудшив шлюз аута пути и вызвав широко распространенную задержку аутентификации и сбои. Проблема усугублялась оптимистической логикой, которая перегружала внутренние балансировщики нагрузки. Приостановка HAProxy на этих узлах одновременно привела к немедленному широкому восстановлению.
Шторм повторного запуска в Северной ВА был исправлен 1) временно уменьшая логику повторного запуска шлюза с PR и 2), блокируя входящие запросы токенов службы токенов Copilot на балансировщиках нагрузки с 403, а затем постепенно наращивая трафик на месте, чтобы позволить абонентам добиться успеха.
Остаточные сбои в аутентификации Copilot продолжались, потому что поведение клиента усилило нагрузку: неудавшаяся операция токена могла генерировать много дополнительных запросов и вводить цикл повторного использования. Трафик службы токенов Copilot увеличился с обычных 7-9K RPS до 70-100K RPS. Уменьшение повторов аутентификации шлюза и блокировка ответов на повторный запуск стабилизировали сервис токенов Copilot и завершили восстановление.
Сложные факторы, препятствующие восстановлению, включали в себя ряд атак на конечные точки кодовой нагрузки.
Чтобы предотвратить повторение, наши последующие действия включают:
- Корректировка политик автомасштабирования для учета параллелизма и емкости коляски служебной сети.
Аудит запроса Istio, параллелизм и масштабирование ограничений по затронутым услугам.
Обзор ограничений повторного использования и обратного поведения через шлюзы и клиентов.
- Обращение к поведению повторного использования VS-кода, которое усилило трафик токенов Copilot.
- Совершенствование мониторинга нагрузочно-балансового потенциала и региональных гарантий отказа.
Автоматический перевод официального обновления инцидента.
Синхронизация с GHEC Team Sync
Начало 13 августа 2026 г. в 16:21 UTC · 2h 6m
IssuesНезначительный инцидент
investigating
Мы расследуем сообщения о воздействии на производительность некоторых сервисов GitHub.
investigating
GHEC Team Sync в настоящее время ухудшается для предприятий с личными счетами, что приводит к задержкам при синхронизации команд с группами IdP. Мы определили причину задержек и работаем над смягчением последствий. Мы предоставим обновленную информацию о нашем прогрессе в 20:00 UTC.
investigating
Мы развернули смягчение. В это время GHEC Team Sync восстановила для предприятий личные счета. Команды, синхронизирующиеся с группами IdP, вернулись к нормальной каденции.
resolved
13 августа 2026 года с 15:31:21 UTC до 18:27:55 UTC синхронизация команды GitHub Enterprise Cloud была деградирована для предприятий, использующих персональные аккаунты. При синхронизации с группами IdP организационные команды испытывали задержки до 3-13 часов (среднее 8 часов), что приводило к задержкам в предоставлении или удалении доступа для корпоративных пользователей в 2,8% команд.
Временное изменение, введенное для решения предыдущей проблемы из-за увеличения использования этой функции, оставалось активным после ее удаления, вызывая задержки синхронизации в периоды большого объема. Мы сняли временные изменения и предоставили дополнительные ресурсы для обработки увеличенного объема.
Автоматический перевод официального обновления инцидента.
Инцидент с Webhooks
Начало 13 августа 2026 г. в 14:45 UTC · 51m
IssuesНезначительный инцидент
Затронутые компоненты
IssuesPackagesPull RequestsWebhooksGit Operations
investigating
Мы расследуем сообщения о ухудшении производительности для Webhooks
investigating
Pull Requests испытывает ухудшение производительности. Мы продолжаем расследование.
investigating
Проблемы испытывают ухудшение производительности. Мы продолжаем расследование.
investigating
Git Operations испытывает ухудшение производительности. Мы продолжаем расследование.
investigating
Пакеты испытывают ухудшение производительности. Мы продолжаем расследование.
investigating
В настоящее время мы изучаем краткое ухудшение обслуживания для операций Git (в частности, push), проблем, запросов на извлечение, реестра пакетов и веб-хуков между 14:32 и 14:46 UTC. Мы определили источник деградации и изучаем стратегии смягчения последствий для предотвращения рецидивов.
monitoring
Деградация, затрагивающая операции Git, проблемы, пакеты, запросы Pull и веб-хуки, была смягчена. Мы проводим мониторинг для обеспечения стабильности.
monitoring
Мы временно отключили фоновую работу, которая вызвала воздействие. В это время воздействие полностью смягчается.
resolved
Между 14:24 и 14:53 UTC 13 августа 2026 года обычная фоновая работа по удалению организации перегружала ключевую общую базу данных, в результате чего несколько сервисов GitHub кратковременно возвращали повышенные ошибки и более медленные ответы. Больше всего пострадал API управления веб-хуками, с меньшим влиянием на операции Git, запросы, проблемы, пакеты, вход и Copilot. Воздействие прояснилось само по себе примерно в 14:53 UTC после завершения работы; мы решили инцидент в 15:36 UTC.
Пострадавшие пользователи, возможно, испытали кратковременное увеличение ошибок и более медленных ответов, в первую очередь при создании, листинге или обновлении веб-хуков, с меньшими последствиями для выполнения запросов, проблем, пакетов и операций Git. Неудачи достигли максимума около 1% в течение нескольких минут около 14:37 UTC.
Чтобы предотвратить будущие инциденты, мы уже отправили обновление, которое включает более безопасный путь удаления для организаций, а также ограничения на удержания удаления в базах данных. Основываясь на этих изменениях, мы проверяем все работы по массовому удалению и очистке, которые пишут в общие базы данных, чтобы предотвратить подобные проблемы в будущем.
Автоматический перевод официального обновления инцидента.
Ошибки модели Fable 5 в копилоте
Начало 13 августа 2026 г. в 14:43 UTC · 1h 4m
IssuesНезначительный инцидент
Затронутые компоненты
Copilot AI Model Providers
investigating
Мы расследуем сообщения о ухудшении производительности для поставщиков моделей Copilot AI
investigating
Мы испытываем ухудшение доступности модели Fable 5 для продуктов Copilot и поверхностей IDE. Это связано с проблемой с поставщиком восходящей модели. Пока мы работаем с ними, чтобы решить проблему, мы рекомендуем выбрать другую модель или выбрать Auto, чтобы продолжить использовать Copilot.
investigating
Мы наблюдаем умеренное восстановление, но все еще испытываем ухудшение доступности модели Fable 5 в продуктах Copilot и поверхностях IDE. Это связано с проблемой с поставщиком восходящей модели. Пока мы работаем с ними, чтобы решить проблему, мы рекомендуем выбрать другую модель или выбрать Auto, чтобы продолжить использовать Copilot.
investigating
Проблемы с нашим поставщиком моделей были решены, и Fable 5 снова доступен в продуктах Copilot и поверхностях IDE.
Мы продолжим мониторинг, чтобы обеспечить стабильность, но смягчение последствий завершено.
resolved
13 августа 2026 года, между примерно 14:06 и 15:47 UTC, сервис Copilot испытал деградацию модели Claude Fable 5 из-за проблемы с нашим провайдером. Пользователи столкнулись с повышенным уровнем ошибок, достигнув максимума в 43% и в среднем 12%. Пользователи, которые выбрали авто или альтернативные модели, не пострадали.
Проблема была решена путем смягчения, введенного в действие нашим поставщиком. GitHub работает с нашим провайдером для дальнейшего повышения отказоустойчивости сервиса для предотвращения подобных инцидентов в будущем.
Автоматический перевод официального обновления инцидента.