Stiamo indagando sui rapporti delle prestazioni incise per alcuni servizi GitHub.
resolved
Questo incidente è stato risolto. Grazie per la vostra pazienza e comprensione come abbiamo affrontato questo problema. Un'analisi dettagliata della causa radice sarà condivisa non appena è disponibile.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Disruzione con Copilot Code Review
Inizio 4 settembre 2026 alle ore 20:39 UTC · 1h 48m
OutageIncidente maggiore
investigating
Stiamo indagando sui rapporti delle prestazioni incise per alcuni servizi GitHub.
investigating
Alcuni utenti possono sperimentare guasti quando si utilizza Copilot codice recensione. Abbiamo identificato la causa principale e stiamo lavorando ad una mitigazione.
investigating
Stiamo applicando la mitigazione e ci aspettiamo il recupero entro circa 30 minuti.
monitoring
Il degrado è stato mitigato. Stiamo monitorando per garantire la stabilità.
resolved
Questo incidente è stato risolto. Grazie per la vostra pazienza e comprensione come abbiamo affrontato questo problema. Un'analisi dettagliata della causa radice sarà condivisa non appena è disponibile.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Incidente con Grok Copilot AI Model Provider
Inizio 3 settembre 2026 alle ore 14:17 UTC · 2h 54m
IssuesIncidente minore
Componenti interessati
Copilot AI Model Providers
investigating
Stiamo indagando i rapporti delle prestazioni degradate per i fornitori di modelli AI Copilot
investigating
Stiamo vivendo la disponibilità degradata per il modello Grok 4.6 in Copilot Chat, VS Code e altri prodotti Copilot. Ciò è dovuto a un problema con un fornitore di modelli a monte. Stiamo lavorando con loro per risolvere il problema.
investigating
Il modello Grok 4.5 ha anche degradato la disponibilità. Stiamo lavorando con il provider a monte per risolvere il problema.
investigating
I problemi con il nostro fornitore di modelli a monte sono stati risolti e i modelli Grok sono ancora una volta disponibili nei prodotti Copilot e nelle superfici IDE.
Continueremo a monitorare per garantire la stabilità, ma la mitigazione è completa.
resolved
Questo incidente è stato risolto. Grazie per la vostra pazienza e comprensione come abbiamo affrontato questo problema. Un'analisi dettagliata della causa radice sarà condivisa non appena è disponibile.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Delays in commit processing
Inizio 1 settembre 2026 alle ore 15:00 UTC · 1h 1m
IssuesIncidente minore
Componenti interessati
Pull Requests
investigating
Stiamo indagando sui rapporti delle prestazioni degradate per Pull Requests
investigating
I diff nella vista PR possono essere stanti per diversi minuti. Stiamo indagando e scalando le risorse.
investigating
Il tempo per aggiornare i diff di richiesta pull è migliorato alle normali soglie.
resolved
Questo incidente è stato risolto. Grazie per la vostra pazienza e comprensione come abbiamo affrontato questo problema. Un'analisi dettagliata della causa radice sarà condivisa non appena è disponibile.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Tasso elevato di errori per modelli OpenAI forniti da Copilot
Inizio 31 agosto 2026 alle ore 09:15 UTC · 42m
IssuesIncidente minore
Componenti interessati
Copilot AI Model Providers
investigating
Stiamo indagando i rapporti delle prestazioni degradate per i fornitori di modelli AI Copilot
investigating
Copilota sta vivendo un tasso più elevato di errori per i modelli OpenAI, tra cui gpt-5.2, gpt-5.3-codex, gpt-5.4, gpt-5.4, e la famiglia gpt-5.6 di modelli. Altri modelli non sono influenzati.
investigating
Uno dei nostri fornitori di modelli ha confermato un incidente alla fine. Abbiamo fornito loro i dettagli per aiutare a identificare il problema. Stiamo iniziando a vedere il recupero.
monitoring
Il degrado dei fornitori di modelli AI copilota è stato mitigato. Stiamo monitorando per garantire la stabilità.
monitoring
I problemi con il nostro fornitore di modelli a monte sono stati risolti, e gpt-5.3-codex, gpt-5.4-mini, gpt-5.4-nano, gpt-5.5, e la famiglia gpt-5.6 dei modelli sono ancora una volta disponibili nei prodotti Copilot e nelle superfici IDE.
Continueremo a monitorare per garantire la stabilità, ma la mitigazione è completa.
resolved
Tra le 08:37 e le 09:41 UTC il 31 agosto 2026, GitHub Copilot ha sperimentato il degrado che colpisce diversi modelli GPT, tra cui gpt-5.2, gpt-5.3-codex, gpt-5.4, gpt-5.4-mini, gpt-5.4-nano, e la famiglia gpt-5.6 (Luna, Sol e Terra). Gli utenti hanno riscontrato tassi di errore elevati e risposte di streaming interrotte. Altri modelli non sono stati colpiti.
Il degrado è stato causato da un problema con un fornitore di modelli a monte. Gli ingegneri GitHub hanno rilevato il problema attraverso il monitoraggio automatizzato, hanno visualizzato avvisi in-product per i modelli interessati, e coordinato con il fornitore. Il servizio è tornato alla normalità dopo che il fornitore ha implementato una mitigazione.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Incidente con i fornitori di modelli AI Copilot
Inizio 27 agosto 2026 alle ore 10:04 UTC · 2h 8m
OutageIncidente critico
Componenti interessati
Copilot AI Model Providers
investigating
Stiamo indagando i rapporti di disponibilità degradata per i fornitori di modelli AI Copilot
investigating
Stiamo sperimentando disponibilità degradata per il modello Kimi K3 nei prodotti Copilot e nelle superfici IDE. Ciò è dovuto a un problema con un fornitore di modelli a monte. Mentre lavoriamo con loro per risolvere il problema, si consiglia di scegliere un altro modello o selezionare 'Auto' per continuare a utilizzare Copilot.
investigating
Copilota AI Model Providers sta sperimentando prestazioni degradate. Stiamo continuando a indagare.
investigating
I problemi con il nostro fornitore di modelli a monte sono stati mitigati, e Kimi K3 è ancora una volta disponibile nei prodotti Copilot e nelle superfici IDE.
Continueremo a monitorare per garantire la stabilità.
resolved
Il 27 agosto 2026, tra le 09:20 e le 12:14 UTC, il servizio Copilot ha sperimentato un degrado del modello Kimi K3 a causa di un problema con il nostro fornitore a monte. Gli utenti hanno riscontrato tassi di errore elevati quando si utilizza Kimi K3. Nessun altro modello è stato influenzato.
Il problema è stato risolto da una mitigazione messa in atto dal nostro fornitore. GitHub sta lavorando con il nostro fornitore per migliorare ulteriormente la resilienza del servizio per prevenire incidenti simili in futuro.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Incidente con Azioni e Richieste
Inizio 26 agosto 2026 alle ore 22:56 UTC · 1h 30m
IssuesIncidente minore
Componenti interessati
Pull RequestsActions
investigating
Stiamo indagando i rapporti delle prestazioni degradate per Azioni e Richieste
investigating
Stiamo indagando su ritardi e timeout elevati che interessano Azioni flusso di lavoro attivato da eventi di richiesta pull. Il 20% delle azioni ha ritardato gli inizi di oltre 5 minuti e fino al 4% delle piste non è riuscito a innescare. Stiamo lavorando attivamente sulla mitigazione e fornirà aggiornamenti come si impara di più.
investigating
Abbiamo applicato le mitigazioni e stiamo vedendo il recupero in Azioni flusso di lavoro e bloccata pull richiesta si fonde. Stiamo continuando a monitorare per la salute continua di unione crea commit prima di risolvere.
investigating
Abbiamo confermato il recupero completo a partire alle 23:58 UTC. Le operazioni di flusso di lavoro di azioni e tirare le operazioni di richiesta sono operative normalmente. Ora risolveremo l'incidente mentre continuiamo a monitorare la salute dei servizi.
monitoring
Il degrado delle azioni e delle richieste di estrazione è stato mitigato. Stiamo monitorando per garantire la stabilità.
resolved
Il 26 agosto 2026, dalle 21:55 UTC alle 23:58 UTC, il 2,6% dei flussi di lavoro attivati da eventi di richiesta pull sono stati ritardati, con l'impatto che sale fino al 25% al suo picco. Alcuni utenti hanno anche sperimentato ritardi nella richiesta di richiesta di fusione-commit di generazione, informazioni di fusione, e disponibilità di un pulsante unico. Azioni e richieste di estrazione completamente recuperato da 23:58 UTC; l'incidente è stato risolto alle 00:26 UTC dopo il normale funzionamento è stato confermato.
I lavori di sfondo che elaborano gli aggiornamenti della richiesta e generano i commit di fusione sono stati influenzati da timeout che raggiungono una singola partizione di dati git. Ciò ha portato a un backlog in pull request merge-commit elaborazione, ritardando pull richiesta-triggered GitHub Azioni flussi di lavoro e alcune informazioni di fusione.
Abbiamo ridotto il carico di lavoro, spostato il traffico dall'infrastruttura interessata e ripristinato il componente di servizio interessato a uno stato sano. Insieme, queste azioni hanno aiutato a drenare il backlog e ripristinare le operazioni normali.
Stiamo lavorando per migliorare il rilevamento della saturazione delle risorse e per eliminare l'impatto del cliente in questo scenario isolando l'impatto, mettendo i limiti migliori sui retries, e rafforzare la backpressure per rendere i nostri sistemi più resilienti sotto carico.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Disturbo con GitHub Billing
Inizio 26 agosto 2026 alle ore 20:40 UTC · 4h 11m
IssuesIncidente minore
investigating
Stiamo indagando sui rapporti delle prestazioni incise per alcuni servizi GitHub.
investigating
Stiamo attualmente indagando sugli errori aumentati con i servizi di fatturazione. I clienti possono osservare i carichi della pagina di bilancio di fatturazione falliti e gli utenti del Copilot CLI possono osservare i guasti che iniziano o continuano le sessioni.
investigating
Abbiamo applicato una mitigazione per sbloccare l'uso di Copilot e abbiamo osservato il recupero per questo particolare impatto. Stiamo continuando a indagare e ad applicare le mitigazioni per la disgregazione della pagina di fatturazione durante il monitoraggio per garantire che Copilot rimanga recuperato.
investigating
Stiamo continuando a monitorare la mitigazione che abbiamo richiesto per l'interruzione della pagina di fatturazione.
investigating
La nostra mitigazione è ancora in possesso mentre continuiamo a indagare per trovare la causa principale.
investigating
La nostra mitigazione continua a mantenere e le condizioni di servizio rimangono stabili. Stiamo continuando a indagare sul carico di lavoro concentrato responsabile della questione e stiamo preparando ulteriori miglioramenti preventivi. Non abbiamo identificato un cambiamento materiale dell'impatto del cliente dal precedente aggiornamento. Forneremo un altro aggiornamento mentre l'indagine progredisce.
investigating
Nessun cambiamento materiale dal precedente aggiornamento. Le condizioni di servizio rimangono stabili dopo la mitigazione, e non abbiamo osservato alcun ulteriore impatto del cliente. Stiamo monitorando attivamente il servizio durante l'implementazione di correzioni mirate per affrontare la causa principale sottostante.
resolved
Il 26 agosto 2026, tra le 20:40 UTC e le 00:51 UTC il 27 agosto, GitHub Billing ha sperimentato le prestazioni degradate che interessano le pagine di bilancio di fatturazione e le sessioni CLI di GitHub Copilot. I clienti interessati hanno incontrato carichi o guasti di pagina di bilancio non riusciti durante l'avvio o la continua sessione CLI. Abbiamo confermato questo impatto per un piccolo numero di clienti (±1%).
Ciò è stato causato da un carico di lavoro concentrato che ha creato ritardi di elaborazione nel nostro livello di archiviazione dati. I ripetitori automatizzati aumentano il carico e prolungano il degrado. Abbiamo mitigato l'incidente riequilibrando il traffico all'interno della nostra infrastruttura.
Stiamo migliorando l'isolamento del carico di lavoro, il comportamento di riprovazione e il rilevamento di carico concentrato per ridurre la probabilità di ricorrenza e accorciare il nostro tempo per rilevare e mitigare incidenti simili.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Incidente con Azioni
Inizio 26 agosto 2026 alle ore 15:11 UTC · 2h 50m
OutageIncidente critico
Componenti interessati
ActionsPages
investigating
Stiamo indagando sui rapporti di disponibilità degradata per le azioni
investigating
Pagine che stanno vivendo le prestazioni degradate. Stiamo continuando a indagare.
investigating
Abbiamo individuato un problema con un database primario e stiamo fallendo su una replica immediatamente
investigating
failover primario brevemente migliorato le prestazioni, ma non ha completamente mitigato, abbiamo accelerato il traffico in entrata e stanno indagando i problemi upstream Vitess
investigating
Crediamo di aver identificato e affrontato il problema e stiamo dilagando il traffico lentamente per assicurarci che non si ripeta. Alcuni clienti continueranno a vedere ritardi mentre ci dilaghiamo.
investigating
Le pagine funzionano normalmente.
investigating
Stiamo continuando a osservare il recupero e le code ritardate stanno bruciando. Alcuni clienti continueranno a vedere i ritardi aumentati fino a quando non è stato completato tutto il lavoro scoppiato - ci aspettiamo che questo entro la prossima ora.
investigating
Continuiamo a osservare il recupero e ci aspettiamo che le azioni in entrata code tornino alla normalità in <30min. Il lavoro continuerà a scorrere attraverso il sistema soggetto a limiti di convalutazione per-customer.
monitoring
Il degrado delle azioni è stato mitigato. Stiamo monitorando per garantire la stabilità.
monitoring
Tutte le code in entrata sono state recuperate e Actions funziona come previsto. 3,7% dei posti di lavoro assegnati ai corridori più grandi durante la fase iniziale di questo incidente sono bloccati in attesa di incarico corridore. Quelle saranno cancellate entro un'ora. Altri corridori stanno elaborando con successo tutti i nuovi lavori.
resolved
Il 26 agosto 2026 dalle 15:02 alle 15:45 UTC, Azioni lavori non sono iniziati. Le seguenti 2 ore fino alle 17:40 UTC, le azioni sono state ritardate a partire da più di 5 minuti come il sistema catturato con carico ritardato. Questo impatto è stato innescato dalla saturazione delle scritture al database primario utilizzato dai trigger di elaborazione dei servizi per flussi di lavoro Azioni. Il primario è stato fallito, ma il sistema non ha completamente recuperato. La saturazione è stata causata dal crescente carico di picco giornaliero combinato con un problema a monte nell’infrastruttura di elaborazione eventi di GitHub, https://www.githubstatus.com/incidents/hcbtzksccj2f, che ha causato l’amplificazione di carico già alto. Gli abbagliatori a valle che sono stati successivamente utilizzati per recuperare sono stati impostati ~10% troppo alto per proteggere il sistema.
A 15:45 UTC, throttling combinato con riavviamenti di servizio recuperato la salute principale del servizio. Quei tredici sono stati gradualmente sollevati tra 15:54 e 17:22 per ripristinare l'elaborazione completa di webhook per le operazioni di azioni. Questa rampa è stata volutamente lenta per garantire che non abbiamo ri-overwhelm il sistema dato il nostro throttling originale era ora noto per essere impostato in modo errato. La coda di eventi webhook è stata completamente bruciata alle 17:40 UTC.
Il 3,7% dei posti di lavoro più grandi, insieme ad alcuni posti di lavoro self-hosted in scala, è rimasto bloccato in coda o “aspettando per il corridore” stato. Abbiamo dispiegato un cambiamento per i posti di lavoro a favore della forza in questo stato, e si sono trasferiti a fallito a 18:40 UTC, circa 50 minuti dopo la mitigazione degli incidenti. Rilascio di questi lavori anche liberato ha ospitato la convalutazione per posti di lavoro più grandi.
I clienti che utilizzano gruppi di concurrency hanno visto un impatto più lungo a causa di un problema separato in cui i corridori assegnati a un sottoinsieme di posti di lavoro scollegato prima che la mitigazione della forza-ritorno è stata dispiegata, che ha impedito l'acquisizione del corridore dal progresso e dalla sinistra posti di lavoro in uno stato di attesa-per-runner. Questo è stato risolto alle 01:00 UTC il 27 agosto.
Alcune piste innescate durante la finestra incidente 15:02-15:45 UTC incontrato un bug che li ha lasciati mostrare come in coda anche dopo il recupero di servizio. Nel backend, queste piste avevano già fallito e si trasferiranno automaticamente allo stato cancellato 24 ore dopo la creazione. Come follow-up, stiamo fissando la causa principale di questo stato in coda e migliorare la nostra capacità di rinfusa-cancellare le piste colpite.
Diversi cambiamenti per migliorare la scalabilità generale di questa parte di Azioni erano già completati e distribuivano alla produzione. Il rollout di tali modifiche sarà completato entro le prossime 24 ore. Ulteriori lavori per migliorare la scala, la resilienza e la degradazione più graziosa dei flussi di lavoro di Azioni sono in volo. Stiamo anche prendendo un elemento di riparazione per accelerare la compensazione di posti di lavoro in coda bloccati o in attesa in casi futuri simili.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Disturbo con alcuni servizi GitHub
Inizio 26 agosto 2026 alle ore 15:09 UTC · 59m
IssuesIncidente minore
investigating
Stiamo indagando sui rapporti delle prestazioni incise per alcuni servizi GitHub.
resolved
Per ulteriori informazioni, rivolgersi a: https://www.githubstatus.com/incidents/y1t7p9fzrlj2
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Ritardo delle azioni
Inizio 24 agosto 2026 alle ore 13:33 UTC · 31m
IssuesIncidente minore
Componenti interessati
Actions
investigating
Stiamo indagando sui rapporti delle prestazioni degradate per le azioni
investigating
I guasti durante l'interrogazione e l'esecuzione di Azioni lavori per un sottoinsieme di clienti stanno ora risolvendo. Stiamo monitorando per il pieno recupero.
monitoring
Il degrado delle azioni è stato mitigato. Stiamo monitorando per garantire la stabilità.
resolved
Il 24 agosto 2026, tra le 13:33 UTC e le 14:04 UTC, il 3,8% delle azioni esegue i ritardi di inizio sperimentati oltre 5 minuti con l'1,25% delle azioni funziona senza esito.
L'incidente è stato causato da un guasto del disco su un nodo che ospita una delle molte istanze di servizio responsabili per l'elaborazione degli eventi di assegnazione dei corridori. Tipicamente, i baccelli sui nodi non sani vengono rimossi e sostituiti automaticamente senza impatto. In questo caso, anche se il nodo è stato gravemente degradato e incapace di eseguire operazioni su disco, ha continuato a inviare segnali sani, impedendo al sistema di spostare immediatamente il suo lavoro altrove. Durante questo periodo, gli eventi assegnati al componente interessato si sono accumulati fino a quando un riequilibrio automatico reindirizzato elaborazione a componenti sani a 13:54 UTC. Il backlog della coda è stato cancellato alle 14:00 UTC, e l'elaborazione restituita alla normalità entro 14:04 UTC.
Per prevenire una ricorrenza, stiamo migliorando il rilevamento e la bonifica automatica per nodi non sani che non sono completamente offline. Stiamo anche rafforzando la resilienza a livello di applicazione, così i consumatori stallati vengono automaticamente rimossi rapidamente e il loro lavoro riassegnato senza aspettare che il nodo interessato recuperare.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Errori elevati su Fable 5 a causa del fornitore a monte
Inizio 24 agosto 2026 alle ore 07:12 UTC · 47m
OutageIncidente maggiore
Componenti interessati
Copilot AI Model Providers
investigating
Stiamo indagando i rapporti di disponibilità degradata per i fornitori di modelli AI Copilot
investigating
Stiamo sperimentando disponibilità degradata per il modello Fable in prodotti Copilot e superfici IDE. Ciò è dovuto a un problema con il fornitore di modelli a monte. Mentre lavoriamo con loro per risolvere il problema, si consiglia di scegliere un altro modello o selezionare 'Auto' per continuare a utilizzare Copilot.
resolved
Il 24 agosto 2026, tra le 06:35 e le 07:25 UTC, il servizio Copilota ha sperimentato un degrado del modello Claude Fable 5 a causa di un problema con il nostro fornitore a monte. Gli utenti hanno riscontrato elevati tassi di errore durante l'utilizzo di Claude Fable 5, con richieste a volte mancanti mid-response. Nessun altro modello è stato influenzato.
Il problema è stato risolto da una mitigazione messa in atto dal nostro fornitore. GitHub sta lavorando con il nostro fornitore per migliorare ulteriormente la resilienza del servizio per prevenire incidenti simili in futuro.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Operazioni Git degradate su SSH
Inizio 21 agosto 2026 alle ore 14:00 UTC · 7m
Pending
resolved
Il 21 agosto 2026, tra 14:00 e 14:07 UTC, dotcom Le operazioni su SSH sono state degradate. Successo Le operazioni Git su SSH sono diminuite di oltre il 95% durante la finestra di impatto di picco, rendendo clone, fetch, o spingere SSH efficacemente non disponibile per la maggior parte degli utenti per circa quattro minuti. Le operazioni di Git su HTTPS non sono state influenzate.
L'incidente è stato causato da un difetto software nella nostra infrastruttura di bilanciamento del carico che è stato innescato da un cambiamento di configurazione. Il difetto si è verificato solo quando le connessioni sono passate attraverso più strati di bilanciatori di carico che eseguono la nuova configurazione, il che significa che non è stato rilevato durante i test canari.
Abbiamo mitigato l'incidente riportando la modifica della configurazione.
Stiamo aggiungendo la copertura di regressione per le configurazioni multistrato load-balancer e migliorare il monitoraggio e l'avviso per le operazioni Git su SSH per ridurre il nostro tempo di rilevamento e mitigazione di problemi simili in futuro.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Fallimenti intermittenti che creano compiti di agente
Inizio 20 agosto 2026 alle ore 14:43 UTC · 9h 54m
OutageIncidente critico
investigating
Stiamo indagando sui rapporti delle prestazioni incise per alcuni servizi GitHub.
investigating
Gli utenti possono sperimentare ritardi quando si avviano attività utilizzando Copilot Cloud Agent. Stiamo attivamente indagando sul problema e fornirà aggiornamenti come si impara di più.
investigating
Abbiamo identificato la componente problematica e stiamo lavorando per non riuscire a un'istanza sana. Ulteriori aggiornamenti saranno forniti come eseguiamo le mitigazioni.
investigating
Stiamo sperimentando problemi con le attività di Copilot Cloud Agent, con conseguente nuove attività avviate non visualizzando correttamente i progressi in corso. Questi compiti di Copilot Cloud Agent sono ancora in fase di completamento correttamente, ma mancano di una corretta visibilità. Stiamo attivamente indagando sul problema e fornirà aggiornamenti come si impara di più.
investigating
Gli utenti stanno riscontrando ritardi nell'avvio delle attività utilizzando Copilot Cloud Agent e non sono in grado di vedere lo stato di queste attività. I compiti di Copilot Cloud Agent sono ancora in fase di completamento. Abbiamo individuato la causa del problema e stiamo mettendo le mitigazioni in atto per restituire il servizio ai livelli normali. Forneremo un altro aggiornamento circa il tempo di recupero previsto a breve.
investigating
Stiamo vedendo segni di recupero per la visibilità dello stato di attività dell'agente Copilot Cloud, ma questo recupero è più lento di quanto previsto. Stiamo perseguendo ulteriori misure di mitigazione per accelerare il recupero.
investigating
Stiamo osservando il graduale recupero per la visibilità dello stato dell'attività dell'agente Copilot Cloud, con l'uscita della sessione ritardata di circa 1 ora. Abbiamo adottato ulteriori misure per accelerare il recupero e stiamo continuando a monitorare l'impatto.
investigating
Stiamo continuando a osservare il graduale recupero per la visibilità dello stato dell'agente Copilot Cloud, con l'uscita della sessione ritardata di circa un'ora. Abbiamo adottato ulteriori misure per accelerare il recupero e stiamo continuando a monitorare l'impatto.
investigating
Stiamo continuando a osservare il graduale recupero per la visibilità dello stato dell'agente Copilot Cloud, con l'uscita della sessione ritardata di circa un'ora. Abbiamo fatto ulteriori passi per accelerare il recupero e ci aspettiamo che questo avvenga entro l'ora successiva.
investigating
Stiamo continuando a osservare il graduale recupero per la visibilità dello stato dell'agente Copilot Cloud. L'output di sessione continua ad essere ritardato di circa 1 ora in quanto i nostri passi di bonifica hanno effetto.
investigating
Stiamo vedendo un graduale recupero nella visibilità dello stato dell'attività dell'agente Copilot Cloud mentre distribuiamo una correzione per la causa principale. L'output di sessione rimane ritardato di circa un'ora mentre la bonifica continua.
resolved
Tra le 13:57 UTC il 20 e 00:37 UTC il 21 agosto 2026, alcuni utenti del Copilot Cloud Agent hanno sperimentato ritardi fino a 60 a 90 minuti nel vedere lo stato e i risultati delle loro attività di agente. I compiti stessi dell'agente hanno continuato a funzionare e completare durante questo periodo; solo la visibilità del loro stato è stato ritardato.
La causa era un outage regionale in un servizio di database cloud di terze parti che Copilot utilizza per memorizzare lo stato dell'attività dell'agente. Abbiamo fallito sul database interessato in una regione sana, capacità di elaborazione aggiunta per lavorare attraverso il backlog, e il funzionamento normale ripristinato una volta che il servizio sottostante recuperato. Nessun dato di attività è stato perso durante l'incidente.
Per evitare la ripetizione di incidenti simili, stiamo rimuovendo la configurazione del database che ci ha resi vulnerabili a questo outage regionale e migliorare le nostre procedure di failover del database.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Fallimenti intermittenti nelle pagine del gruppo runner e dei permessi correlati al runner
Inizio 18 agosto 2026 alle ore 05:02 UTC · 6h 28m
IssuesIncidente minore
investigating
Stiamo indagando sui rapporti delle prestazioni incise per alcuni servizi GitHub.
monitoring
Stiamo indagando i rapporti di non caricare i gruppi di corridori e le autorizzazioni relative ai corridori per i clienti che utilizzano i corridori più grandi.
monitoring
Abbiamo identificato la fonte di un problema di comunicazione tra i servizi Azioni e stiamo lavorando per mitigare. I clienti possono sperimentare il mancato caricamento dei gruppi di corridori e dei problemi relativi alle autorizzazioni del runner quando si utilizza Larger Runners.
monitoring
Abbiamo applicato una mitigazione e stiamo vedendo segnali di recupero. Continueremo a monitorare il recupero e fornire aggiornamenti.
resolved
Il 18 agosto 2026, tra 05:02 UTC e 11:30 UTC, i clienti non sono stati in grado di visualizzare o gestire Azioni Runners e Runner Groups attraverso il GitHub UI e API.
Il problema è stato causato da fallimenti nelle richieste di backend di lettura dei dati del gruppo runner e runner. I guasti sono stati causati da un certificato di autenticazione scaduto unico a questo servizio. Il certificato era stato ruotato in KeyVault, ma un passo per consentire l'uso a tempo di esecuzione era stato sospeso per evitare il ripetersi di incidenti precedenti innescati da questa operazione.
L'impatto è stato mitigato completando l'attivazione del nuovo certificato nel sistema backend. Abbiamo aggiunto un ulteriore monitoraggio a questo e altri certificati. Questo servizio è anche nel processo di essere sostituito come parte del nostro lavoro di disponibilità e scala, portando questo percorso di autenticazione e gestione segreta in linea con i modelli in tutti i servizi GitHub.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Incidente con Azioni
Inizio 18 agosto 2026 alle ore 05:02 UTC · 6h 28m
OutageIncidente maggiore
investigating
Stiamo indagando sui rapporti delle prestazioni incise per alcuni servizi GitHub.
resolved
Il 18 agosto 2026, tra le 05:02 UTC e le 11:30 UTC, i clienti non sono stati in grado di eseguire lavori su Actions Larger Runners e non sono stati in grado di visualizzare o gestire Azioni Runners e Runner Groups attraverso il GitHub UI e API.
Questi problemi sono stati causati da fallimenti nelle richieste di backend che risolvono i metadati essenziali per l'avvio dei flussi di lavoro più grandi Runner e per la lettura dei dati del gruppo runner e runner. I guasti sono stati causati da un certificato di autenticazione scaduto unico a questo servizio. Il certificato era stato ruotato in KeyVault, ma un passo per consentire l'uso a tempo di esecuzione era stato sospeso per evitare il ripetersi di incidenti precedenti che erano stati attivati da questa operazione.
Abbiamo mitigato i problemi completando l'attivazione del nuovo certificato nel sistema backend. Abbiamo aggiunto un ulteriore monitoraggio a questo e altri certificati. Il relativo servizio è anche nel processo di essere sostituito come parte del nostro lavoro di disponibilità e scala, portando questo percorso di autenticazione e gestione segreta in linea con i modelli in tutti i servizi GitHub.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Stiamo indagando sui rapporti delle prestazioni incise per alcuni servizi GitHub.
investigating
API Richieste sta sperimentando le prestazioni degradate. Stiamo continuando a indagare.
investigating
Le azioni stanno vivendo prestazioni degradate. Stiamo continuando a indagare.
investigating
Stiamo vedendo un tasso di errore di circa il 20% in numerose esperienze, tra cui Pull Requests, Issues e altri. Le indagini sono attualmente in corso e noi pubblicheremo aggiornamenti come diventano disponibili
investigating
Pull Requests sta vivendo prestazioni degradate. Stiamo continuando a indagare.
investigating
Stiamo vivendo alti tassi di errore circa il 20% per le esperienze web e traffico api. Archivi download e download di contenuti di repository grezzi stanno vivendo un tasso di errore del 50% circa. Le indagini sono in corso nella causa principale, e gli aggiornamenti continueranno a essere forniti come si indaga.
investigating
Stiamo vivendo alti tassi di errore circa il 20% per le esperienze web e traffico api. Archivi download e download di contenuti di repository grezzi stanno vivendo un tasso di errore del 50% circa. Anche l'autenticazione SAML e OIDC, SCIM e Team Sync hanno un impatto. Le indagini sono in corso e continueremo a fornire aggiornamenti mentre scopriamo ulteriori informazioni.
investigating
Copilota sta vivendo disponibilità degradata. Stiamo continuando a indagare.
investigating
I problemi stanno vivendo disponibilità degradata. Stiamo continuando a indagare.
investigating
Pull Requests sta vivendo disponibilità degradata. Stiamo continuando a indagare.
investigating
Le azioni stanno vivendo disponibilità degradata. Stiamo continuando a indagare.
investigating
Stiamo vivendo alti tassi di errore circa il 20% per le esperienze web e traffico api. Archivi download e download di contenuti di repository grezzi stanno vivendo un tasso di errore del 50% circa. Anche l'autenticazione SAML e OIDC, SCIM e Team Sync hanno un impatto. Attualmente stiamo effettuando mitigazioni basate sulla nostra indagine finora e stiamo monitorando per il miglioramento.
investigating
Webhooks sta vivendo la disponibilità degradata. Stiamo continuando a indagare.
investigating
Pagine che stanno vivendo le prestazioni degradate. Stiamo continuando a indagare.
investigating
Webhooks sta sperimentando le prestazioni degradate. Stiamo continuando a indagare.
investigating
Stiamo vivendo alti tassi di errore circa il 20% per le esperienze web e traffico api. Archivi download e download di contenuti di repository grezzi stanno vivendo un tasso di errore del 50% circa. Anche l'autenticazione SAML e OIDC, SCIM e Team Sync hanno un impatto. Stiamo attualmente eseguendo mitigazioni e pubblicheremo aggiornamenti mentre progrediamo.
investigating
Stiamo vivendo alti tassi di errore circa il 20% per le esperienze web e traffico api. Archivi download e download di contenuti di repository grezzi stanno vivendo un tasso di errore del 50% circa. Anche l'autenticazione SAML e OIDC, SCIM e Team Sync hanno un impatto. Stiamo ancora lavorando per identificare la causa principale e continueremo a pubblicare gli aggiornamenti come si impara di più e eseguire la mitigazione.
investigating
Abbiamo identificato la componente problematica e abbiamo preso azioni correttive. Ci sono forti segni di recupero ma stiamo ancora lavorando per ripristinare completamente il servizio, con i tassi di errore ancora rimanenti leggermente elevati. pubblicheremo ulteriori aggiornamenti mentre il recupero continua.
investigating
Il degrado delle richieste API, azioni, operazioni Git, questioni, pagine, richieste di estrazione e Webhooks è stato mitigato. Stiamo monitorando per garantire la stabilità.
investigating
Git Operations sta sperimentando prestazioni degradate. Stiamo continuando a indagare.
investigating
Abbiamo identificato il componente problematico e abbiamo preso azioni correttive, ma stiamo vedendo l'impatto residuo su numerosi servizi. Stiamo continuando ad applicare ulteriori mitigazioni e indagare sull'impatto rimanente.
investigating
I problemi stanno vivendo prestazioni degradate. Stiamo continuando a indagare.
investigating
Abbiamo identificato il componente problematico e abbiamo preso azioni correttive, ma stiamo vedendo l'impatto residuo sotto forma di errori di autenticazione sporadici. Stiamo continuando ad applicare ulteriori mitigazioni e indagare sull'impatto rimanente.
investigating
Il degrado delle operazioni Git è stato mitigato. Stiamo monitorando per garantire la stabilità.
investigating
API Requests sta vivendo la disponibilità degradata. Stiamo continuando a indagare.
investigating
API Richieste funziona normalmente.
investigating
Stiamo continuando a indagare su errori di autenticazione sporadici. Abbiamo parzialmente disattivato i ripetitori di autenticazione e abbiamo visto miglioramenti, e stiamo monitorando l'impatto prima di applicare pienamente questa mitigazione.
investigating
Stiamo continuando a indagare su errori sporadici che interessano l'autenticazione Copilot in alcune applicazioni. L'utilizzo del copilota tramite l'app GitHub CLI e GitHub non sono influenzati.
investigating
I problemi funzionano normalmente.
investigating
Stiamo continuando ad applicare mitigazioni per affrontare i guasti sporadici di autenticazione Copilot in alcune applicazioni. Ci aspettiamo il recupero completo entro i prossimi 30 minuti. L'utilizzo del copilota tramite l'app GitHub CLI e GitHub non sono influenzati.
resolved
Il 17 agosto 2026, a partire da 13:28–21:15 UTC (7h 47m), GitHub.com ha sperimentato errori e latenza elevati tra i problemi, Pull Requests, APIs, Actions e Copilot. Al picco, i tassi di errore web/API erano circa il 20%, mentre i download di archivio e contenuti grezzi hanno raggiunto circa il 50%. Anche l'autenticazione SAML/OIDC, SCIM e Team Sync sono stati colpiti, così come i flussi di lavoro di Azioni in GHEC con Data Residency che dipendono dalle definizioni dei passi del flusso di lavoro pubblico ospitate su GitHub.com. La maggior parte dei servizi recuperati da 16:36 UTC come il nostro centro dati centrale degli Stati Uniti recuperato; Azioni è stato degradato fino a circa 18:03 UTC; e Copilot Token Service completamente recuperato da 21:02.
Alcuni del traffico fallito è stato spostato da Stati Uniti centrale a Virginia del Nord dove è stato servito con successo fino a quando il fallimento della rete negli Stati Uniti centrale è stato debugged e risolto. Risposte in ritardo a un singolo endpoint interno hanno innescato un latente bug retry in codice VS che ha amplificato il traffico di circa 10x e ha causato il recupero ritardato per il Servizio Token Copilot.
La causa immediata del fallimento è stata la saturazione di rete sui bilanciatori di carico negli Stati Uniti centrali a causa di un nuovo picco nel traffico. Originariamente questo è stato causato da un sidecar pod Istio che raggiunge i suoi limiti di concurrency e non riesce a scalare correttamente a causa di una politica non configurata che ha guardato il servizio host ma non i limiti sidecar. Un fallimento cascaded a più e alla fine quattro nodi HAProxy esauriscono i loro limiti di flusso, degradando il percorso gateway auth e causando latenza diffusa di autenticazione e guasti. Il problema è stato aggravato dalla logica di riprovazione ottimistica che ha sovraccaricato i bilanciatori del carico interno. Pausing HAProxy su quei nodi ha prodotto simultaneamente immediato ampio recupero.
Il retry storm in Northern VA è stato fissato da 1) temporaneamente riducendo la logica di retry gateway con una PR e 2) bloccando in entrata Copilot Token Service token richieste ai bilancieri di carico con un 403, e poi gradualmente dilagare il traffico per-sito per consentire ai chiamanti di avere successo.
I guasti di autenticazione Copilota residuo sono continuati perché il comportamento di riprovazione del cliente ha amplificato il carico: un'operazione di token non riuscita potrebbe generare molte richieste extra e inserire un loop di riprovazione. Il traffico di Copilot Token Service è aumentato da un normale RPS 7–9K a 70–100K RPS. Ridurre i retries di autenticazione del gateway e bloccare le risposte retry-triggering stabilizzato Copilot Token Service e il recupero completato.
I fattori complicanti che ostacolavano il recupero includevano un certo numero di attacchi di raschiamento su endpoint di codeload.
Per prevenire il ripetersi, le nostre azioni di follow-up includono:
- Correggere le politiche di autoscaling per tenere conto della convalutazione e della capacità del sidecar service-mesh.
- Auditing della richiesta di Istio, della convalutazione e dei limiti di scaling nei servizi interessati.
- Revisione dei limiti di retry e del comportamento di backoff attraverso i gateway e i clienti.
- Rivolgendosi al comportamento di riprova del codice VS che ha amplificato il traffico di token Copilot.
- Migliorare il monitoraggio delle capacità di bilanciamento del carico e le garanzie di failover regionali.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Disturbo con GHEC Team Sync
Inizio 13 agosto 2026 alle ore 16:21 UTC · 2h 6m
IssuesIncidente minore
investigating
Stiamo indagando sui rapporti delle prestazioni incise per alcuni servizi GitHub.
investigating
GHEC Team Sync è attualmente degradato per le imprese con account personali, causando ritardi nella sincronizzazione dei gruppi IdP. Abbiamo identificato la causa dei ritardi e stiamo lavorando ad una mitigazione. Forniremo un aggiornamento sui nostri progressi alle 20:00 UTC.
investigating
Abbiamo implementato una mitigazione. In questo momento GHEC Team Sync ha recuperato per le imprese con account personali. Le squadre che si sincronizzano con i gruppi IdP sono tornate alla loro normale cadenza.
resolved
Il 13 agosto 2026, da 15:31:21 UTC a 18:27:55 UTC, GitHub Enterprise Cloud team sincronizzazione è stato degradato per le imprese che utilizzano account personali. I team organizzativi hanno subito ritardi fino a 3-13 ore (media 8 ore) durante la sincronizzazione con i gruppi IdP, con conseguente ritardo di accesso o di rimozione per gli utenti aziendali attraverso il 2,8% delle squadre.
Un cambiamento temporaneo introdotto per affrontare un problema precedente a causa di un aumento dell'utilizzo di questa funzione è rimasto attivo dopo che era destinato a essere rimosso, causando ritardi di sincronizzazione durante i periodi di alto volume. Abbiamo rimosso il cambiamento temporaneo e fornito ulteriori risorse per gestire il volume aumentato.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Incidente con Webhooks
Inizio 13 agosto 2026 alle ore 14:45 UTC · 51m
IssuesIncidente minore
Componenti interessati
IssuesPackagesPull RequestsWebhooksGit Operations
investigating
Stiamo indagando i rapporti delle prestazioni degradate per Webhooks
investigating
Pull Requests sta vivendo prestazioni degradate. Stiamo continuando a indagare.
investigating
I problemi stanno vivendo prestazioni degradate. Stiamo continuando a indagare.
investigating
Git Operations sta sperimentando prestazioni degradate. Stiamo continuando a indagare.
investigating
I pacchetti stanno vivendo prestazioni degradate. Stiamo continuando a indagare.
investigating
Stiamo attualmente indagando su un breve degrado di servizio per le operazioni Git (in particolare spinte), problemi, richieste di tiro, registro dei pacchetti e webhooks tra 14:32 e 14:46 UTC. Abbiamo identificato la fonte del degrado e stiamo indagando sulle strategie di mitigazione per prevenire il ripetersi.
monitoring
Il degrado che interessa Git Operations, Issues, Packages, Pull Requests e Webhooks è stato mitigato. Stiamo monitorando per garantire la stabilità.
monitoring
Abbiamo temporaneamente disabilitato un lavoro di sfondo che ha causato l'impatto. In questo momento l'impatto è completamente mitigato.
resolved
Tra 14:24 e 14:53 UTC il 13 agosto 2026, un lavoro di base di routine per eliminare un'organizzazione sopraffatto un database condiviso chiave, causando più servizi GitHub per restituire brevemente errori elevati e risposte più lente. La maggior parte degli interessati è stata l'API di gestione webhook, con un impatto minore sulle operazioni Git, tirare richieste, problemi, pacchetti, sign-in e Copilot. Impatto sgomberato da solo a circa 14:53 UTC una volta che il lavoro finito; abbiamo risolto l'incidente a 15:36 UTC.
Gli utenti interessati possono avere sperimentato un breve aumento di errori e risposte più lente, soprattutto quando si crea, elenca o aggiorna webhooks, con impatti più piccoli per tirare richieste, problemi, pacchetti e operazioni Git. I guasti raggiunsero circa l'1% per diversi minuti circa 14:37 UTC.
Per prevenire gli incidenti futuri, abbiamo già spedito un aggiornamento che si accende il percorso di cancellazione più sicuro per le organizzazioni, insieme ai tappi sulla cancellazione detiene sui database. Basandoci su questi cambiamenti, stiamo controllando tutti i lavori di cancellazione e pulizia di massa che scrivono a database condivisi per prevenire problemi simili in futuro.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.
Errori con il modello Fable 5 in Copilot
Inizio 13 agosto 2026 alle ore 14:43 UTC · 1h 4m
IssuesIncidente minore
Componenti interessati
Copilot AI Model Providers
investigating
Stiamo indagando i rapporti delle prestazioni degradate per i fornitori di modelli AI Copilot
investigating
Stiamo sperimentando la disponibilità degradata per il modello Fable 5 in prodotti Copilot e superfici IDE. Ciò è dovuto a un problema con un fornitore di modelli a monte. Mentre lavoriamo con loro per risolvere il problema, si consiglia di scegliere un altro modello o selezionare 'Auto' per continuare a utilizzare Copilot.
investigating
Stiamo vedendo un modesto recupero, ma stiamo ancora sperimentando disponibilità degradata per il modello Fable 5 in prodotti Copilot e superfici IDE. Ciò è dovuto a un problema con un fornitore di modelli a monte. Mentre lavoriamo con loro per risolvere il problema, si consiglia di scegliere un altro modello o selezionare 'Auto' per continuare a utilizzare Copilot.
investigating
I problemi con il nostro fornitore di modelli a monte sono stati risolti e Fable 5 è nuovamente disponibile nei prodotti Copilot e nelle superfici IDE.
Continueremo a monitorare per garantire la stabilità, ma la mitigazione è completa.
resolved
Il 13 agosto 2026, tra le 14:06 e le 15:47 UTC, il servizio Copilota ha sperimentato un degrado del modello Claude Fable 5 a causa di un problema con il nostro fornitore a monte. Gli utenti hanno riscontrato tassi di errore elevati, raggiungendo il 43% e con una media del 12%. Gli utenti che hanno selezionato Auto o modelli alternativi non sono stati colpiti.
Il problema è stato risolto da una mitigazione messa in atto dal nostro fornitore. GitHub sta lavorando con il nostro fornitore per migliorare ulteriormente la resilienza del servizio per prevenire incidenti simili in futuro.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.