Investigăm rapoarte de performanţe afectate pentru unele servicii GitHub.
resolved
Acest incident a fost rezolvat. Vă mulţumim pentru răbdare şi înţelegere în timp ce abordăm această problemă. O analiză detaliată a cauzelor va fi împărtășită de îndată ce este disponibilă.
Traducere automată din actualizarea oficială a incidentului.
Perturbă cu revizuirea codului copilotului
A început 4 septembrie 2026 la 20:39 UTC · 1h 48m
OutageIncident major
investigating
Investigăm rapoarte de performanţe afectate pentru unele servicii GitHub.
investigating
Unii utilizatori pot experimenta eșecuri atunci când utilizează revizuirea codului copilot. Am identificat cauza principală și lucrăm la o atenuare.
investigating
Aplicăm atenuarea şi aşteptăm recuperarea în aproximativ 30 de minute.
monitoring
Degradarea a fost atenuată. Monitorizăm pentru a asigura stabilitatea.
resolved
Acest incident a fost rezolvat. Vă mulţumim pentru răbdare şi înţelegere în timp ce abordăm această problemă. O analiză detaliată a cauzelor va fi împărtășită de îndată ce este disponibilă.
Traducere automată din actualizarea oficială a incidentului.
Incident cu Grok Copilot AI Model Furnizor
A început 3 septembrie 2026 la 14:17 UTC · 2h 54m
IssuesIncident minor
Componente afectate
Copilot AI Model Providers
investigating
Investigăm rapoarte de performanţă degradată pentru Copilot AI Model Furnizori
investigating
Ne confruntăm cu o disponibilitate degradată pentru modelul Grok 4.6 în Copilot Chat, VS Code şi alte produse Copilot. Acest lucru se datorează unei probleme cu un furnizor de modele în amonte. Lucrăm cu ei pentru a rezolva problema.
investigating
Modelul Grok 4.5 a degradat și disponibilitatea. Lucrăm cu furnizorul din amonte pentru a rezolva această problemă.
investigating
Problemele cu furnizorul nostru de modele din amonte au fost rezolvate, iar modelele Grok sunt încă o dată disponibile pe produsele copilot și pe suprafețele IDE.
Vom continua monitorizarea pentru a asigura stabilitatea, dar atenuarea este completă.
resolved
Acest incident a fost rezolvat. Vă mulţumim pentru răbdare şi înţelegere în timp ce abordăm această problemă. O analiză detaliată a cauzelor va fi împărtășită de îndată ce este disponibilă.
Traducere automată din actualizarea oficială a incidentului.
Întârzieri în procesul de comitere
A început 1 septembrie 2026 la 15:00 UTC · 1h 1m
IssuesIncident minor
Componente afectate
Pull Requests
investigating
Investigăm rapoarte de performanţă degradată pentru cererile de retragere
investigating
Diffs în vizualizarea PR pot fi vechi timp de câteva minute. Investigăm şi mărim resursele.
investigating
Timpul de actualizare a cererilor de tragere s-a îmbunătățit până la pragurile normale.
resolved
Acest incident a fost rezolvat. Vă mulţumim pentru răbdare şi înţelegere în timp ce abordăm această problemă. O analiză detaliată a cauzelor va fi împărtășită de îndată ce este disponibilă.
Traducere automată din actualizarea oficială a incidentului.
Rata ridicată a erorilor pentru modelele OpenAI furnizate de copilot
A început 31 august 2026 la 09:15 UTC · 42m
IssuesIncident minor
Componente afectate
Copilot AI Model Providers
investigating
Investigăm rapoarte de performanţă degradată pentru Copilot AI Model Furnizori
investigating
Copilot se confruntă cu o rată mai mare de erori pentru modelele OpenAI, inclusiv gpt-5.3, gpt-5.4, gpt-5.4, gpt-5.4, și familia de modele GPT-5.6.6. Alte modele nu sunt afectate.
investigating
Unul dintre furnizorii noştri model a confirmat un incident la sfârşitul lor. Le-am furnizat detalii pentru a ajuta la identificarea problemei. Începem să vedem recuperare.
monitoring
Degradarea care afectează Copilot AI Model Suppliers a fost atenuată. Monitorizăm pentru a asigura stabilitatea.
monitoring
Problemele cu furnizorul nostru de modele din amonte au fost rezolvate, iar gpt-5.3-codex, gpt-5.4-mini, gpt-5.4-nano, gpt-5.5 şi familia de modele gpt-5.6 sunt încă o dată disponibile pe produsele Copilot şi suprafeţele IDE.
Vom continua monitorizarea pentru a asigura stabilitatea, dar atenuarea este completă.
resolved
Între 08:37 și 09:41 UTC la 31 august 2026, GitHub Copilot a suferit degradare care a afectat mai multe modele GPT, inclusiv gpt-5.3, gpt-5.3, gpt-5.4, gpt-5.4-mini, gpt-5.4-nano și familia gpt-5.6 (Luna, Sol și Terra). Utilizatorii au întâlnit rate ridicate de eroare și au întrerupt transmiterea răspunsurilor. Alte modele nu au fost afectate.
Degradarea a fost cauzată de o problemă cu un furnizor model în amonte. Inginerii GitHub au detectat problema prin monitorizare automată, au afişat avertismente în interiorul produselor pentru modelele afectate şi au coordonat cu furnizorul. Serviciul a revenit la normal după ce furnizorul a implementat o atenuare.
Traducere automată din actualizarea oficială a incidentului.
Incident cu Copilot AI Model Furnizori
A început 27 august 2026 la 10:04 UTC · 2h 8m
OutageIncident critic
Componente afectate
Copilot AI Model Providers
investigating
Investigăm rapoarte de disponibilitate degradată pentru Copilot AI Model Furnizori
investigating
Ne confruntăm cu disponibilitatea degradată pentru modelul Kimi K3 în produsele copilot și suprafețele IDE. Acest lucru se datorează unei probleme cu un furnizor de modele în amonte. În timp ce lucrăm cu ei pentru a rezolva problema, recomandăm alegerea unui alt model sau selectarea "Auto" pentru a continua utilizarea copilot.
investigating
Copilot AI Model Furnizori se confruntă cu performanțe degradate. Continuăm să investigăm.
investigating
Problemele cu furnizorul nostru de modele din amonte au fost atenuate, iar Kimi K3 este din nou disponibilă pe produsele copilot și pe suprafețele IDE.
Vom continua monitorizarea pentru a asigura stabilitatea.
resolved
Pe 27 august 2026, între aproximativ 09:20 și 12:14 UTC, serviciul de copilot a suferit o degradare a modelului Kimi K3 din cauza unei probleme cu furnizorul nostru din amonte. Utilizatorii au întâlnit rate ridicate de eroare atunci când au utilizat Kimi K3. Nu au fost afectate alte modele.
Problema a fost rezolvată printr-o atenuare pusă în aplicare de furnizorul nostru. GitHub lucrează cu furnizorul nostru pentru a îmbunătăți în continuare reziliența serviciului pentru a preveni incidente similare în viitor.
Traducere automată din actualizarea oficială a incidentului.
Incident cu acțiuni și cereri de retragere
A început 26 august 2026 la 22:56 UTC · 1h 30m
IssuesIncident minor
Componente afectate
Pull RequestsActions
investigating
Investigăm rapoarte de performanţă degradată pentru acţiuni şi cereri de retragere
investigating
Investigăm întârzieri ridicate şi întârzieri care afectează fluxurile de lucru ale acţiunilor declanşate de evenimente de solicitare de tragere. 20% din acţiuni au întârziat începerea a mai mult de 5 minute şi până la 4% din curse nu au reuşit să declanşeze. Lucrăm în mod activ la atenuare și vom oferi actualizări pe măsură ce vom afla mai multe.
investigating
Am aplicat atenuări şi vedem cum redresarea în acţiuni curge şi cererea blocată se uneşte. Continuăm să monitorizăm starea de sănătate susţinută a fuziunii înainte de rezolvare.
investigating
Am confirmat recuperarea completă începând cu ora 23:58 UTC. Acţiunile funcţionează şi cererea de tragere fuzionează normal. Acum vom rezolva incidentul în timp ce vom continua să monitorizăm sănătatea serviciilor.
monitoring
Degradarea care afectează acțiunile și cererile de tragere a fost atenuată. Monitorizăm pentru a asigura stabilitatea.
resolved
La 26 august 2026, de la 21:55 UTC până la 23:58 UTC, 2,6% din fluxurile de lucru declanșate de cererea de tragere au fost întârziate, impactul crescând până la 25% la vârf. Unii utilizatori au avut, de asemenea, întârzieri în ceea ce privește cererea de extragere a energiei electrice, informații privind fuzionabilitatea și disponibilitatea butonului de fuziune. Acţiuni şi cereri de tragere recuperate complet până la 23:58 UTC; incidentul a fost rezolvat la 00:26 UTC după confirmarea unei operaţii normale.
Locurile de muncă de bază care pun în aplicare procedurile de actualizare a cererilor și generează angajamente de fuziune au fost afectate de termene care au atins o singură partiție de date GIT. Acest lucru a dus la un backlog în cererea de extragere procesare fuzionare-commit, întârziere tragere cerere-triggered GitHub Acțiuni fluxuri de lucru și unele informații de fuzionare.
Am redus volumul de muncă, am mutat traficul departe de infrastructura afectată și am restabilit componenta de servicii afectată într-o stare sănătoasă. Împreună, aceste acţiuni au contribuit la reducerea întârzierilor şi la restabilirea operaţiunilor normale.
Ne străduim să îmbunătățim detectarea saturației resurselor și să eliminăm impactul asupra clienților în acest scenariu prin izolarea impactului, prin plasarea unor limite mai bune asupra retriesurilor și prin consolidarea presiunii din spate pentru a face sistemele noastre mai rezistente sub sarcină.
Traducere automată din actualizarea oficială a incidentului.
Tulburare cu GitHub Billing
A început 26 august 2026 la 20:40 UTC · 4h 11m
IssuesIncident minor
investigating
Investigăm rapoarte de performanţe afectate pentru unele servicii GitHub.
investigating
Investigăm în prezent erori crescute cu serviciile de facturare. Clienţii pot observa sarcinile de facturare a paginii bugetare eşuate, iar utilizatorii CLI Copilot pot observa eşecuri începând sau continuând sesiunile.
investigating
Am aplicat o atenuare pentru a debloca utilizarea copilot și au observat recuperarea pentru acest impact special. Continuăm să investigăm şi să aplicăm atenuări pentru întreruperea paginii de facturare în timp ce monitorizăm pentru a ne asigura că copilotul rămâne recuperat.
investigating
Continuăm să monitorizăm atenuarea pe care am aplicat-o pentru întreruperea paginii de facturare.
investigating
Atenuarea noastră se menţine pe măsură ce continuăm să investigăm pentru a găsi cauza principală.
investigating
Atenuarea noastră continuă să reziste, iar condiţiile de serviciu rămân stabile. Continuăm să investigăm volumul de muncă concentrat responsabil pentru această problemă și pregătim îmbunătățiri preventive suplimentare. Nu am identificat o modificare semnificativă a impactului asupra clienților de la actualizarea anterioară. Vom oferi o altă actualizare pe măsură ce ancheta progresează.
investigating
Nicio modificare materială de la actualizarea anterioară. Condițiile de serviciu rămân stabile în urma atenuării și nu am observat niciun alt impact al clienților. Monitorizăm activ serviciul în timp ce punem în aplicare soluții specifice pentru a aborda cauza fundamentală.
resolved
La 26 august 2026, între orele 20:40 UTC și 00:51 UTC la 27 august, GitHub Billing a cunoscut performanțe degradate care au afectat paginile bugetare de facturare și sesiunile CLI GitHub Copilot. Clienţii afectaţi s-au confruntat cu sarcini sau eşecuri eşuate la începerea sau continuarea sesiunilor CLI. Am confirmat acest impact pentru un număr mic de clienți (< 1%).
Acest lucru a fost cauzat de un volum de muncă concentrat care a creat întârzieri de procesare în stratul nostru de stocare a datelor. Retările automate au mărit sarcina şi au prelungit degradarea. Am redus incidentul prin reechilibrarea traficului din infrastructura noastră.
Ameliorăm izolarea, rejudecarea comportamentului și detectarea încărcăturii concentrate pentru a reduce probabilitatea recurenței și a scurta timpul nostru pentru a detecta și atenua incidente similare.
Traducere automată din actualizarea oficială a incidentului.
Incidentul acțiunilor
A început 26 august 2026 la 15:11 UTC · 2h 50m
OutageIncident critic
Componente afectate
ActionsPages
investigating
Investigăm rapoarte privind disponibilitatea degradată a acțiunilor
investigating
Paginile se confruntă cu performanţe degradate. Continuăm să investigăm.
investigating
Am identificat o problemă cu o bază de date primară și nu reușesc pe la o replică imediat
investigating
eşec primar îmbunătăţit pe scurt performanţă, dar nu a atenua pe deplin, am accelerat traficul de intrare şi investighează în amonte Vitess probleme
investigating
Credem că ne-am identificat și am abordat problema și suntem rampă de trafic înapoi încet pentru a se asigura că nu reapare. Unii clienţi vor continua să vadă întârzierile pe măsură ce urcăm.
investigating
Paginile funcţionează normal.
investigating
Continuăm să observăm recuperarea şi cozile întârziate ard. Unii clienți vor continua să vadă întârzieri crescute până când toate lucrările accelerate vor fi finalizate - așteptăm acest lucru în următoarea oră.
investigating
Continuăm să observăm recuperarea şi ne aşteptăm ca acţiunile de intrare să revină la normal în <30min. Lucrările vor continua să curgă prin sistem sub rezerva unor limite per client.
monitoring
Degradarea care afectează acțiunile a fost atenuată. Monitorizăm pentru a asigura stabilitatea.
monitoring
Toate cozile de intrare și-au revenit și acțiunile funcționează conform așteptărilor. 3,7% din locurile de muncă alocate alergătorilor mai mari în faza incipientă a acestui incident sunt blocate în așteptare pentru misiune alergător. Acestea vor fi anulate într-o oră. Alţi alergători procesează cu succes toate noile locuri de muncă.
resolved
La 26 august 2026 de la 15:02 la 15:45 UTC, acțiunile nu au reușit să înceapă. Următoarele 2 ore până la ora 17:40 UTC, acțiunile au fost amânate începând cu mai mult de 5 minute, sistemul fiind prins cu încărcătură întârziată. Acest impact a fost declanșat de saturarea scrierii în baza de date primară utilizată de către declanșatorii de procesare a serviciilor pentru fluxurile de lucru ale acțiunilor. Primarul a eşuat, dar sistemul nu şi-a revenit complet. Prin urmare, Comisia consideră că măsura în cauză nu constituie ajutor de stat. Acceleraţiile în aval care mai târziu au fost folosite pentru recuperare au fost stabilite cu ~10% prea mari pentru a proteja sistemul.
La 15:45 UTC, agitarea combinată cu repornirea serviciului a recuperat sănătatea de bază a serviciului. Aceste acceleraţii au fost ridicate treptat între 15:54 şi 17:22 pentru a restabili procesarea completă a webhook pentru acţiuni. Această rampă a fost în mod deliberat lentă pentru a ne asigura că nu am reconfruntat sistemul, având în vedere că agitaţia noastră iniţială era acum stabilită incorect. Coada de evenimente webhook a fost complet ars la 17:40 UTC.
3,7% dintre locurile de muncă mai mari, împreună cu unele locuri de muncă auto-hostate de scară, au rămas blocate în coadă sau în așteptare pentru statul runner. Am desfășurat o schimbare în ceea ce privește locurile de muncă din acest stat, iar acestea s-au transformat în eșec la 18:40 UTC, la aproximativ 50 de minute după atenuarea incidentelor. Eliberarea acestor locuri de muncă a fost, de asemenea, eliberată pentru locuri de muncă mai mari.
Clienții care utilizează grupuri de convailități au avut un impact mai lung din cauza unei probleme separate în care alergătorii cărora li s-a atribuit un subset de locuri de muncă deconectate înainte de desfășurarea atenuării prin votarea forței, ceea ce a împiedicat achiziționarea alergătorilor să progreseze și să părăsească locurile de muncă într-un stat care așteaptă să se desfășoare. Acest lucru a fost rezolvat la 01:00 UTC pe 27 august.
Unele ruleaza declansate in timpul ferestrei incidentului 15:02-15:45 UTC intalnit un bug care le-a lasat aratandu-se la coada chiar si dupa recuperarea serviciului. În backend, aceste curse au eșuat deja și se va muta automat la stat anulat 24 de ore după creare. Ca follow-up, suntem de stabilire cauza rădăcină a acestei stări coadă și îmbunătățirea capacitatea noastră de a în vrac-cancel alergări afectate.
Mai multe schimbări în ceea ce privește îmbunătățirea scalabilității generale a acestei părți a acțiunilor au fost deja finalizate și implementate în producție. Rularea acestor modificări va fi completă în următoarele 24 de ore. Se desfăşoară activităţi suplimentare pentru a îmbunătăţi amploarea, rezilienţa şi degradarea mai graţioasă a fluxurilor de lucru ale acţiunilor. De asemenea, luăm un produs de reparații pentru a accelera eliminarea locurilor de muncă blocate la coadă sau în așteptare în cazuri viitoare similare.
Traducere automată din actualizarea oficială a incidentului.
Deranjare cu unele servicii GitHub
A început 26 august 2026 la 15:09 UTC · 59m
IssuesIncident minor
investigating
Investigăm rapoarte de performanţe afectate pentru unele servicii GitHub.
resolved
Vă rugăm să consultați rezumatul combinat al acestui incident asociat: https://www.githubstatus.com/incidente/y1t7p9fzrlj2
Traducere automată din actualizarea oficială a incidentului.
Întârzierile acţiunilor la începerea activităţilor
A început 24 august 2026 la 13:33 UTC · 31m
IssuesIncident minor
Componente afectate
Actions
investigating
Investigăm rapoarte de performanţă degradată pentru acţiuni
investigating
Eșecurile în timp ce la coadă și rulează acțiuni locuri de muncă pentru un subset de clienți sunt acum rezolva. Monitorizăm recuperarea completă.
monitoring
Degradarea care afectează acțiunile a fost atenuată. Monitorizăm pentru a asigura stabilitatea.
resolved
La 24 august 2026, între 13:33 UTC şi 14:04 UTC, 3,8% din acţiuni încep cu întârzieri de peste 5 minute, cu 1,25% din acţiuni eşuând.
Incidentul a fost cauzat de un eşec de disc pe un nod găzduind unul dintre multele cazuri de servicii responsabile pentru procesarea evenimentelor de atribuire a alergătorilor. De obicei, capsulele pe noduri nesănătoase sunt eliminate și înlocuite automat fără impact. În acest caz, deși nodul a fost grav degradat și incapabil să efectueze operațiuni pe disc, el a continuat să trimită semnale sănătoase, împiedicând sistemul să-și mute imediat activitatea în altă parte. În această perioadă, evenimentele atribuite componentei afectate s-au acumulat până la o reechilibrare automată redirecționată către componente sănătoase la 13:54 UTC. Retragerea cozii a fost eliminată la ora 14:00 UTC, iar procesarea a revenit la normal până la ora 14:04 UTC.
Pentru a preveni o recidivă, îmbunătăţim detectarea şi remedierea automată a nodurilor nesănătoase care sunt complet offline. De asemenea, consolidăm reziliența la nivel de aplicație, astfel încât consumatorii stagnați sunt eliminați automat și munca lor este realocată fără a aștepta recuperarea nodului afectat.
Traducere automată din actualizarea oficială a incidentului.
Erori ridicate la Fable 5 din cauza furnizorului din amonte
A început 24 august 2026 la 07:12 UTC · 47m
OutageIncident major
Componente afectate
Copilot AI Model Providers
investigating
Investigăm rapoarte de disponibilitate degradată pentru Copilot AI Model Furnizori
investigating
Ne confruntăm cu o disponibilitate degradată pentru modelul Fable în produsele Copilot și suprafețele IDE. Acest lucru se datorează unei probleme cu furnizorul modelului din amonte. În timp ce lucrăm cu ei pentru a rezolva problema, recomandăm alegerea unui alt model sau selectarea "Auto" pentru a continua utilizarea copilot.
resolved
Pe 24 august 2026, între aproximativ 06:35 și 07:25 UTC, serviciul de copilot a suferit o degradare a modelului Claude Fable 5 din cauza unei probleme cu furnizorul nostru din amonte. Utilizatorii au întâmpinat rate ridicate de eroare atunci când au utilizat Claude Fable 5, cu cereri care uneori nu au răspuns la jumătate. Nu au fost afectate alte modele.
Problema a fost rezolvată printr-o atenuare pusă în aplicare de furnizorul nostru. GitHub lucrează cu furnizorul nostru pentru a îmbunătăți în continuare reziliența serviciului pentru a preveni incidente similare în viitor.
Traducere automată din actualizarea oficială a incidentului.
Operaţiuni Git degradate peste SSH
A început 21 august 2026 la 14:00 UTC · 7m
Pending
resolved
Pe 21 august 2026, între 14:00 şi 14:07 UTC, dotcom Operaţiunile Git peste SSH au fost degradate. Succes Operațiunile Git peste SSH au scăzut cu mai mult de 95% în timpul ferestrei de impact de vârf, făcând clona, aduce sau împingere peste SSH efectiv indisponibilă pentru majoritatea utilizatorilor timp de aproximativ patru minute. Operaţiunile Git asupra HTTPS nu au fost afectate.
Incidentul a fost cauzat de un defect software în infrastructura noastră de echilibrare a sarcinii, care a fost declanșată de o schimbare de configurație. Defectul a avut loc doar atunci când conexiunile au trecut prin mai multe straturi de balansoare de sarcină care rulează noua configurație, ceea ce a însemnat că nu a fost detectat în timpul testării canarilor.
Am atenuat incidentul prin rularea înapoi schimbarea configurației.
Adăugăm o acoperire de regresie pentru configuraţiile multistrate ale balanţei de sarcină şi îmbunătăţim monitorizarea şi alertarea operaţiunilor Git asupra SSH pentru a reduce timpul nostru până la detectarea şi atenuarea problemelor similare în viitor.
Traducere automată din actualizarea oficială a incidentului.
Eșecuri intermitente care creează sarcini de agent
A început 20 august 2026 la 14:43 UTC · 9h 54m
OutageIncident critic
investigating
Investigăm rapoarte de performanţe afectate pentru unele servicii GitHub.
investigating
Utilizatorii pot experimenta întârzieri la începerea sarcinilor utilizând agentul Cloud Copilot. Investigăm în mod activ această problemă și vom furniza actualizări pe măsură ce vom afla mai multe.
investigating
Am identificat componenta problematică și încercăm să dăm faliment într-un caz sănătos. Alte actualizări vor fi furnizate pe măsură ce efectuăm atenuarea.
investigating
Ne confruntăm cu probleme legate de sarcinile agentului cloud copilot, ceea ce duce la sarcini nou-înființate care nu prezintă în mod corespunzător progrese în curs. Aceste sarcini ale Copilot Cloud Agent sunt încă finalizate corect, dar nu au vizibilitate adecvată. Investigăm în mod activ această problemă și vom furniza actualizări pe măsură ce vom afla mai multe.
investigating
Utilizatorii se confruntă cu întârzieri atunci când începe sarcinile folosind Copilot Cloud Agent și nu sunt în măsură să vadă starea acestor sarcini. Sarcinile agentului cloud copilot sunt încă finalizate. Am identificat cauza problemei și punem în aplicare măsuri de atenuare pentru a readuce serviciul la niveluri normale. Vom oferi o altă actualizare despre timpul de recuperare așteptat în curând.
investigating
Vedem semne de recuperare pentru vizibilitatea stării de sarcină a agentului Cloud, dar această recuperare este mai lentă decât am anticipat. Urmărim măsuri suplimentare de atenuare pentru accelerarea redresării.
investigating
Observăm recuperarea treptată pentru vizibilitatea stării de sarcină a agentului Cloud Copilot, cu o ieșire de sesiune întârziată aproximativ 1 oră. Am luat măsuri suplimentare pentru accelerarea redresării și continuăm să monitorizăm impactul.
investigating
Continuăm să observăm recuperarea treptată a vizibilităţii stării de sarcină a agentului Cloud Copilot, cu o întârziere cu aproximativ 1 oră. Am luat măsuri suplimentare pentru accelerarea redresării și continuăm să monitorizăm impactul.
investigating
Continuăm să observăm recuperarea treptată a vizibilităţii stării de sarcină a agentului Cloud Copilot, cu o întârziere cu aproximativ 1 oră. Am luat măsuri suplimentare pentru a accelera recuperarea și ne așteptăm ca acest lucru să intre în vigoare în următoarea oră.
investigating
Continuăm să observăm recuperarea treptată a vizibilităţii stării de sarcină a agentului cloud. Rezultatele sesiunii continuă să fie întârziate cu aproximativ 1 oră pe măsură ce măsurile noastre de remediere intră în vigoare.
investigating
Vedem o recuperare treptată a vizibilităţii stării de sarcină a agentului Cloud în timp ce implementăm un fix pentru cauza principală. Rezultatul sesiunii rămâne întârziat cu aproximativ o oră în timp ce remedierea continuă.
resolved
Între orele 13:57 UTC la 20 august și 00:37 UTC la 21 august 2026, unii utilizatori ai agentului Cloud Copilot au avut întârzieri de până la 60 până la 90 de minute pentru a vedea statutul și rezultatele sarcinilor lor de agent. Sarcinile agentului au continuat să funcționeze și să fie complete în acest timp; doar vizibilitatea statutului lor a fost întârziată.
Cauza a fost o pană regională într-un serviciu de baze de date cloud terţe pe care copilot îl foloseşte pentru a stoca statutul de agent operativ. Am eșuat în baza de date afectată într-o regiune sănătoasă, am adăugat capacitatea de procesare pentru a lucra prin backlog și am restabilit funcționarea normală după recuperarea serviciului de bază. Nu s-au pierdut date despre sarcini în timpul incidentului.
Pentru a preveni repetarea unor incidente similare, eliminăm configuraţia bazei de date care ne-a făcut vulnerabili la această pană regională şi ne îmbunătăţim procedurile de faliment al bazei noastre de date.
Traducere automată din actualizarea oficială a incidentului.
Eșecuri intermitente în grupurile de alergători și în paginile de permisiuni legate de alergători
A început 18 august 2026 la 05:02 UTC · 6h 28m
IssuesIncident minor
investigating
Investigăm rapoarte de performanţe afectate pentru unele servicii GitHub.
monitoring
Investigăm rapoarte despre incapacitatea de a încărca grupuri de alergători şi permisiuni legate de alergători pentru clienţi care folosesc alergători mai mari.
monitoring
Am identificat sursa unei probleme de comunicare între serviciile acţiunilor şi lucrăm spre atenuare. Clienții pot experimenta eșecul de a încărca grupuri de alergători și probleme de permisiuni legate de alergător atunci când se utilizează Larger Runners.
monitoring
Am aplicat o atenuare şi vedem semnale de recuperare. Vom continua monitorizarea recuperării și furnizarea de actualizări.
resolved
La 18 august 2026, între 05:02 UTC şi 11:30 UTC, clienţii nu au putut vizualiza sau gestiona Grupurile de Acţiuni Runners şi Runner prin intermediul GitHub UI şi API.
Problema a fost cauzată de eșecuri în cererile backend lectură runner și date de grup alergător. Eșecurile au fost cauzate de un certificat de autentificare expirat unic pentru acest serviciu. Certificatul a fost rotit în KeyVault, dar un pas pentru a permite utilizarea la termen a fost oprit pentru a preveni recurența incidentelor anterioare declanșate de această operațiune.
Impactul a fost atenuat prin completarea autorizației noului certificat în sistemul de suport. Am adăugat o monitorizare suplimentară la acest certificat și la alte certificate. Acest serviciu este, de asemenea, în curs de înlocuire ca parte a disponibilității și a muncii noastre la scară largă, aducând această cale de autentificare și gestionarea secretă în conformitate cu modelele din toate serviciile GitHub.
Traducere automată din actualizarea oficială a incidentului.
Incidentul acțiunilor
A început 18 august 2026 la 05:02 UTC · 6h 28m
OutageIncident major
investigating
Investigăm rapoarte de performanţe afectate pentru unele servicii GitHub.
resolved
La 18 august 2026, între 05:02 UTC și 11:30 UTC, clienții nu au putut să-și desfășoare activitatea în cadrul acțiunilor Larger Runners și nu au reușit să vizualizeze sau să gestioneze grupuri de participanți și executanți prin intermediul GitHub UI și API.
Aceste probleme au fost cauzate de eșecuri în cererile backend rezolvarea metadatele esențiale pentru începerea ruleaza fluxul de lucru Larger Runner și pentru citirea runner și datele grupului alergător. Eșecurile au fost cauzate de un certificat de autentificare expirat unic pentru acest serviciu. Certificatul a fost rotit în KeyVault, dar un pas pentru a permite utilizarea la termen a fost oprit pentru a preveni recurența incidentelor anterioare care au fost declanșate de această operațiune.
Am atenuat problemele prin completarea activitatii noului certificat in sistemul de suport. Am adăugat o monitorizare suplimentară la acest certificat și la alte certificate. Serviciul relevant este, de asemenea, în curs de înlocuire ca parte a disponibilității și muncii noastre la scară largă, aducând această cale de autentificare și gestionarea secretă în conformitate cu modelele din toate serviciile GitHub.
Traducere automată din actualizarea oficială a incidentului.
Investigăm rapoarte de performanţe afectate pentru unele servicii GitHub.
investigating
Solicitările API se confruntă cu performanțe degradate. Continuăm să investigăm.
investigating
Acţiunile se confruntă cu performanţe degradate. Continuăm să investigăm.
investigating
Vedem o rată de eroare de aproximativ 20% în numeroase experienţe, printre care Pull Appements, Issues şi altele. Investigațiile sunt în curs de desfășurare și vom posta actualizări ca acestea devin disponibile
investigating
Solicitările de retragere se confruntă cu performanțe degradate. Continuăm să investigăm.
investigating
Ne confruntăm cu rate ridicate de eroare în jur de 20% pentru experiențele pe internet și traficul api. Descărcările arhivelor și descărcările de conținut ale depozitului brut se confruntă cu o rată de eroare de aproximativ 50%. Investigațiile sunt în curs de desfășurare în cauza rădăcină, și actualizările vor continua să fie furnizate în timp ce investigăm.
investigating
Ne confruntăm cu rate ridicate de eroare în jur de 20% pentru experiențele pe internet și traficul api. Descărcările arhivelor și descărcările de conținut ale depozitului brut se confruntă cu o rată de eroare de aproximativ 50%. SAML și autentificarea OIDC, SCIM, și Team Sync sunt, de asemenea, afectate. Investigațiile sunt în curs de desfășurare și vom continua să oferim actualizări pe măsură ce vom descoperi mai multe informații.
investigating
Copilotul se confruntă cu o disponibilitate degradată. Continuăm să investigăm.
investigating
Problemele se confruntă cu disponibilitatea degradată. Continuăm să investigăm.
investigating
Solicitările Pull se confruntă cu disponibilitatea degradată. Continuăm să investigăm.
investigating
Acţiunile se confruntă cu o disponibilitate degradată. Continuăm să investigăm.
investigating
Ne confruntăm cu rate ridicate de eroare în jur de 20% pentru experiențele pe internet și traficul api. Descărcările arhivelor și descărcările de conținut ale depozitului brut se confruntă cu o rată de eroare de aproximativ 50%. SAML și autentificarea OIDC, SCIM, și Team Sync sunt, de asemenea, afectate. În prezent, efectuăm reduceri bazate pe investigaţia noastră de până acum şi monitorizăm îmbunătăţirea.
investigating
Webhooks se confruntă cu disponibilitatea degradată. Continuăm să investigăm.
investigating
Paginile se confruntă cu performanţe degradate. Continuăm să investigăm.
investigating
Webhooks se confruntă cu performanțe degradate. Continuăm să investigăm.
investigating
Ne confruntăm cu rate ridicate de eroare în jur de 20% pentru experiențele pe internet și traficul api. Descărcările arhivelor și descărcările de conținut ale depozitului brut se confruntă cu o rată de eroare de aproximativ 50%. SAML și autentificarea OIDC, SCIM, și Team Sync sunt, de asemenea, afectate. În prezent efectuăm atenuări și vom posta actualizări pe măsură ce progresăm.
investigating
Ne confruntăm cu rate ridicate de eroare în jur de 20% pentru experiențele pe internet și traficul api. Descărcările arhivelor și descărcările de conținut ale depozitului brut se confruntă cu o rată de eroare de aproximativ 50%. SAML și autentificarea OIDC, SCIM, și Team Sync sunt, de asemenea, afectate. Încă lucrăm la identificarea cauzei profunde și vom continua să postăm actualizări pe măsură ce vom afla mai multe și vom efectua atenuarea.
investigating
Am identificat componenta problematică și am luat măsuri corective. Există semne puternice de recuperare, dar încă lucrăm la restabilirea completă a serviciului, iar ratele de eroare rămân încă puțin ridicate. Vom posta noi actualizări pe măsură ce recuperarea continuă.
investigating
Degradarea care afectează Solicitările API, Acţiuni, Operaţiuni Git, Probleme, Pagini, Solicitări Pull şi Webhooks a fost atenuată. Monitorizăm pentru a asigura stabilitatea.
investigating
Git Operations se confruntă cu performanțe degradate. Continuăm să investigăm.
investigating
Am identificat componenta problematică și am luat măsuri corective, dar vedem un impact rezidual în numeroase servicii. Continuăm să aplicăm măsuri suplimentare de atenuare și să investigăm impactul rămas.
investigating
Problemele se confruntă cu performanțe degradate. Continuăm să investigăm.
investigating
Am identificat componenta problematică și am luat măsuri corective, dar vedem un impact rezidual sub forma unor defecțiuni sporadice de autentificare. Continuăm să aplicăm măsuri suplimentare de atenuare și să investigăm impactul rămas.
investigating
Degradarea care afectează Git Operations a fost atenuată. Monitorizăm pentru a asigura stabilitatea.
investigating
Solicitările API se confruntă cu disponibilitatea degradată. Continuăm să investigăm.
investigating
Solicitările API funcționează normal.
investigating
Continuăm să investigăm eşecuri sporadice de autentificare. Am dezactivat parţial certificatele de autentificare şi am văzut îmbunătăţiri şi monitorizăm impactul înainte de a aplica pe deplin această atenuare.
investigating
Continuăm să investigăm eșecurile sporadice care afectează autentificarea copilotului în unele aplicații. Utilizarea copilotului prin intermediul GitHub CLI și GitHub App nu este afectată.
investigating
Problemele funcţionează normal.
investigating
Continuăm să aplicăm atenuări pentru a aborda eșecurile sporadice de autentificare ale copilotului în unele aplicații. Aşteptăm recuperarea completă în următoarele 30 de minute. Utilizarea copilotului prin intermediul GitHub CLI și GitHub App nu este afectată.
resolved
La 17 august 2026, de la 13:28 La vârf, ratele de eroare Web/API au fost de aproximativ 20%, în timp ce descărcările de conținut brut și arhivă au ajuns la aproximativ 50%. Au fost afectate, de asemenea, autentificarea SAML/OIDC, SCIM și Team Sync, precum și fluxurile de lucru ale acțiunilor în GHEC cu Rezidențe de date care depind de definițiile de etapă ale fluxului de lucru public găzduite pe GitHub.com. Cele mai multe servicii recuperate de 16:36 UTC ca centrul nostru de date din SUA centrală recuperat; Acțiuni a fost degradat până la aproximativ 18:03 UTC; și Copilot Token Service recuperat complet până la 21:02.
Unele dintre traficul care a eșuat a fost mutat din centrul SUA în Virginia de Nord unde a fost servit cu succes până când eșecul rețelei în Central SUA a fost depanat și rezolvat. Răspunsul întârziat la un singur obiectiv intern a declanşat o nouă eroare în Codul VS care a amplificat traficul cu aproximativ 10x şi a provocat o recuperare întârziată pentru Serviciul Copilot Token.
Cauza imediată a eşecului a fost saturarea reţelei de balanţe de sarcină în centrul SUA din cauza unui nou vârf în trafic. Inițial, acest lucru a fost cauzat de o pod lateral Istio atinge limitele sale de numerar și nu se scara auto corect din cauza unei politici configurate greșit care a urmărit serviciul gazdă, dar nu limitele ataș. Un eșec în cascadă la mai multe și, în cele din urmă, patru noduri HAProxy și-au epuizat limitele de flux, degradând calea auth poarta și provocând latență de autentificare și eșecuri pe scară largă. Problema a fost agravată de logica optimistă de rejudecare care a supraîncărcat balanserele interne. Întrerupând HAProxy pe aceste noduri simultan a produs o recuperare imediată largă.
Furtuna de reîncercare din Nordul VA a fost stabilită cu 1) reducerea temporară a logicii de retrimitere a porții cu un PR și 2) blocarea cererilor de semnal pentru copilot Token Service de la balansoarele de sarcină cu un 403, și apoi treptat rampa înapoi de trafic pe site-ul pentru a permite apelatorilor să aibă succes.
Eșecurile de autentificare ale copilotului rezidual au continuat deoarece reîncercarea comportamentului a amplificat sarcina: o operațiune de jetoane eșuată ar putea genera multe cereri suplimentare și ar putea introduce o buclă de retrimitere. Copilot Token Service Traficul a crescut de la un RPS normal de 7 Reducerea retușărilor de autentificare a porții și blocarea răspunsurilor re-declanșatoare stabilizate Copilot Token Service și a finalizat recuperarea.
Factorii complicați care au împiedicat recuperarea au inclus o serie de atacuri de răzuire asupra criteriilor finale de încărcare a codurilor.
Pentru a preveni recurența, acțiunile noastre de monitorizare includ:
- Corectarea politicilor de autoscalare pentru a cont pentru service-mesh sidecar si capacitatea.
- Auditing Istio request, convaility, and scalating limits across services.
- Revizuire limite de rejudecare și comportament de rezervă peste porți și clienți.
- Adresându-se comportamentului VS Cod retry care amplificat Copilot token trafic.
- Îmbunătăţirea monitorizării capacităţii de echilibrare a sarcinii şi a garanţiilor regionale de eşuare.
Traducere automată din actualizarea oficială a incidentului.
Tulburare cu GHEC Echipa Sincronizare
A început 13 august 2026 la 16:21 UTC · 2h 6m
IssuesIncident minor
investigating
Investigăm rapoarte de performanţe afectate pentru unele servicii GitHub.
investigating
GHEC Team Sync este în prezent degradat pentru întreprinderile cu conturi personale, cauzând întârzieri în sincronizarea echipelor cu grupurile IdP. Am identificat cauza întârzierilor și lucrăm la o atenuare. Vom oferi o actualizare a progreselor noastre la ora 20:00 UTC.
investigating
Am implementat o atenuare. În acest moment, GHEC Team Sync a recuperat pentru întreprinderile cu conturi personale. Echipele sincronizate cu grupurile IdP au revenit la cadenţa lor normală.
resolved
La 13 august 2026, de la 15:31:21 UTC la 18:27:55 UTC, sincronizarea echipei GitHub Enterprise Cloud a fost degradată pentru întreprinderi folosind conturi personale. Echipele de organizare s-au confruntat cu întârzieri de până la 3 până la 13 ore (în medie 8 ore) atunci când s-au sincronizat cu grupurile IdP, ceea ce a dus la întârzieri în acordarea de granturi de acces sau mutări pentru utilizatorii de întreprinderi în 2,8% din echipe.
O schimbare temporară introdusă pentru a aborda o problemă anterioară din cauza utilizării sporite a acestei caracteristici a rămas activă după ce a fost destinată eliminării, cauzând întârzieri de sincronizare în perioadele de volum ridicat. Am eliminat schimbarea temporară și am furnizat resurse suplimentare pentru a gestiona volumul crescut.
Traducere automată din actualizarea oficială a incidentului.
Incident cu Webhooks
A început 13 august 2026 la 14:45 UTC · 51m
IssuesIncident minor
Componente afectate
IssuesPackagesPull RequestsWebhooksGit Operations
investigating
Investigăm rapoarte de performanţă degradată pentru Webhooks
investigating
Solicitările de retragere se confruntă cu performanțe degradate. Continuăm să investigăm.
investigating
Problemele se confruntă cu performanțe degradate. Continuăm să investigăm.
investigating
Git Operations se confruntă cu performanțe degradate. Continuăm să investigăm.
investigating
Pachetele se confruntă cu performanţe degradate. Continuăm să investigăm.
investigating
Investigăm în prezent o scurtă degradare a serviciului pentru operațiunile Git (în special împingeri), probleme, cereri de tragere, registru de pachete și webhooks între 14:32 și 14:46 UTC. Am identificat sursa degradării și investigăm strategii de atenuare pentru a preveni recurența.
monitoring
Degradarea care afectează Git Operations, Issues, Packages, Pull Cereri și Webhooks a fost atenuată. Monitorizăm pentru a asigura stabilitatea.
monitoring
Am dezactivat temporar un loc de muncă de fundal care a cauzat impactul. În acest moment impactul este complet atenuat.
resolved
Între 14:24 și 14:53 UTC pe 13 august 2026, un loc de muncă de rutină de fundal pentru a șterge o organizație copleșit o bază de date comună cheie, determinând mai multe servicii GitHub pentru a reveni pe scurt erori ridicate și răspunsuri mai lente. Cele mai afectate au fost API-ul de management al webhook-ului, cu impact mai mic asupra operațiunilor Git, cereri de extragere, probleme, pachete, sign-in și copilot. Impact eliminat pe cont propriu la aproximativ 14:53 UTC odată ce locul de muncă a terminat; am rezolvat incidentul la 15:36 UTC.
Utilizatorii afectați pot fi experimentat o scurtă creștere a erorilor și răspunsuri mai lente, în primul rând atunci când creați, listați sau actualizați site-uri web, cu impact mai mic pentru a trage cereri, probleme, pachete și operațiuni Git. Eșecurile au atins un vârf de aproximativ 1% pentru câteva minute în jurul orei 14:37 UTC.
Pentru a preveni incidentele viitoare, am trimis deja o actualizare care transformă calea de ștergere mai sigură pentru organizații, împreună cu capacele de ștergere deține pe baze de date. Bazându-ne pe aceste schimbări, audităm toate locurile de muncă în vrac de ştergere şi curăţare care scriu în baze de date comune pentru a preveni probleme similare în viitor.
Traducere automată din actualizarea oficială a incidentului.
Erori cu modelul Fable 5 în copilot
A început 13 august 2026 la 14:43 UTC · 1h 4m
IssuesIncident minor
Componente afectate
Copilot AI Model Providers
investigating
Investigăm rapoarte de performanţă degradată pentru Copilot AI Model Furnizori
investigating
Ne confruntăm cu o disponibilitate degradată pentru modelul Fable 5 în produsele copilot şi suprafeţe IDE. Acest lucru se datorează unei probleme cu un furnizor de modele în amonte. În timp ce lucrăm cu ei pentru a rezolva problema, recomandăm alegerea unui alt model sau selectarea "Auto" pentru a continua utilizarea copilot.
investigating
Vedem o recuperare modestă, dar încă se confruntă cu o disponibilitate degradată pentru modelul Fable 5 în produsele Copilot și suprafețele IDE. Acest lucru se datorează unei probleme cu un furnizor de modele în amonte. În timp ce lucrăm cu ei pentru a rezolva problema, recomandăm alegerea unui alt model sau selectarea "Auto" pentru a continua utilizarea copilot.
investigating
Problemele cu furnizorul nostru model în amonte au fost rezolvate, iar Fable 5 este încă o dată disponibil pe produsele copilot și suprafețele IDE.
Vom continua monitorizarea pentru a asigura stabilitatea, dar atenuarea este completă.
resolved
Pe 13 august 2026, între aproximativ 14:06 şi 15:47 UTC, serviciul de copilot a suferit o degradare a modelului Claude Fable 5 din cauza unei probleme cu furnizorul nostru din amonte. Utilizatorii s-au confruntat cu rate ridicate de eroare, cu o valoare maximă de 43% și o medie de 12%. Utilizatorii care au selectat modele Auto sau alternative nu au fost afectaţi.
Problema a fost rezolvată printr-o atenuare pusă în aplicare de furnizorul nostru. GitHub lucrează cu furnizorul nostru pentru a îmbunătăți în continuare reziliența serviciului pentru a preveni incidente similare în viitor.
Traducere automată din actualizarea oficială a incidentului.