Flere Atlantiske tjenester oplever problemer
- investigating
Vi oplever problemer med flere atlantiske produkter. Vores hold undersøger yderligere og flere opdateringer, herunder vil blive delt inden for 1 time.
- identified
Vi har identificeret, at den grundlæggende årsag til problemet er relateret til en infrastruktur afbrydelse fra vores offentlige cloud-udbyder. Vi arbejder tæt sammen med dem for at mindske dette problem. Vi vil give yderligere opdateringer, når de bliver tilgængelige.
- identified
Vores team fortsætter med at arbejde på at afbøde den infrastruktur udfald fra vores offentlige cloud-udbyder. Vi vil give yderligere opdateringer, når de er tilgængelige.
- identified
Vi arbejder fortsat med vores offentlige cloud-udbyder for at mindske dette problem. Vi begynder at se en vis bedring i regioner uden for det østlige USA, men brugerne globalt kan stadig opleve problemer med visse produktfunktioner. Disse er anført i bunden af hver produktside.
- monitoring
Det underliggende problem i den offentlige infrastruktur, som påvirkede en synkront sagsbehandling, er blevet afbødet, og alle de berørte tjenester er ved at komme sig. Vi arbejder nu på at rydde tilbage i kø begivenheder, hvilket betyder, at nogle handlinger (såsom meddelelser, automatisering udløser, og data synkronics) kan være i forringet tilstand. Vi vil fortsætte med at overvåge og levere opdateringer, når backlog er ryddet.
- monitoring
Vi følger fortsat situationen, efterhånden som tjenesterne kommer sig. Vi er i øjeblikket i færd med at rydde op i baggrunden af begivenheder i køen. Vi vil give en yderligere opdatering om cirka en time.
- monitoring
Vores tjenester er nu fuldt operationelle. Vi fortsætter med at spille alle begivenheder, der blev savnet under hændelsen, og gør gode fremskridt. Vi vil give en yderligere opdatering, når replays er færdige. Hvis du oplever nogen løbende problemer, bedes du kontakte vores support team. Vi undskylder forstyrrelsen og takker for Deres tålmodighed.
- resolved
Den 8. maj 2026, nogle kunder, der udnytter Atlantiske produkter oplevede forhøjede fejlrater og forringet ydeevne. Spørgsmålet er nu løst, og tjenesten fungerer normalt for alle berørte kunder.
- postmortem
Alle datoer og tidspunkter nedenfor er i UTC, medmindre andet er angivet. # # # Oversigt Den 8. maj 2026 mellem 00: 22 og 06: 08, en af vores hosting udbydere lidt en betydelig hændelse i en specifik tilgængelighed zone i prod-øst, som førte til Atlantis kunder oplever forringet ydeevne og forsinkelser i baggrund operationer og automatisering udførelse. Hændelsen startede den 8. maj 2026 kl 00: 22 og blev opdaget inden for 4 minutter af automatiske overvågningssystemer. Vores hold arbejdede på at genoprette kerneluften kl. 06: 08. Den endelige oprensning af backlingede processer og mindre problemer skred frem i etaper derfra blev afsluttet iterativt 19: 15. # # # * * IMPACT * * Den primære infrastruktur, der var berørt af denne hændelse, var den event processing pipeline i prod-øst regionen, som distribuerer begivenheder mellem Atlantis tjenester og understøtter baggrundsoperationer såsom automatisering udførelse, søgning indeksering, meddelelser, tilladelse synkronisering. * Mellem 00: 22 og 06: 08, en infrastruktur hændelse i vores hosting udbyder udløste en indtagelse fiasko i vores begivenhed behandling rørledning. * Ved 02: 50, begivenhed indtagelse blev undladt over til en upåvirket tilgængelighed zone, gradvist genoprette live begivenhed strømme. * Ved 06: 08, pålidelighed for ny indtagelse i prod-øst genvundet til 100%. Det resterende arbejde var at tømme den akkumulerede cross-region efterslæb af meddelelser, som afsluttet kl 17: 00. * Ved 18: 48, Automation havde behandlet deres backlog af begivenheder, der blev oprettet under behandlingen * * Automation * * Mellem kl. 00: 22 og 02: 50 oplevede kunder med automatiseringsregler, der blev udløst af begivenheder, der stammede fra den pro-østlige region, en betydelig reduktion af regelhenrettelser. Under dette vindue blev der ikke affyret automatiseringsregler, fordi de begivenheder, der udløste dem, ikke blev leveret. Regel authoring, besparelse og regler udløst manuelt, af skemaer, eller af webkroge blev ikke påvirket. Klokken 02: 50, den begivenhed behandling infrastruktur mislykkedes over til en upåvirket tilgængelighed zone, genoprette levering af live begivenheder til Automation og tillade nye begivenhedsudløste regler til at begynde at udføre normalt. Begivenheder, der genereres under nedslagsvinduet, skal dog stadig afspilles igen, før forsinkede automatiseringer kunne behandles. Begyndelsen 08: 28, opstrøms tjenester genspillede deres queued begivenheder i en koordineret rækkefølge, og alle genspillede begivenheder blev behandlet af 18: 48. Under replay vinduet, kunder kan have oplevet automatisering regler, der udføres senere end forventet, et lille antal regler, der når daglige behandlingsgrænser på grund af komprimeret replay, og tidsfølsomme regler ikke udfylde som forventet, hvis interne timeout tærskler blev overskredet. * * Jira og Jira Service Management * * Mellem 00: 22 og 02: 50, kunder med lejere hostet i pro-øst regionen oplevede forstyrrelser til Jira og Jira Service Management events-drevne funktioner som automatisering, sammen med en kort periode med forhøjede fejl under infrastruktur failover. Core Jira erfaringer, herunder problemvisning, bestyrelser og projekt navigation, forblev tilgængelige under hele hændelsen. Jira hændelseslevering blev påvirket af den primære virkning, hvilket forhindrede downstream-tjenester i at modtage spørgsmål livscyklusbegivenheder. Dette påvirkede automatiseringsregler udløst af Jira begivenheder, AI agent orkestrering i Jira, meddelelser om spørgsmål opdateringer og overgange, søgning indeksering for nyoprettede eller modificerede spørgsmål, og eventueldrevne integreringer mellem Jira og andre atlantiske produkter. Kl. 02: 50, den begivenhed behandling infrastruktur mislykkedes over til en upåvirket tilgængelighed zone, genoprette levering af nye begivenheder. Alle begivenheder, der blev genereret under slagvinduet, blev fastholdt i en recovery kø og krævede genspil. Dette begyndte kl 08: 28 og afsluttet kl 12: 00. Under replay-vinduet, kan kunderne have oplevet automatisering regler, der udføres senere end forventet, forsinkede meddelelser ankommer timer efter den udløsende handling, midlertidige huller i søgeresultater for indhold skabt eller ændret under påvirkningsvinduet, og AI agent arbejdsgange ikke udfylde som forventet, hvor interne timeout tærskler blev overskredet. * * Sammenhæng * * Mellem kl. 00: 22 og 02: 50 oplevede kunder med lejere, der var hostede i den pro-østlige region, forstyrrelser til eventdrevne tjenester i Confluence. Dette resulterede i forsinkelser i søgning indeksering, meddelelser, automatisering regel udførelse, og tilladelse synkronisering. Den underliggende event processing infrastruktur mislykkedes over til en upåvirket tilgængelighed zone, hvorefter live Confluence operationer genoptaget normalt. Men begivenheder, der blev genereret under påvirkningsvinduet var i kø for at spille igen, og nogle baggrundstjenester forblev forsinket, indtil dette spil og relaterede valideringsarbejde afsluttet. Mellem 10: 14 og 17: 00 blev en bulk replay af alle de queued lejer replay opgaver afsluttet for at gendanne data konsistens. Under og umiddelbart efter genafspilningsvinduet, kan kunderne have oplevet søgeresultater, der ikke afspejler indhold skabt eller ændret under udfald, forsinkede eller manglende meddelelser til side og kommentaraktivitet, automatiseringsregler fyring senere end forventet, og korte forsinkelser i tilladelse synkronisering for lejere, der er afhængige af trinvis identitet synkronisering. * * Bitskovl og rørledninger * * Mellem 00: 22 og 06: 08, kunder, der bruger Bitspande og Pipelines oplevede svigt og forringet funktionalitet på tværs af begivenhedsdrevne arbejdsgange. Core Git operationer, herunder skubbe, trække, og klon, blev ikke påvirket og fortsatte med at fungere normalt under hændelsen. Automatic pipeline triggers initiated by push or pull request events was available under kollisionsvinduet. Sammenfletning køer, brugerdefinerede fletning kontrol, Forge- baserede udløsere, arbejdsrumstilladelser ændringer, og nogle arbejdsrums provisionsstrømme blev også påvirket. Kunder, der bruger fletning køer var ude af stand til at flette pull anmodninger, og nogle pipeline trin mislykkedes, fordi queued arbejde bidrog til forhøjede concurrency grænser. Ved ca. 03: 57, blev Pipelines omkonfigureret til at forbruge begivenheder gennem en alternativ sti, genetablere automatisk rørledning udløser. Sammenfletning køer, brugerdefinerede fletning kontroller, Forge udløser, og andre berørte arbejdsgange blev gradvist restaureret som den underliggende begivenhed behandling infrastruktur genvundet. Alle Bitspace- og Pipelines-tjenester blev bekræftet fuldt operationelle kl. 06.08. Efter inddrivelse, i kø begivenheder blev gennemgået og genspillet, hvor sikkert at gendanne data konsistens til fakturering, revision logning, og andre baggrundsprocesser. * * Identitetstjenester * * Mellem kl. 00: 22 og 02: 50 oplevede kunder med lejere, der var vært i den pro-østlige region, forsinkelser i udbredelsen af identitet og gruppemedlemskab ændringer i de efterfølgende Atlantiske produkter. Kerneidentitetsoperationer, herunder autentificering, login og direkte gruppeledelse, blev ikke påvirket og fortsatte med at fungere normalt under hele hændelsen. Virkningen var begrænset til asynkron, eventueldrevne operationer, der afhænger af hændelsesbehandling rørledningen. Dette omfattede forsinkelser i levering af gruppemedlemskab og brugerprofilændringer til produkter som Jira og Confluence, som påvirkede downstream tilladelse synkronisering og crowd sync strømme. Et lille antal VIDENSKABSbaserede identitetssynkroniseringer og arbejdsgange, hvor der provieres på stedet, oplevede også midlertidige forsinkelser. Efter at event processing infrastruktur genvundet, backed- up identitet og gruppe mappe begivenheder blev genspillet, hvor det var nødvendigt, genoprette downstream sammenhæng for berørte produkter. Ingen identitetsdata blev tabt. Gruppemedlemskab ændringer, brugerprofilopdateringer, og provisionsrelaterede begivenheder, der opstod i løbet af påvirkningsvinduet blev beholdt og behandlet efter inddrivelse. # # # * * MIDLERTIDIGE AKTIONER PLAN & NÆSTE STEPS * * Vi ved, at udfald påvirker din produktivitet. Mens vores overvågnings- og inddrivelsesprocesser hjalp os med at reagere hurtigt, fremhævede denne hændelse muligheder for yderligere at styrke modstandsdygtigheden for eventueldrevne tjenester. Vi prioriterer forbedringer, der vil: * * * Forbedre fejloverdækning * * så kritisk begivenhed behandling kan komme sig mere problemfrit under infrastruktur forstyrrelser. * * * Styrke inddrivelse håndtering * * så genspillede begivenheder kan behandles hurtigere. Vi undskylder til kunder, hvis tjenester blev påvirket under denne hændelse; vi tager øjeblikkelige skridt til at forbedre platformens ydeevne og tilgængelighed. Tak. Atlantisk kundesupport.
Automatisk oversat fra den officielle hændelsesopdatering.