Potencjał niektórych nieodebranych wiadomości dla abonentów w US East PoP
- investigating
Od 12: 15 UTC, Użytkownicy w naszym US East PoP doświadczają obecnie problemu z usługi Publish i Subscribe, który powoduje, że niektóre wiadomości nie pojawiają się w wywołaniach do tej usługi. Nie są zwracane żadne błędy z usługi, mimo że wiadomości nie są zwracane poprawnie. Badamy tę sprawę.
- monitoring
Od 13: 55 UTC kwestia dotycząca usług wydawniczych i subskrybowanych w US East PoP została złagodzona. Syntetyczny monitoring powrócił do normy i nie wykryto nieodebranych wiadomości. Obecnie uważa się, że incydent miał związek z niepowodzeniem monitorowania. Trwa dalsze dochodzenie, a usługa jest nadal ściśle monitorowana.
- resolved
W ciągu ostatnich 30 minut nie zaobserwowano żadnych dalszych problemów, incydent został rozwiązany. Wkrótce przejdziemy do analizy przyczyn. Jeśli uważasz, że doświadczyłeś wpływu związanego z tym incydentem, zgłoś go do PubNub Support na support @ pubnub.com. com.
- postmortem
# # # * * Problem Opis, uderzenie i rozdzielczość * * We wtorek, 25 sierpnia 2026 roku, o godzinie 12: 10 UTC, nasz wewnętrzny monitoring ostrzegł nas o problemie, w którym bardzo mały podzbiór wiadomości w obrębie jednej strefy dostępności w jednym regionie\ (nasz wschodni punkt obecności\) może nie być natychmiast dostarczony abonentom w tym samym regionie. Wszystkie wiadomości utrzymywały się normalnie w ramach usługi Uporczywości PubNub, * * w związku z czym żadne dane nie zostały utracone. * * Ruch do lub z jakiegokolwiek innego regionu lub AZ nie został naruszony, a inne usługi PubNub nie zostały naruszone. Żaden klient nie zgłosił wpływu. * * * Root Cause * * Podczas planowanych wewnętrznych testów obciążenia grupa wewnętrznych serwerów routingu została usunięta z serwisu. Ze względu na usterkę konfiguracji, ich adresy sieciowe nie były w pełni wycofane i pozostały buforowane przez naszą warstwę wydawniczą. W większości przypadków nie stanowiło to problemu. Jednakże jeden adres został następnie przeniesiony do niepowiązanego komponentu wewnętrznego, który normalnie odpowiadał na ten sam protokół i port. Ponieważ odpowiedź ta okazała się sukcesem, warstwa wydawnicza nie otrzymała żadnych błędów, a wiadomości wysyłane na ten adres były niepoprawnie kierowane. Ponowne uruchomienie dotkniętych serwerów wyczyściło przestarzałe adresy o 13: 25 UTC. * * * Legalizacja kroków i zalecane przyszłe środki zapobiegawcze * * * Po zidentyfikowaniu dotkniętych serwerów, przeprowadzono restart toczenia w celu usunięcia przestarzałych adresów routingu. * W wyniku dochodzenia, które potwierdziło przyczynę, w dniu 25 sierpnia 2026 r. o godzinie 22: 00 UTC wprowadzono poprawki zapewniające prawidłową rezygnację ze wszystkich serwerów wydawniczych na całym świecie.
Automatyczne tłumaczenie oficjalnej aktualizacji incydentu.