Strona internetowa i deska rozdzielcza
- investigating
Obecnie badamy problem wpływający na stronę internetową i tablicę rozdzielczą. Użytkownicy mogą doświadczyć zwiększonej liczby błędów. Nasz zespół pracuje nad zidentyfikowaniem przyczyny, a my dostarczymy aktualizację jak tylko więcej informacji stanie się dostępne. Przepraszamy za wszelkie niedogodności i doceniamy waszą cierpliwość.
- identified
Nasz zespół zidentyfikował przyczynę problemu wpływającego na stronę internetową i tablicę rozdzielczą i aktywnie pracuje nad wdrożeniem stałego rozwiązania. Niektórzy użytkownicy mogą w tym czasie nadal doświadczać problemów związanych z łącznością. Będziemy nadal dzielić się aktualizacjami w miarę postępów w kierunku pełnej rezolucji. Dziękuję za cierpliwość.
- identified
Nasz zespół pracuje nad wdrożeniem stałego rozwiązania. Niektórzy użytkownicy mogą w tym czasie nadal doświadczać problemów związanych z łącznością. Będziemy nadal dzielić się aktualizacjami w miarę postępów w kierunku pełnej rezolucji.
- resolved
Kwestia dotycząca strony internetowej i tablicy rozdzielczej została rozwiązana od 11: 30 UTC. Użytkownicy nie powinni już tego doświadczać. Nasz zespół nadal monitoruje wydajność, aby zapewnić stabilność. Przepraszamy za wszelkie zakłócenia, które mogły spowodować i docenić pana zrozumienie. Dziękuję za cierpliwość, i proszę sięgnąć po wsparcie, jeśli zauważysz coś niezwykłego.
- postmortem
16 lipca 2026, między 07: 55 UTC a 11: 15 UTC\ (około 3 godzin i 20 minut\), strona internetowa Uploadcare i portal klienta były częściowo niedostępne. Podczas tego okna, dotknięte żądania mogą nie powiodły się na naszych dystrybucjach CloudFront z błędami 504 Gateway Timeout i nigdy nie dotarły do naszych usług backend. Zakłócenie to zostało spowodowane przez globalną Amazon Web Services\ (AWS\) CloudFront extage wpływającą na VPC Origins, rodzaj pochodzenia, na którym polegamy dla strony internetowej i portalu klienta. Wnioski kierowane przez VPC Origins nie powiodły się, podczas gdy dystrybucje CloudFront przy użyciu innych typów pochodzenia nie zostały naruszone. AWS później przypisał wyłączenie do wewnętrznego ograniczenia przepustowości we flocie, która zarządza połączeniami z prywatnymi źródłami VPC, co spowodowało nieprawidłową dystrybucję konfiguracji trasy do jej procesorów sieciowych. Co ważne, nasze podstawowe usługi platformowe - w tym przesyłanie plików, przechowywanie, przetwarzanie i dostarczanie plików już buforowanych - nie zostały naruszone przez ten incydent i nadal działają normalnie przez cały czas. Nasze dalsze prace skupiają się na utrzymaniu sprawdzonego, gotowego do rozmieszczenia awaryjnego dla tej klasy AWS CloudFront. * * * Czas zdarzeń * * Wszystkie czasy są w UTC 16 lipca 2026. * * * 07: 55 - * * Wskaźniki CloudFront zaczynają wykazywać podwyższony poziom błędów dla naszej strony internetowej i dystrybucji webclient. * * * 07: 59 - * * Nasze alarmy monitorujące, że [uploadcare.com] (http: / / uploadcare.com) jest nieosiągalny. Nasz zespół inżynieryjny natychmiast rozpoczyna śledztwo. * * * 08: 02 - * * Potwierdzamy błędy 504 dla [uploadcare.com] (http: / / uploadcare.com) i obserwujemy, że prośby nie docierają do naszego oparcia. Inne dystrybucje CloudFront pozostają zdrowe. * * * 08: 07 - * * Opierając się na wzorze błędu i wygenerowanej przez CloudFront stronie 504 błędów, CloudFront staje się naszą główną podejrzewaną przyczyną. W tym momencie AWS nie opublikował jeszcze żadnego zawiadomienia, choć szersza społeczność zaczęła zgłaszać problemy CloudFront. * * * 08: 28 - * * Potwierdzamy, że problem wpływa na nasze strony internetowe i portal klienta. * * * 08: 42 - * * Wskaźniki CloudFront pokazują poziom błędu około 30%. * * * 08: 44 - * * AWS uznaje globalny brak CloudFront związany z VPC Origins - około 49 minut po naszym uderzeniu. * * * 09: 23 - * * Rozpoczynamy implementację odwrotu: przełączanie czułych początków z VPC Origins na sieciowo nastawione Balancery obciążenia aplikacji\ (ALB\). * * * 10: 58 - * * Odwrót jest przeznaczony do zatwierdzenia. * * * 11: 02 - * * Opadek przechodzi walidację podczas inscenizacji. Zaczynamy toczyć te same zmiany w kierunku produkcji. * * * 11: 15 - * * AWS rozwiązuje problem. Nasze strony internetowe produkcji i portall klienta w pełni odzyskać i stawki błędów wrócić do zera. Ponieważ AWS odzyskał jako pierwszy, spadek produkcji nie był wymagany. Oświadczamy, że incydent został rozwiązany. / Co poszło dobrze * * * Szybka detekcja i diagnoza. * * Nasz monitoring wykrył awarię w ciągu kilku minut, a nasz zespół skorelował ją z szerszą sprawą AWS i zidentyfikował prawdopodobną przyczynę, zanim AWS publicznie potwierdziło brak. * * * Zatwierdzone ograniczenie. * * Podczas incydentu zaprojektowaliśmy, wdrożyliśmy i zatwierdziliśmy zapas - przełączyliśmy początki CloudFront z VPC Origins na internetowe ALB - na nasze środowisko postojowe. AWS odzyskane zanim musieliśmy zastosować go do produkcji, ale teraz jest to udowodnione łagodzenie przyszłych incydentów VPC Origins. * * * Ograniczone uderzenie. * * Ponieważ awaria była ograniczona do dystrybucji przy użyciu VPC Origins, nasza podstawowa platforma - pliki do przesyłania, przechowywania, przetwarzania i cached dostawy - pozostała w pełni operacyjna. * * What went wrong * * * * * Współdzielona zależność od pochodzenia. * * Nasza publiczna strona internetowa i dystrybucja portalu klienta opierały się na CloudFront VPC Origins, więc jedna awaria podsystemu AWS wpłynęła na nich wraz z brakiem awarii. * * * Pozycje akcji * * * * * Keep a ready-to-putting CloudFront fallback. * * Przygotowaliśmy i zatwierdziliśmy zmiany w infrastrukturze w celu przełączania dystrybucji z VPC Origins na ALBs zwrócone do sieci, więc to łagodzące może być stosowane szybko, jeśli podobne AWS out recur. Serdecznie przepraszamy za zakłócenie tego incydentu i za opóźnienie w przekazywaniu go przez naszą stronę statusu. Podczas gdy głównym powodem był brak AWS-side poza naszą bezpośrednią kontrolą, jesteśmy zobowiązani do zmniejszenia naszego narażenia na tę klasę niepowodzeń oraz do szybszego i bardziej przejrzystego komunikowania się w przyszłości.
Automatyczne tłumaczenie oficjalnej aktualizacji incydentu.