Ιστοσελίδα και έξοδος από το ταμπλό
- investigating
Αυτή τη στιγμή ερευνούμε ένα θέμα που επηρεάζει την ιστοσελίδα και το ταμπλό. Οι χρήστες μπορεί να βιώσουν αυξημένο αριθμό σφαλμάτων. Η ομάδα μας εργάζεται για τον εντοπισμό της βασικής αιτίας, και θα παρέχουμε μια ενημέρωση μόλις γίνουν διαθέσιμες περισσότερες πληροφορίες. Ζητάμε συγγνώμη για την ταλαιπωρία και εκτιμούμε την υπομονή σας.
- identified
Η ομάδα μας έχει εντοπίσει την αιτία του ζητήματος που επηρεάζει την ιστοσελίδα και το ταμπλό και εργάζεται ενεργά για την υλοποίηση μιας μόνιμης λύσης. Ορισμένοι χρήστες ενδέχεται να εξακολουθούν να αντιμετωπίζουν προβλήματα συνδεσιμότητας κατά τη διάρκεια αυτής της περιόδου. Θα συνεχίσουμε να μοιραζόμαστε ενημερώσεις καθώς σημειώνουμε πρόοδο προς την πλήρη επίλυση. Σας ευχαριστώ για τη συνεχή υπομονή σας.
- identified
Η ομάδα μας προσπαθεί να εφαρμόσει μια μόνιμη λύση. Ορισμένοι χρήστες ενδέχεται να εξακολουθούν να αντιμετωπίζουν προβλήματα συνδεσιμότητας κατά τη διάρκεια αυτής της περιόδου. Θα συνεχίσουμε να μοιραζόμαστε ενημερώσεις καθώς σημειώνουμε πρόοδο προς την πλήρη επίλυση.
- resolved
Το ζήτημα που αφορά τον Ιστότοπο και τον πίνακα έχει επιλυθεί από τις 11:30 UTC. Οι χρήστες δεν πρέπει πλέον να βιώνουν το ζήτημα. Η ομάδα μας συνεχίζει να παρακολουθεί τις επιδόσεις για να εξασφαλίσει σταθερότητα. Ζητάμε συγγνώμη για οποιαδήποτε αναστάτωση που μπορεί να προκάλεσε αυτό το θέμα και να εκτιμήσει την κατανόησή σας. Σας ευχαριστώ για την υπομονή σας, και παρακαλώ επικοινωνήστε για να υποστηρίξει αν παρατηρήσετε κάτι ασυνήθιστο.
- postmortem
Στις 16 Ιουλίου 2026, μεταξύ 07:55 UTC και 11:15 UTC \ (περίπου 3 ώρες και 20 λεπτά\), η ιστοσελίδα του Upcare και η πύλη του πελάτη δεν ήταν εν μέρει διαθέσιμες. Κατά τη διάρκεια αυτού του παραθύρου, τα επηρεαζόμενα αιτήματα ενδέχεται να αποτύχουν στις διανομές μας CloudFront με 504 λάθη χρονοδιακόπτη Gateway και δεν έφτασαν ποτέ στις υπηρεσίες υποστήριξης. Η διακοπή προκλήθηκε από μια παγκόσμια Amazon Web Services \(AWS\) CloudFront διακοπή που επηρεάζει VPC Origins, τον τύπο προέλευσης που βασιζόμαστε για την ιστοσελίδα και την πύλη των πελατών. Τα αιτήματα που δρομολογήθηκαν μέσω VPC Origins απέτυχαν, ενώ οι διανομές CloudFront χρησιμοποιώντας άλλους τύπους προέλευσης δεν επηρεάστηκαν. Η AWS αργότερα απέδωσε τη διακοπή σε έναν εσωτερικό περιορισμό χωρητικότητας στον στόλο που διαχειρίζεται συνδέσεις με ιδιωτικές VPC προέλευσης, γεγονός που προκάλεσε τη διαμόρφωση δρομολόγησης να διανέμεται λανθασμένα στους επεξεργαστές δικτύου της. Σημαντικό είναι ότι οι βασικές υπηρεσίες μας πλατφόρμας — συμπεριλαμβανομένης της αποστολής αρχείων, της αποθήκευσης, της επεξεργασίας και της παράδοσης ήδη καλυμμένων αρχείων — δεν επηρεάστηκαν από αυτό το περιστατικό και συνέχισαν να λειτουργούν κανονικά καθ' όλη τη διάρκεια. Η συνέχεια της εργασίας μας επικεντρώνεται στο να διατηρήσουμε μια αποδεδειγμένη, έτοιμη προς ανάπτυξη υποχώρηση για αυτή την κατηγορία της αποτυχίας AWS CloudFront. # **Χρονολόγιο γεγονότων ** Όλες οι φορές είναι σε UTC στις 16 Ιουλίου 2026. * * **07:55 — ** Οι μετρήσεις CloudFront αρχίζουν να παρουσιάζουν αυξημένα ποσοστά σφάλματος για την ιστοσελίδα μας και τις διανομές του webclient. * **07:59 — ** Οι ειδοποιήσεις παρακολούθησης μας ότι [uploadcare.com] (http://uploadcare.com) είναι απρόσιτες. Η ομάδα μας αρχίζει να ερευνά αμέσως. * **08:02 —** Επιβεβαιώνουμε 504 λάθη για [uploadcare.com] (http://uploadcare.com) και παρατηρούμε ότι τα αιτήματα δεν φτάνουν στο σύστημα υποστήριξης μας. Άλλες διανομές CloudFront μας παραμένουν υγιείς. * **08:07 — ** Με βάση το μοτίβο του λάθους και τη σελίδα 504 του CloudFront, το CloudFront γίνεται η κύρια ύποπτη βασική αιτία. Σε αυτό το σημείο AWS δεν είχε ακόμη δημοσιεύσει καμία ειδοποίηση, αν και η ευρύτερη κοινότητα είχε αρχίσει να αναφέρει προβλήματα CloudFront. * **08:28 — ** Επιβεβαιώνουμε ότι το θέμα επηρεάζει τις δημόσιες ιστοσελίδες και την πύλη των πελατών μας. * **08:42 — ** Οι μετρήσεις CloudFront δείχνουν ένα ποσοστό σφάλματος περίπου 30%. * * **08:44 — ** AWS αναγνωρίζει μια παγκόσμια διακοπή CloudFront που σχετίζεται με VPC Origins — περίπου 49 λεπτά μετά την έναρξη της πρόσκρουσης μας. * **09:23 — ** Αρχίζουμε να υλοποιούμε ένα fallback: αλλαγή επηρεαζόμενης προέλευσης από VPC Origins σε internet-spect Application Load Balancers \(ALBs\). **10:58 -** Η υποχώρηση αναπτύσσεται στο περιβάλλον μας για επικύρωση. * **11:02 -** Η υποχώρηση περνά την επικύρωση κατά τη στάτευση. Αρχίζουμε τις ίδιες αλλαγές προς την παραγωγή. * **11:15 — ** AWS επιλύει την υποκείμενη διακοπή. Οι ιστοσελίδες παραγωγής μας και portall πελατών ανακάμπτουν πλήρως και τα ποσοστά σφαλμάτων επιστρέφουν στο μηδέν. Επειδή η AWS ανέκαμψε πρώτη, η παραγωγή δεν ήταν απαραίτητη. Δηλώνουμε ότι το περιστατικό λύθηκε. # ** Τι πήγε καλά ** * **Γρήγορη ανίχνευση και διάγνωση. ** Ο έλεγχός μας εντόπισε την αποτυχία μέσα σε λίγα λεπτά, και η ομάδα μας την συσχετίζει με ένα ευρύτερο θέμα AWS και εντόπισε την πιθανή βασική αιτία πριν η AWS αναγνωρίσει τη διακοπή δημόσια. * * * * * Μια επικυρωμένη άμβλυνση. ** Κατά τη διάρκεια του περιστατικού σχεδιάσαμε, εφαρμόσαμε και επικυρώσαμε μια αναδρομή — μετατρέψτε τις πηγές του CloudFront από VPC Origins σε ALB με προοπτική το διαδίκτυο — στο περιβάλλον μας. Το AWS ανέκαμψε πριν χρειαστεί να το εφαρμόσουμε στην παραγωγή, αλλά αυτό είναι πλέον ένας αποδεδειγμένος μετριασμός για μελλοντικά περιστατικά VPC Origins. * ** Περιεχόμενη πρόσκρουση. ** Επειδή η αποτυχία περιοριζόταν σε διανομές που χρησιμοποιούσαν VPC Origins, η βασική μας πλατφόρμα — uploads αρχείων, αποθήκευση, επεξεργασία και λανθάνουσα παράδοση — παρέμεινε πλήρως λειτουργική. # ** Τι πήγε στραβά ** * ** Μια κοινή εξάρτηση προέλευσης. ** Η δημόσια ιστοσελίδα μας και οι διανομές πύλης πελατών όλα στηρίζονταν στο CloudFront VPC Origins, έτσι μια ενιαία βλάβη υποσυστήματος AWS τους επηρέασε μαζί με καμία αποτυχία. # ** Στοιχεία δράσης ** * ** Κρατήστε ένα έτοιμο για ανάπτυξη CloudFront fallback. ** Έχουμε προετοιμάσει και επικυρώσει αλλαγές υποδομής για να αλλάξουμε τις επηρεαζόμενες διανομές από VPC Origins σε ALB με προοπτική το διαδίκτυο, έτσι αυτός ο μετριασμός μπορεί να εφαρμοστεί γρήγορα σε περίπτωση που επαναληφθεί παρόμοια διακοπή AWS. Ζητάμε ειλικρινά συγγνώμη για την αναστάτωση που προκάλεσε αυτό το περιστατικό, και για την καθυστέρηση στην επικοινωνία μέσω της σελίδας κατάστασης μας. Ενώ η βασική αιτία ήταν μια εκτός λειτουργίας AWS εκτός του άμεσου ελέγχου μας, δεσμευόμαστε να μειώσουμε την έκθεσή μας σε αυτή την κατηγορία αποτυχίας και να επικοινωνούμε πιο γρήγορα και με διαφάνεια στο μέλλον.
Αυτόματη μετάφραση από την επίσημη ενημέρωση του συμβάντος.