Site web și pană de bord
- investigating
Investigăm în prezent o problemă care afectează site-ul web și tabloul de bord. Utilizatorii pot experimenta un număr crescut de erori. Echipa noastră lucrează pentru a identifica cauza principală, și vom oferi o actualizare de îndată ce mai multe informații devin disponibile. Ne cerem scuze pentru orice neplăceri şi apreciem răbdarea ta.
- identified
Echipa noastră a identificat cauza problemei de impact site-ul și Dashboard și este activ de lucru pentru a implementa o soluție permanentă. Unii utilizatori pot avea încă probleme de conectivitate în acest timp. Vom continua să punem în comun actualizările în timp ce facem progrese în direcția unei rezoluții complete. Mulţumesc pentru răbdare.
- identified
Echipa noastră lucrează pentru a implementa o soluţie permanentă. Unii utilizatori pot avea încă probleme de conectivitate în acest timp. Vom continua să punem în comun actualizările în timp ce facem progrese în direcția unei rezoluții complete.
- resolved
Problema care afectează Site-ul și Dashboard a fost rezolvată la 11:30 UTC. Utilizatorii nu ar trebui să mai experimenteze problema. Echipa noastră continuă să monitorizeze performanţa pentru a asigura stabilitatea. Ne cerem scuze pentru orice întrerupere pe care această problemă ar fi putut-o cauza şi aprecia înţelegerea voastră. Vă mulțumim pentru răbdare, și vă rugăm să ajungeți pentru a sprijini dacă observați ceva neobișnuit.
- postmortem
La 16 iulie 2026, între 07:55 UTC și 11:15 UTC \(aproximativ 3 ore și 20 minute\), Site-ul web al UTC și portalul clienților nu erau disponibile parțial. În timpul acestei ferestre, cererile afectate ar putea eşua la distribuţiile noastre CloudFront cu 504 erori Gateway Timeout şi nu au ajuns niciodată la serviciile noastre de suport. Perturbarea a fost cauzată de un Amazon Global Web Services \ (AWS\) CloudFront pană care afectează VPC Origins, tipul de origine pe care ne bazăm pentru site-ul web și portalul clienților. Cererile rutate prin VPC Origins au eșuat, în timp ce distribuția CloudFront folosind alte tipuri de origine nu a fost afectată. AWS a atribuit ulterior întreruperii unei constrângeri interne de capacitate în flota care gestionează conexiunile la origini private VPC, ceea ce a determinat distribuirea incorectă a configurației rutei către procesatorii rețelei sale. Important este faptul că serviciile noastre de platformă centrală, inclusiv încărcarea fișierelor, stocarea, procesarea și livrarea fișierelor deja construite, nu au fost afectate de acest incident și au continuat să funcționeze în mod normal pe tot parcursul. Lucrările noastre de follow-up se concentrează pe păstrarea unui rezultat dovedit, gata să-se ocupe de această clasă de AWS CloudFront eșec. # **Timeline of events** Toate timpurile sunt în UTC pe 16 iulie 2026. * **07:55 * **07:59 * Monitorizarea noastră alertează că [uploadcarecare.com](http://uploadcare.com) nu poate fi contactat. Echipa noastră de inginerie începe să investigheze imediat. * **08:02 Alte distribuţii CloudFront rămân sănătoase. * **08:07 * Bazat pe modelul de eroare și pe pagina de eroare generată de CloudFront 504, CloudFront devine principala noastră cauză de rădăcină suspectată. În acest moment AWS nu a postat încă nici o notificare, deși comunitatea mai largă a început raportarea problemelor CloudFront. * **08:28 * Confirmăm că problema afectează site-urile noastre publice și portalul clienților. * **08:42 * **08:44 * **09:23 * Începem punerea în aplicare a unei retrageri: trecerea originilor afectate de la originile VPC Originile aplicației cu vedere la internet Balancers \(ALBs\). * **10:58 * Retragerea este implementată în mediul nostru de pregătire pentru validare. * **11:02 *** Retragerea trece validarea pe platou. Începem să facem aceleaşi schimbări către producţie. * **11:15 Site-urile noastre de producție și portall client recupera complet și ratele de eroare reveni la zero. Deoarece AWS și-a revenit mai întâi, producția nu a fost necesară. Declarăm incidentul rezolvat. Ce a mers bine * ** Detectare şi diagnosticare rapidă. ** Monitorizarea noastră a detectat eșecul în câteva minute, iar echipa noastră a corelat-o cu o problemă mai largă AWS și a identificat cauza de rădăcină probabilă înainte ca AWS să recunoască în mod public întreruperea. * ** O atenuare validată. ** În timpul incidentului am proiectat, implementat și validat un backback AWS recuperat înainte de a avea nevoie să-l aplice la producție, dar acest lucru este acum o atenuare dovedită pentru viitoarele incidente VPC Origins. * **Contained impact.** Deoarece eșecul a fost limitat la distributii folosind VPC Origins, platforma noastră principală Ce a mers prost? * **O dependenţă comună de origine.** Site-ul nostru public și distribuția de portaluri ale clienților s-au bazat pe "CloudFront VPC Origins," astfel încât o singură defecțiune a subsistemului AWS le-a afectat împreună cu nici un eșec. # **Action items** * ** Keep a ready-to-play CloudFront fallback.** Am pregătit și validat modificările de infrastructură pentru a comuta distribuțiile afectate de la VPC Origins la ALB-uri cu vedere la internet, astfel încât această atenuare să poată fi aplicată rapid în cazul în care se repetă o pană de curent alternativ similară. Ne cerem sincer scuze pentru întrerupere acest incident cauzat, și pentru întârzierea în comunicarea acestuia prin intermediul paginii noastre de stare. În timp ce cauza principală a fost o pană în afara controlului nostru direct, ne-am angajat să reducem expunerea noastră la această clasă de eșec și să comunicăm mai rapid și mai transparent în viitor.
Traducere automată din actualizarea oficială a incidentului.