Sito web e outage Dashboard
- investigating
Stiamo attualmente indagando su un problema che riguarda il sito web e Dashboard. Gli utenti possono sperimentare un maggior numero di errori. Il nostro team sta lavorando per identificare la causa principale, e forniremo un aggiornamento non appena ulteriori informazioni saranno disponibili. Ci scusiamo per qualsiasi inconveniente e apprezziamo la vostra pazienza.
- identified
Il nostro team ha identificato la causa del problema che colpisce il sito web e Dashboard e sta attivamente lavorando per implementare una soluzione permanente. Alcuni utenti possono ancora sperimentare problemi di connettività durante questo periodo. Continueremo a condividere gli aggiornamenti mentre facciamo progressi verso la risoluzione completa. Grazie per la vostra continua pazienza.
- identified
Il nostro team sta lavorando per implementare una soluzione permanente. Alcuni utenti possono ancora sperimentare problemi di connettività durante questo periodo. Continueremo a condividere gli aggiornamenti mentre facciamo progressi verso la risoluzione completa.
- resolved
Il problema riguardante il sito web e Dashboard è stato risolto a partire dalle 11:30 UTC. Gli utenti non dovrebbero più sperimentare il problema. Il nostro team continua a monitorare le prestazioni per garantire la stabilità. Ci scusiamo per qualsiasi disturbo questo problema potrebbe aver causato e apprezzare la vostra comprensione. Grazie per la vostra pazienza, e si prega di raggiungere per sostenere se si nota qualcosa di insolito.
- postmortem
Il 16 luglio 2026, tra le 07:55 UTC e le 11:15 UTC \(circa 3 ore e 20 minuti\), il sito web di Uploadcare e il portale del cliente erano parzialmente non disponibili. Durante questa finestra, le richieste interessate potrebbero fallire nelle nostre distribuzioni CloudFront con errori 504 Gateway Timeout e non hanno mai raggiunto i nostri servizi backend. La disgregazione è stata causata da un globale Amazon Web Services \(AWS\) CloudFront outage che interessa VPC Origins, il tipo di origine su cui ci affidiamo per il sito web e il portale clienti. Le richieste inoltrate attraverso VPC Origins sono fallite, mentre le distribuzioni CloudFront utilizzando altri tipi di origine non sono state influenzate. AWS ha poi attribuito l'outage a un vincolo di capacità interna nella flotta che gestisce i collegamenti alle origini private VPC, che ha causato la configurazione di routing da distribuire in modo errato ai suoi processori di rete. Importante, i nostri servizi di piattaforma di base — tra cui il caricamento dei file, l'archiviazione, l'elaborazione e la consegna di file già registrati — non sono stati colpiti da questo incidente e hanno continuato a funzionare normalmente durante tutto. Il nostro lavoro di follow-up si concentra sul mantenimento di un fallback collaudato e pronto per questa classe di fallimento AWS CloudFront. # Timeline of events # Tutte le volte sono in UTC il 16 luglio 2026. * **07:55 —** Le metriche CloudFront iniziano a mostrare tassi di errore elevati per le nostre distribuzioni web e webclient. Revisione: Il nostro monitoraggio avvisa che [uploadcare.com](http://uploadcare.com) è irraggiungibile. Il nostro team di ingegneri inizia a indagare immediatamente. * **08:02 —** Confermiamo 504 errori per [uploadcare.com](http://uploadcare.com) e osserviamo che le richieste non stanno raggiungendo il nostro backend. Altre nostre distribuzioni CloudFront rimangono sane. Revisione: Sulla base del modello di errore e della pagina di errore 504 generata da CloudFront, CloudFront diventa la nostra principale causa di root sospetta. A questo punto AWS non aveva ancora pubblicato alcun avviso, anche se la comunità più ampia aveva iniziato a segnalare problemi CloudFront. ##08:28# Confermiamo che il problema riguarda i nostri siti web pubblici e il portale clienti. * **08:42 —** Le metriche CloudFront mostrano un tasso di errore di circa il 30%. * **08:44 —** AWS riconosce un outage globale CloudFront relativo a VPC Origins — circa 49 minuti dopo l'inizio del nostro impatto. Revisione: Iniziamo a implementare un fallback: cambiare le origini influenzate da VPC Origins a Internet-facing Applicazione Bilanciatori di carico \(ALBs\). Revisione: Il fallback viene distribuito nel nostro ambiente di staging per la validazione. * * 11:02 * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * Il fallback passa la convalida sulla messa in scena. Iniziamo a lanciare gli stessi cambiamenti verso la produzione. * 11:15 —** AWS risolve l'outage sottostante. I nostri siti di produzione e portali clienti completamente recuperare e i tassi di errore ritornano a zero. Poiché AWS recuperato prima, la caduta di produzione non è stata richiesta. Dichiariamo l'incidente risolto. # What went well # # Rilevamento e diagnosi. # Il nostro monitoraggio ha rilevato il fallimento in pochi minuti, e il nostro team l'ha correlato con un più ampio problema AWS e ha identificato la probabile causa principale prima che AWS riconoscesse l'esternalizzazione pubblicamente. Una mitigazione convalidata. Durante l'incidente abbiamo progettato, implementato e convalidato un fallback — cambiando le origini CloudFront da VPC Origins a ALB di fronte a Internet — sul nostro ambiente di staging. AWS recuperato prima di dover applicarlo alla produzione, ma questo è ora una mitigazione provata per i futuri incidenti VPC Origins. # Impatto raggiunto. # Poiché il fallimento è stato limitato alle distribuzioni utilizzando VPC Origins, la nostra piattaforma di base — i carichi di file, l'archiviazione, l'elaborazione e la consegna cache — sono rimasti pienamente operativi. # Che cosa e' andato storto # Una dipendenza di origine condivisa. Il nostro sito web pubblico e le distribuzioni del portale clienti si affidano a CloudFront VPC Origins, per cui un singolo fallimento del sottosistema AWS li ha colpiti insieme senza alcun failover. # Action products # ******************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************************* Abbiamo preparato e convalidato le modifiche dell'infrastruttura per passare le distribuzioni colpite da VPC Origins a ALB di fronte a Internet, in modo che questa mitigazione può essere applicata rapidamente se un simile AWS outage recur. Ci scusiamo sinceramente per la rottura di questo incidente causato, e per il ritardo nella comunicazione attraverso la nostra pagina di stato. Mentre la causa principale era un outage lato AWS al di fuori del nostro controllo diretto, ci impegniamo a ridurre la nostra esposizione a questa classe di fallimento e a comunicare più rapidamente e trasparente in futuro.
Tradotto automaticamente dall'aggiornamento ufficiale dell'incidente.