IT Asset Management - APAC Login PageIT Visibility - APAC
investigating
Incident Description: Wir untersuchen derzeit ein Problem, das den Zugang zu Flexera One-Diensten in der APAC-Region betrifft. Die betroffenen Kunden können Schwierigkeiten beim Zugriff auf die Plattform haben oder nach der Authentifizierung auf Fehler stoßen.
Priorität: P1
Wiederherstellungsaktivität: Unsere Techniker wurden beauftragt und untersuchen das Problem aktiv, um die zugrunde liegende Ursache zu identifizieren und den normalen Service so schnell wie möglich wiederherzustellen.
identified
Unsere Untersuchung hat ein Konfigurationsproblem als wahrscheinliche Ursache der Auswirkungen identifiziert. Teams arbeiten aktiv an der Implementierung und Validierung von Korrekturmaßnahmen zur Wiederherstellung des normalen Servicebetriebs. Weitere Aktualisierungen werden im Laufe der Untersuchung bereitgestellt.
identified
Im Laufe der Untersuchung haben unsere Teams Hinweise darauf gefunden, dass das Problem nicht für das IT Asset Management isoliert ist und breitere Auswirkungen auf die Flexera One-Plattform in APAC haben könnte. Abhilfemaßnahmen gegen die identifizierte Ursache sind im Gange, und die Teams konzentrieren sich auf die Wiederherstellung der vollen Servicestabilität. Zusätzliche Updates werden bereitgestellt, sobald mehr Informationen verfügbar sind.
identified
Wir arbeiten weiter an einer Lösung für dieses Problem.
monitoring
Ein Fix wurde implementiert und der Zugriff auf die Flexera One-Plattform wurde wiederhergestellt. Unsere Teams führen zusätzliche Validierungsaktivitäten durch und überwachen weiterhin den Zustand und die Leistung des Dienstes, um die Stabilität zu bestätigen und sicherzustellen, dass alle Dienste voll funktionsfähig bleiben.
resolved
Nach erweiterten Überwachungs- und Verifizierungsaktivitäten haben unsere Teams bestätigt, dass die Dienste stabil bleiben und keine weiteren Auswirkungen beobachtet wurden. Der Vorfall wurde behoben und alle betroffenen Dienste sind voll funktionsfähig.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera One – IT Asset Management – EU – Reconciliation Failures
Beginn 13. August 2026 um 01:08 UTC · 4h 49m
OutageSchwerwiegender Vorfall
Betroffene Komponenten
IT Asset Management - EU Batch Processing System
investigating
Incident Description: We are currently investigating an issue impacting the reconciliation process within the IT Asset Management platform in the EU region. Affected customers may experience failures when attempting to run reconciliation jobs. As a result, reconciliation processes may not complete successfully, potentially delaying data updates and downstream processing.
Priority: P2
Restoration Activity: Our technical teams have been engaged and are actively working to identify the root cause and restore services. Further updates will be provided as we continue working toward resolution.
monitoring
Our teams identified a configuration issue introduced during the completion of a standard release earlier today, which prevented an instance from successfully communicating with the Reconcile service.
The affected instance's configuration process was successfully re-executed, restoring the required settings and re-establishing connectivity with the Reconcile service. Validation testing confirmed normal service operation, and reconciliation processing has resumed successfully. The environment remains under monitoring to ensure continued stability.
monitoring
We are continuing to monitor for any further issues.
resolved
Following extended monitoring, our teams have confirmed that the platform has remained stable and no recurrence of the issue has been observed since the remediation actions were completed. Reconciliation processing continues to operate normally, connectivity with the Reconcile service remains healthy, and all validation checks have been successful.
Based on the sustained stability of the environment and the absence of any further failures, this incident has been resolved
Flexera One - Cloud Cost Optimization (CCO) - NAM - Service Degradation
Beginn 11. August 2026 um 17:26 UTC · 3h 0m
OutageSchwerwiegender Vorfall
Betroffene Komponenten
Cloud Cost Optimization - US
investigating
Incident Description: Wir untersuchen ein Problem mit Cloud Cost Optimization (CCO)-Diensten in der Region Nordamerika (NAM). Es kann vorkommen, dass Seiten nicht geladen werden, das Ladeverhalten verlängert wird oder der Zugriff auf bestimmte Cloud-Kostenoptimierungsfunktionen innerhalb von Flexera One erschwert wird.
Priorität: P2
Restaurierungsaktivität: Unsere technischen Teams untersuchen das Problem aktiv und arbeiten daran, den normalen Service wiederherzustellen. Die derzeitigen Bemühungen konzentrieren sich auf die Identifizierung der Ursache des Abbaus und die Validierung von Korrekturmaßnahmen. Wir werden zusätzliche Updates bereitstellen, sobald weitere Informationen verfügbar sind.
identified
Our investigation has identified the issue affecting certain Cloud Cost Optimization (CCO) functionality in the North America region. Following a recent service migration, some application components were not operating with the expected resource configuration, resulting in certain requests failing to complete and impacted pages remaining in a continuous loading state.
Our technical teams have implemented configuration changes to restore the appropriate resource allocation for the affected services and are currently deploying those changes. We are monitoring recovery and validating service functionality as the update takes effect.
We will provide additional updates as progress continues.
monitoring
The configuration changes have been deployed, and the affected service components are now operating with the intended resource configuration. Our technical teams have observed recovery of the impacted Cloud Cost Optimization (CCO) functionality in the North America region and are performing final validation to confirm service stability.
We will continue to monitor the environment closely and provide a further update once validation activities are complete.
resolved
Following a period of monitoring, services have remained stable and no further issues have been observed.
This incident is now considered resolved.
postmortem
**Description:** Flexera One - Cloud Cost Optimization \(CCO\) - North America - Service Degradation Affecting Certain Functionality
**Timeframe:** August 11, 2026, 9:51 AM PDT – August 11, 2026, 10:45 AM PDT
**Incident Summary**
On August 11, 2026, customers may have experienced issues accessing certain Cloud Cost Optimization \(CCO\) functionality in the North America region. Impacted pages could remain in a continuous loading state and fail to render correctly.
Technical teams began investigating after identifying that certain application requests were not completing successfully. The impact was limited to specific functionality rather than the entire CCO service.
During the investigation, technical teams determined that dependent application services were unable to successfully retrieve required configuration information from a supporting service component, resulting in rendering issues for affected functionality.
Corrective configuration changes were implemented and updated service components were deployed. Following deployment, technical teams validated recovery and continued monitoring the environment to confirm stable operation. All affected functionality subsequently returned to normal operation.
**Root Cause**
During a recent service migration, a supporting application component was deployed with an incorrect resource configuration. As processing demand increased, the affected service components exhausted available resources and became unavailable.
As a result, dependent application services were unable to successfully retrieve required configuration information needed to process certain requests. This resulted in rendering issues affecting specific Cloud Cost Optimization \(CCO\) functionality.
**Remediation Actions**
The following actions were taken during the incident response:
1. Incident Investigation Initiated: Technical teams investigated reports of affected CCO functionality remaining in a continuous loading state and failing to render correctly.
2. Service Dependency Analysis Performed: Technical teams identified that dependent application services were unable to successfully retrieve required configuration information from a supporting service component.
3. Configuration Issue Identified: Investigation determined that a supporting application component had been deployed with an incorrect resource configuration following a recent service migration.
4. Corrective Configuration Changes Applied: Technical teams implemented configuration changes to restore the intended operating parameters for the affected service components.
5. Service Recovery Validation Performed: Updated service components were deployed, affected functionality was validated, and the environment was monitored to confirm stable operation before incident closure.
**Future Preventative Measures**
Following this incident, technical teams reviewed the migration and deployment process associated with the affected service component.
1. Configuration Validation Enhancements: An additional validation step has been added to verify that service configurations are appropriate for forecasted processing requirements following migration activities. This additional review is intended to help identify configuration discrepancies before they can affect production workloads.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera - Ticketing-Service - Degradierte Leistung für E-Mail-Updates
Beginn 7. August 2026 um 04:55 UTC · 7d 0h
IssuesGeringfügiger Vorfall
investigating
Problembeschreibung: Unsere Teams haben festgestellt, dass die E-Mail-Systeme einiger Flexera-Kunden E-Mails ablehnen, die Benachrichtigungen über Updates zu Flexera-Supportfällen enthalten.
Priorität: P3
Wiederherstellungstätigkeit:
Technische Teams untersuchen das Problem aktiv.
In der Zwischenzeit melden Sie sich bitte bei der Flexera Community an und nutzen Sie das Support Case Portal unter https://community.flexera.com/s/case/Case/Default, um den Fallstatus zu überprüfen und nach Updates zu suchen.
identified
Our teams have identified the cause of the issue and are currently working to resolve it.
identified
Our teams continue to work toward a resolution. During the ongoing investigation, we identified that in some instances emails from Flexera may be being blocked by SharePoint. Addressing this issue requires additional investigation and coordination with the relevant parties to ensure the appropriate corrective actions are taken. We will continue to provide updates as more information becomes available.
identified
Our teams continue working toward a resolution. Additional investigation and coordination with the appropriate teams are underway to restore normal email flow. We will provide further updates as more information becomes available.
monitoring
Our teams have implemented corrective measures and are observing positive results. Initial validation testing has been successful, indicating that the mitigation actions are effective. We will continue to closely monitor the service to ensure ongoing stability and will provide further updates as they become available.
resolved
After extended monitoring, our teams have confirmed that all email updates are being delivered successfully. This incident has been declared as resolved.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera One - IT Asset Management - APAC - Datenladefehler / Langsamkeit
Beginn 5. August 2026 um 08:28 UTC · 0m
OutageSchwerwiegender Vorfall
Betroffene Komponenten
IT Asset Management - APAC Inventory UploadIT Asset Management - APAC Batch Processing System
resolved
Vorfallbeschreibung: Unsere Teams identifizierten eine Serviceunterbrechung, die eine Teilmenge von Flexera One IT Asset Management (ITAM)-Kunden in der APAC-Produktionsumgebung vom 4. August 2026, 04:04 Uhr PDT bis 04:25 Uhr PDT betraf. Während des betroffenen Zeitraums erlebte eine Teilmenge unserer Kunden intermittierende Langsamkeit, mangelnde Reaktionsfähigkeit des Dienstes oder Datenladefehler innerhalb der Plattform.
Priorität: P2
Wiederherstellungsaktivität: Unsere technischen Teams untersuchten das Problem und stellten fest, dass während des betroffenen Zeitraums eine unerwartete Erschöpfung der Datenbankressourcen auftrat. Der Zustand wurde anschließend selbst korrigiert, so dass sich die betroffenen Dienste erholen und zum normalen Betrieb zurückkehren können. Die Validierung nach dem Vorfall bestätigte, dass der Plattformbetrieb wie erwartet abläuft. Wir führen eine detaillierte Überprüfung des Vorfalls durch und bewerten zusätzliche Sicherheitsvorkehrungen, Kapazitätskontrollen und Überwachungsverbesserungen, um die Wahrscheinlichkeit ähnlicher Ereignisse in der Zukunft weiter zu verringern.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera One- IT Asset Management - EU - Inventar Upload und Beacon Kommunikationsprobleme
Beginn 3. August 2026 um 06:56 UTC · 1d 4h
OutageSchwerwiegender Vorfall
Betroffene Komponenten
IT Asset Management - EU Beacon CommunicationIT Asset Management - EU Inventory Upload
investigating
Incident Description: Wir untersuchen derzeit ein Problem mit Uploads von Inventarpaketen (*.zip) in der Region Europa für Flexera One IT Asset Management. Kunden, die versuchen, bestimmte Inventarpakete hochzuladen, können auf Fehler stoßen, die zu fehlgeschlagenen Inventar-Uploads und Verzögerungen bei der Verarbeitung von Inventardaten führen.
Priorität: P2
Restaurierungsaktivität: Unser technisches Team untersucht das Problem aktiv und überprüft die aktuellen Verarbeitungsaktivitäten, um Umfang und Fortschritt zu bestätigen. Wir beobachten die Situation genau und werden Updates bereitstellen, sobald mehr Informationen verfügbar werden.
investigating
Unsere Teams untersuchen das Problem weiterhin aktiv und führen eine detaillierte Überprüfung der Systemprotokolle und Diagnosen durch, um die zugrunde liegende Ursache weiter zu identifizieren und zu bestätigen. Wir werden zusätzliche Updates bereitstellen, sobald weitere Informationen verfügbar sind.
investigating
Während der laufenden Untersuchung stellten unsere Teams fest, dass das Problem auch die Kommunikation mit der Flexera One EU Production-Umgebung beeinflussen könnte. Infolgedessen können zusätzliche Operationen, die auf der Beacon-to-Plattform-Kommunikation beruhen, betroffen sein. Das Team untersucht weiterhin die zugrunde liegende Ursache, bewertet den vollen Umfang der Auswirkungen und arbeitet daran, eine Lösung so schnell wie möglich umzusetzen.
monitoring
Unsere Teams haben eine kürzliche Konfigurationsänderung als wahrscheinliche Ursache des Problems identifiziert. Die Konfiguration wurde seitdem zurückgenommen, und wir beobachten die Wiederherstellung des Dienstes in den betroffenen Komponenten, wobei die Plattformfunktionalität allmählich auf das erwartete Niveau zurückkehrt. Die Teams sind weiterhin aktiv an der Überwachung der Umgebung beteiligt, um die vollständige Wiederherstellung zu validieren, die Stabilität der Plattform zu gewährleisten und etwaige Restauswirkungen schnell zu beheben.
monitoring
Wir werden weiterhin auf weitere Probleme achten.
monitoring
Mitigation-Maßnahmen bleiben wirksam, und die Bestandsbearbeitung wird erfolgreich fortgesetzt. Wir überwachen aktiv den Wiederherstellungsfortschritt und arbeiten den verbleibenden Rückstand durch, um sicherzustellen, dass die gesamte Verarbeitung erfolgreich abgeschlossen wird. Wir werden weiterhin Updates bereitstellen, wenn die Wiederherstellungsbemühungen voranschreiten.
monitoring
Die Servicewiederherstellung bleibt auf Kurs, wobei die Minderungsmaßnahmen weiterhin wirksam sind. Die Bestandsaufbereitung funktioniert erfolgreich, und der Rückstand wurde erheblich reduziert, wodurch sich die Volumina dem normalen Niveau annähern. Unsere Teams überwachen weiterhin die Umwelt und verarbeiten den verbleibenden Rückstand, um die Wiederherstellung abzuschließen. Gegebenenfalls werden weitere Aktualisierungen bereitgestellt.
resolved
Die Umwelt ist auf ein normales Betriebsniveau zurückgekehrt. Inventarverarbeitung und Beacon-Kommunikation sind stabil und der Backlog hat die erwarteten Schwellenwerte erreicht.
Die Plattform bleibt gesund, wobei die kontinuierliche Überwachung eine nachhaltige Stabilität bestätigt. Weitere Details zu den Ursachen, restaurativen Maßnahmen und langfristigen Verbesserungsinitiativen werden nach der Validierung der Ergebnisse in einem Post-Mortem-Bericht vorgestellt.
postmortem
**Beschreibung:** Flexera One- IT Asset Management - EU - Inventar-Uploadfehler
**Zeitrahmen:** 31. Juli 2026, 18:00 Uhr PDT bis 4. August 2026, 4:09 Uhr PDT
**Incident Summary**
Am Sonntag, den 2. August 2026, um 23:42 Uhr PDT, identifizierte Flexera ein Problem, das Inventarpaket-Uploads und ausgewählte Beacon-Kommunikation innerhalb der Flexera One IT Asset Management EU-Produktionsumgebung betrifft. Betroffene Kunden erlebten fehlgeschlagene Inventarpaket-Uploads, einschließlich HTTP 504 (Gateway Timeout) und HTTP 405 (Methode nicht erlaubt). Das Problem störte auch die ausgewählte Beacon-to-Plattform-Kommunikation, was zu Verzögerungen oder Ausfällen bei der Bestandsverarbeitung und der Aufnahme von Bestandsdaten führte.
Die Untersuchung ergab, dass der früheste Einschlag am 31. Juli 2026 um 18:00 Uhr PDT begann. Die Analyse identifizierte ein Kommunikationsproblem innerhalb eines kritischen Dienst-Routing-Pfades, das verhinderte, dass eine Teilmenge von Anforderungen erfolgreich nachgelagerte Verarbeitungsdienste erreichte. Dies führte zu wiederholten Wiederholungen, verzögerter Bestandsverarbeitung und Backlog-Akkumulation.
Um das Problem zu mildern und den Dienst wiederherzustellen, wurde der Datenverkehr auf einen alternativen Kommunikationspfad umgeleitet. Nach dieser Änderung stabilisierte sich die Beacon-Kommunikation, Inventar-Uploads nahmen die Verarbeitung erfolgreich wieder auf und der Inventar-Backlog begann zu sinken. Bis 3:42 Uhr PDT am 3. August 2026 wurden Inventar-Uploads erfolgreich abgeschlossen und es wurden keine neuen Fehler beobachtet.
Die Umgebung blieb unter erweiterter Überwachung, während die Verarbeitungsmengen auf ein normales Betriebsniveau zurückkehrten. Um 4:09 Uhr PDT am 4. August 2026 bestätigte Flexera, dass die Beacon-Kommunikation, die Bestandsverarbeitung und die damit verbundenen Plattformdienste normal funktionieren, der Rückstand auf die erwarteten Schwellenwerte zurückgekehrt ist und der Vorfall offiziell für behoben erklärt wurde.
**Wurzelursache**
Am 31. Juli 2026 führte ein Zertifikatsupdate auf einen kritischen Dienstkommunikationspfad zu einer Konfigurationsfehlanpassung zwischen Plattformkomponenten. Das Problem tauchte später auf, als Anwendungskomponenten neu gestartet wurden und mit der Einrichtung neuer Verbindungen unter Verwendung der aktualisierten Konfiguration begannen. Dies führte zu Handshake-Fehlern und Kommunikationsfehlern, was zu einer Nichtverfügbarkeit des Dienstes führte. Folglich konnten Anfragen von Kunden-Beacons, Inventarpaket-Dateien in die EU-Produktionsumgebung hochzuladen, nicht verarbeitet werden, was zu Upload-Ausfällen führte und den Empfang und die Verarbeitung von Inventardaten verhinderte. Eine Teilmenge anderer Beacon-zu-Plattform-Interaktionen war ebenfalls betroffen, obwohl die Auswirkungen der Kunden nicht sofort beobachtet wurden.
Der Dienst wurde wiederhergestellt, indem der Datenverkehr auf einen alternativen Kommunikationspfad umgeleitet wurde, der nicht von dem zertifikatsbezogenen Konfigurationsproblem betroffen war. Inventar-Uploads und Beacon-Kommunikation haben dann den normalen Betrieb wieder aufgenommen.
Beitragende Faktoren
Intermittierende Anforderungsfehler: Fehlgeschlagene Verbindungsaufbauversuche führten dazu, dass ein Teil der Anforderungen vor dem Erreichen der nachgelagerten Verarbeitungsdienste erfolglos war.
Inventarverarbeitungsverzögerungen: Kommunikationsfehler verhinderten, dass einige Inventarpakete und zugehörige Importe erfolgreich verarbeitet wurden, was zu verzögerten Bestandsaktualisierungen führte.
* Retry-Driven Backlog Growth: Automatisierte Retry-Mechanismen ermöglichten es vielen Transaktionen, erfolgreich zu sein, trugen jedoch zu erhöhten Verarbeitungsverzögerungen und Backlog-Akkumulation bei, während das Problem aktiv blieb.
**Abhilfemaßnahmen**
Um den Service wiederherzustellen, führten die technischen Teams folgende Aktionen aus:
* Traffic Re-Routing: Umgeleiteter Traffic vom betroffenen Servicepfad, um stabile Beacon-Kommunikation und Inventarpaket-Uploads wiederherzustellen.
* Plattformüberwachung: Kontinuierliche Überwachung von Beacon-Kommunikation, Inventar-Uploads und Verarbeitungsaktivitäten zur Überprüfung der Servicewiederherstellung.
* Backlog Recovery Management: Überwachter Bestandsverarbeitungsdurchsatz und Validierung, dass die Verarbeitungsrückstände stetig reduziert und zu den erwarteten Betriebsschwellen zurückgekehrt sind.
* Stabilitätsvalidierung: Durchgeführte erweiterte Überwachung nach der Wiederherstellung, um eine nachhaltige Plattformstabilität und eine erfolgreiche Bestandsbearbeitung zu bestätigen.
* Service-Wiederherstellungsbestätigung: Um 4:09 Uhr PDT am 4. August 2026 bestätigte, dass die Beacon-Kommunikation, die Bestandsverarbeitung und die damit verbundenen Dienste normal funktionieren.
** Künftige Präventivmaßnahmen**
Service Communication Resilience: Überprüfen und verbessern Sie den betroffenen Kommunikationspfad, um die Zuverlässigkeit, Resilienz und Wiederherstellung von zukünftigen konnektivitätsbedingten Störungen zu verbessern.
Verstärkte Änderungsvalidierung: Verbesserung der Validierungs- und Testprozesse für Infrastruktur-, Konfigurations-, Zertifikats- und Servicepfadänderungen, um Kommunikationsfehlanpassungen vor der Bereitstellung in Produktionsumgebungen zu identifizieren.
Verbesserte Erkennung und Alarmierung: Verbesserte Überwachungs- und Alarmierungsfunktionen, um anhaltende Kommunikationsstörungen, erhöhte Wiederholaktivität, abnormale Fehlerratenmuster und entstehende Verarbeitungsrückstände früher zu identifizieren. Diese Verbesserungen ermöglichen eine schnellere Erkennung, Untersuchung und Behebung von Problemen, bevor sie sich zu einer breiteren Kundenwirkung entwickeln.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Software Vulnerability Research (SVR) - Service Disruption
Beginn 29. Juli 2026 um 04:36 UTC · 5h 17m
OutageKritischer Vorfall
Betroffene Komponenten
Software Vulnerability Research
investigating
Incident Description: Wir untersuchen ein Problem, das den Dienst Software Vulnerability Research (SVR) betrifft. Kunden können derzeit Schwierigkeiten beim Zugriff auf oder bei der Nutzung von SVR haben.
Priorität: P1
Restaurierungsaktivität: Unsere Teams untersuchen das Problem aktiv und arbeiten daran, den Service wiederherzustellen. Mitigation-Aktivitäten sind derzeit im Gange, da wir daran arbeiten, den Service wieder online zu bringen. Weitere Updates werden bereitgestellt, sobald mehr Informationen verfügbar werden.
investigating
Recovery-Maßnahmen wurden implementiert, der Service ist jedoch unter aktuellen Workload-Bedingungen weiterhin instabil, was zu anhaltenden Service-Störungen führt. Unsere Teams arbeiten aktiv daran, die Auswirkungen zu reduzieren und die Verfügbarkeit des Dienstes wiederherzustellen. Weitere Updates werden bereitgestellt, sobald mehr Informationen verfügbar werden.
resolved
Technische Teams haben die Serviceverfügbarkeit für Software Vulnerability Research (SVR) wiederhergestellt. Wiederherstellungsmaßnahmen wurden implementiert, um die Instabilität des Dienstes zu beheben, und die Validierung hat bestätigt, dass die SVR-Funktionalität wiederhergestellt wurde. Wir werden den Service weiterhin genau beobachten, um eine anhaltende Stabilität zu gewährleisten.
Ein Post-Mortem-Bericht mit zusätzlichen Details, einschließlich der Ursache und der vorbeugenden Maßnahmen, wird in den kommenden Tagen veröffentlicht.
postmortem
**Description:** Software Vulnerability Research \(SVR\) - Service Disruption
**Timeframe:** July 28, 2026, 2:00 PM PDT to July 29, 2026, 2:53 AM PDT
**Incident Summary**
On Tuesday, 28 July 2026, at 2:00 PM PDT, the Flexera Software Vulnerability Research\(SVR\) production environment experienced a service disruption that affected API availability and application functionality. The incident occurred when the primary database instance supporting the SVR platform became unavailable. Existing database connections were unexpectedly terminated, and application servers were unable to establish new connections. As a result, customers were unable to reliably access SVR services and APIs during the incident.
During the investigation, our teams determined that the disruption was caused by an unplanned failover initiated by the cloud service provider. According to the provider’s event history, an infrastructure issue was detected on the primary database host, prompting the provider to automatically initiate the failover process.
Our technical teams immediately engaged the cloud service provider to investigate the incident and restore service. Following recovery and validation activities, all production services were successfully restored and returned to normal operation by 2:53 AM PDT on 29 July 2026.
**Root Cause**
The incident was triggered by an unplanned failover of the production database, initiated by the cloud service provider in response to an infrastructure-level issue affecting the primary database host.
During the failover, the primary database instance became temporarily unavailable. This caused active database connections to terminate abruptly, preventing application services from establishing new connections. As a result, API requests failed and service availability across the SVR platform was impacted.
Flexera has formally requested a detailed Root Cause Analysis \(RCA\) from the cloud service provider to determine the precise infrastructure condition that triggered the failover and to identify opportunities to prevent recurrence.
**Contributing Factors**
During the investigation, the following factors were identified as potentially contributing to the overall impact of the incident:
* A significantly elevated volume of client connection attempts was observed originating from customer environments during the incident period.
* Connection volumes exceeded normal operating levels, increasing load on backend services while database services were recovering.
* Elevated connection activity may have amplified the impact of the database failover and increased recovery complexity.
* Existing application retry and connection behaviours generated additional connection demand during database recovery activities.
**Remediation Actions**
* Cloud provider engagement: Our teams immediately engaged the cloud service provider and worked directly with their on-call engineers throughout the recovery effort.
* Database recovery: Executed a controlled database failover/reboot in coordination with the cloud service provider.
* Restored connectivity: Re-established database availability and connectivity to the production environment.
* Application recovery validation: Confirmed that application services successfully reconnected to backend database services.
* Service validation: Verified recovery of APIs and critical SVR application functionality.
* Post-recovery monitoring: Implemented enhanced monitoring of database health, application performance, and connection activity following restoration.
**Future Preventative Measures**
* Continue monitoring customer connection volumes and backend database connection utilisation.
* Review and optimise database connection pooling, connection management, retry logic, and failover handling to improve resilience during future infrastructure events.
* Complete the cloud service provider support engagement and review the provider's detailed Root Cause Analysis once available.
* Conduct an internal post-incident review and implement additional preventive measures identified through the review process.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Incident Description: Wir untersuchen ein intermittierendes Problem, das Flexera One-Dienste in der APAC-Region betrifft. Kunden können bei der Verwendung von Flexera One-Anwendungen und -Diensten intermittierende Zugriffsprobleme oder -fehler auftreten. Das Problem scheint derzeit auf die APAC-Region beschränkt zu sein.
Priorität: P2
Restaurierungsaktivität: Unsere Teams untersuchen das Problem aktiv. Der Umfang und die Auswirkungen werden in den Flexera One-Diensten in der APAC-Region bewertet, und wir arbeiten daran, die zugrunde liegende Ursache zu identifizieren und die Servicestabilität wiederherzustellen. Weitere Updates werden bereitgestellt, sobald mehr Informationen verfügbar werden.
investigating
Unsere technischen Teams untersuchen das Problem aktiv. Das Problem scheint intermittierend zu sein, wobei einige Anfragen erfolgreich sind, während andere weiterhin scheitern. Wir überprüfen die betroffenen Dienste und ihre Abhängigkeiten, um den Umfang der Auswirkungen zu bestimmen, die zugrunde liegende Ursache zu identifizieren und die Servicestabilität wiederherzustellen.
resolved
Technische Teams haben das Problem der Flexera One-Dienste in der APAC-Region gemildert. Die Servicefunktionalität wurde wiederhergestellt und die Validierung bestätigt, dass die betroffenen Anwendungen und Dienste wie erwartet funktionieren.
Während der Untersuchung identifizierten die Teams intermittierende Kommunikationsprobleme, die für einige Kunden zu Zugriffsproblemen und Fehlern führten. Im Rahmen der Minderungsmaßnahmen starteten die technischen Teams die betroffenen Dienste neu, woraufhin die Dienstfunktionalität wiederhergestellt und die Validierung die erfolgreiche Wiederherstellung der betroffenen Dienste bestätigte. Wir werden den Vorfall weiterhin überprüfen und den Zustand des Dienstes überwachen.
postmortem
**Description:** Flexera One - APAC - Intermittent Service Disruption
## Timeframe
**Timeframe:** July 28, 2026, 3:16 PM PDT - July 28, 2026, 5:39 PM PDT
## Incident Summary
On Tuesday, July 28, 2026, at 3:49 PM PDT, customers using Flexera One services in the APAC region began experiencing intermittent service disruptions affecting multiple applications and platform capabilities. Customers may have encountered login issues, application errors, failed page loads, API errors, and intermittent access to certain Flexera One functionality.
During the incident, multiple services experienced intermittent communication failures with shared platform services. As a result, customers experienced inconsistent application behavior, with some requests succeeding while others failed.
Technical teams investigated the issue across affected applications and platform components to determine the scope and source of the failures. The investigation identified a connectivity issue affecting communication between application services and a shared platform dependency. Corrective configuration changes were implemented to restore service communication and stabilize affected functionality.
Following implementation of the corrective changes, technical teams validated functionality across impacted applications and confirmed that services had returned to normal operation. Continued monitoring showed stable service behavior, and the incident was resolved at 5:40 PM PDT on July 28, 2026.
## Root Cause
Investigation determined that the incident was caused by a connectivity issue introduced during a platform infrastructure migration.
Following the migration, certain application services continued using legacy connection ports when communicating with shared platform services. When affected services restarted, they attempted to communicate using endpoint and port combinations that were no longer aligned with the updated platform configuration.
This configuration mismatch resulted in intermittent communication failures between application services and shared platform components, causing customer-facing application errors and service disruptions across multiple Flexera One services in the APAC region.
## Remediation Actions
The following actions were taken during the incident response:
1. **Incident Investigation Initiated:** Technical teams investigated reports of intermittent failures affecting multiple Flexera One services in the APAC region and assessed the scope of customer impact.
2. **Dependency Analysis Performed:** Technical teams reviewed communication paths between impacted applications and shared platform services to identify the source of the connectivity failures.
3. **Configuration Mismatch Identified:** Investigation determined that certain services were attempting to communicate through legacy ports that were not aligned with the updated platform configuration following the migration.
4. **Platform Configuration Updated:** The required ports were added to the updated platform configuration, restoring connectivity for the affected services.
5. **Service Recovery Validation:** Technical teams validated functionality across impacted applications and confirmed that service communication and customer-facing functionality had returned to normal operation.
## Future Preventative Measures
The following improvements have been identified to further reduce the risk of similar incidents in the future:
1. **Platform Configuration Alignment:** Platform connectivity configurations were updated to ensure application services can communicate with shared platform components using the required connection ports. Maintaining alignment between service connectivity requirements and platform configurations helps reduce the risk of similar connectivity issues following future infrastructure changes.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Snow Atlas - APAC - Anmeldefehler und 404 Fehler
Beginn 27. Juli 2026 um 00:11 UTC · 1h 49m
OutageKritischer Vorfall
Betroffene Komponenten
Snow Atlas - AustraliaSnow Atlas API - Australia
investigating
Incident Description: Wir untersuchen ein Problem, das Snow Atlas-Kunden in der APAC-Region betrifft. Betroffene Benutzer können möglicherweise nicht auf die Plattform zugreifen und beim Anmeldeversuch auf 404-Fehler stoßen. Die aktuelle Untersuchung zeigt, dass das Problem auf die APAC-Region beschränkt ist, wobei derzeit keine Auswirkungen in anderen Regionen bestätigt werden.
Priorität: P1
Wiederherstellungsaktivität: Unsere technischen Teams untersuchen das Problem aktiv, um die zugrunde liegende Ursache zu identifizieren und den Service wiederherzustellen. Wir beobachten die Umwelt genau und führen gegebenenfalls Korrekturmaßnahmen durch. Weitere Updates werden bereitgestellt, sobald mehr Informationen verfügbar werden.
investigating
Unsere Teams haben das Problem behoben, das Snow Atlas-Kunden in der APAC-Region betrifft.
Das Problem trat auf, wenn ein Plattformdienst nicht korrekt gestartet wurde, was zu intermittierenden Fehlern und Zugriffsproblemen für einige Kunden führte. Technische Teams identifizierten den zugrunde liegenden Startfehler und stellten den Dienst durch Neustart der betroffenen Plattformkomponenten wieder her.
Validierungsaktivitäten haben den erfolgreichen Zugang zur Plattform bestätigt, und wir beobachten derzeit keine anhaltenden Auswirkungen auf die Kunden.
Unsere Teams werden die Umwelt weiterhin genau beobachten, um weiterhin Stabilität zu gewährleisten.
resolved
Dieser Vorfall wurde behoben.
postmortem
**Description:** Snow Atlas - APAC - Login Failures and 404 Errors
**Timeframe:** July 26, 2026, 5:00 PM PDT to July 26, 2026, 6:15 PM PDT
**Incident Summary**
On Sunday, 26 July 2026, Flexera experienced a service disruption affecting Snow Atlas customers in the APAC Production environment, resulting in login failures and temporary inability to access Agreement pages. The issue was isolated to the APAc region, with no impact to other production regions.
Investigation by our technical teams determined that the disruption was caused by a backend service communication issue that prevented Agreement data from being retrieved successfully. The condition was consistent with a runtime synchronization issue following recent platform infrastructure maintenance.
Flexera teams validated platform health, restored the affected services, and confirmed successful recovery. Customer access was fully restored, and post-recovery monitoring confirmed stable operations with no recurrence of the underlying service communication errors.
A detailed post-incident review was completed, and corrective measures have been implemented to further strengthen platform resilience and recovery processes.
**Root Cause**
The incident was caused by an application communication failure within the APAC Production environment. A component responsible for processing requests between internal application services did not successfully handle Agreement-related requests, preventing those requests from being completed and resulting in customer-facing 404 errors and failures accessing Agreement pages.
**Contributing Factors**
* The application communication failure occurred following a recent infrastructure upgrade to the APAC Production environment.
* Although the application services and underlying infrastructure remained healthy, an internal service responsible for processing Agreement requests did not fully recover after the upgrade.
* Existing health checks validated application and infrastructure availability but did not verify the successful initialization of the internal communication path following the upgrade.
* The issue was therefore not detected until customers began experiencing login failures and HTTP 404 errors when accessing Agreement pages.
**Remediation Actions**
To restore service, technical teams:
* Confirmed the underlying infrastructure remained healthy throughout the incident.
* Identified the failed internal service communication affecting Agreement requests.
* Restarted the affected application services.
* Validated successful recovery across impacted tenants.
* Continued monitoring to confirm service stability.
**Future Preventative Measures**
* Enhanced Post-Upgrade Validation: Introduce additional validation checks following infrastructure upgrades to verify that critical application components and internal service communications are functioning as expected.
* Improved Monitoring and Alerting: Enhance monitoring and alerting to detect internal service communication failures and responder registration issues more quickly.
* Synthetic Health Checks: Implement synthetic health checks that validate critical customer workflows, including Agreement page functionality, following infrastructure changes.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera One- IT Sichtbarkeit- EU - Berichte nicht laden
Beginn 22. Juli 2026 um 10:33 UTC · 21h 18m
OutageSchwerwiegender Vorfall
Betroffene Komponenten
IT Visibility EU
investigating
Incident Description: Wir untersuchen ein Problem mit Auswirkungen auf die IT-Sichtbarkeit in der Region Europa, in der mehrere Power BI-Berichte nicht geladen werden. Kunden in der betroffenen Region können möglicherweise keine betroffenen Berichte innerhalb der Anwendung anzeigen. Die aktuelle Untersuchung zeigt, dass das Problem auf die Region Europa beschränkt ist, ohne dass derzeit in anderen Regionen Auswirkungen beobachtet werden.
Priorität: P2
Wiederherstellungsaktivität: Unsere technischen Teams untersuchen das Problem aktiv, um die zugrunde liegende Ursache zu identifizieren und die Berichtsfunktionalität wiederherzustellen. Wir bewerten weiterhin den Umfang der Auswirkungen, überwachen den Zustand des Dienstes und setzen gegebenenfalls Korrekturmaßnahmen um. Wir werden weitere Updates bereitstellen, sobald weitere Informationen verfügbar sind.
identified
Unsere Untersuchung hat ein mögliches Konfigurationsproblem in der betroffenen Umgebung identifiziert. Im Rahmen unserer Validierungsbemühungen wurden Korrekturmaßnahmen für eine Teilmenge der betroffenen Organisationen ergriffen, und Berichte werden nun erfolgreich geladen.
Unsere Teams konzentrieren sich derzeit auf die Implementierung einer umfassenderen Sanierung in allen betroffenen Organisationen und führen eine detaillierte Überprüfung durch, um zu verstehen, warum sich die Konfigurationsänderungen nicht wie erwartet verbreitet haben. Wir validieren die Sanierung weiterhin und überwachen die Serviceleistung genau, während wir auf eine vollständige Auflösung hinarbeiten.
identified
Korrekturmaßnahmen wurden nun auf eine größere Anzahl betroffener Organisationen angewendet, und die erste Validierung zeigt, dass Berichte erfolgreich geladen werden.
Wir validieren derzeit alle betroffenen Organisationen, um zu bestätigen, dass die Berichtsfunktionalität und die Serviceleistung vollständig wiederhergestellt wurden. Parallel dazu setzen die Teams weiterhin umfassendere Sanierungsmaßnahmen in der gesamten Umwelt um und überwachen den Service genau, um Stabilität zu gewährleisten, während die Arbeit an einer vollständigen Auflösung fortgesetzt wird.
identified
Unsere Teams haben den Fix auf alle identifizierten Organisationen angewendet. Erste Validierung zeigt an, dass sich die betroffenen Organisationen wie erwartet erholen.
Technische Teams validieren weiterhin die Wirksamkeit der Sanierung in der gesamten europäischen Region, um zu bestätigen, dass der Service vollständig wiederhergestellt wurde. Wir beobachten die Plattformleistung genau und werden ein weiteres Update bereitstellen, sobald die regionale Validierung abgeschlossen ist.
resolved
Weitere Untersuchungen identifizierten ein Synchronisationsproblem als die zugrunde liegende Ursache des Vorfalls. Unsere technischen Teams implementierten gezielte Sanierungsmaßnahmen, einschließlich Service-Neustarts, um den normalen Betrieb wiederherzustellen. Nach einer erweiterten Überwachung und Validierung nach der Mängelbeseitigung ist die Serviceleistung stabil geblieben, und wir haben bestätigt, dass alle betroffenen Dienste in den Normalbetrieb zurückgekehrt sind. Das Problem gilt nun als gelöst.
postmortem
**Beschreibung:** Flexera One – IT Visibility – EU – Failure to Load Reports
**Zeitrahmen:** 22. Juli 2026, 3:11 Uhr PDT – 22. Juli 2026, 11:04 Uhr PDT
**Incident Summary**
Am 22. Juli 2026, um etwa 3:11 Uhr PDT, begann ein Problem mit der Berichtsfunktionalität von IT Visibility in der Flexera One EU-Produktionsumgebung. Während des betroffenen Zeitraums erlebten Kunden in der EU-Region Ausfälle beim Versuch, IT-Sichtbarkeitsberichte und Dashboards wie Software-Inventar, Hardware-Inventar, Technology Intelligence \(TI\), Nachhaltigkeit und FinOps-Berichtsansichten zu laden.
Die technischen Teams begannen mit der Untersuchung, nachdem mehrere Kundenberichte über Ladefehler in der gesamten EU-Region eingegangen waren. Die erste Analyse bestätigte, dass das Problem auf die EU-Produktionsumgebung beschränkt war, während gleichwertige Berichtsfunktionen in anderen Regionen weiterhin normal funktionierten.
Die Untersuchung ergab, dass ein Authentifizierungsproblem innerhalb der EU-Berichtsumgebung aufgetreten war. Infolgedessen konnten betroffene Berichte und Dashboards die zum erfolgreichen Laden erforderlichen Daten nicht abrufen, was zu Ladefehlern bei betroffenen Kunden führte.
Die technischen Teams implementierten Korrekturaktualisierungen innerhalb der betroffenen Berichtsumgebung und führten Validierungsaktivitäten in den betroffenen Kundenorganisationen durch. Nach diesen Aktionen nahmen Berichte und Dashboards den normalen Betrieb wieder auf und die Kunden konnten wieder erfolgreich auf Berichtsdaten zugreifen.
Nach der Validierung der betroffenen Kundenumgebungen und der Bestätigung, dass Berichte erfolgreich geladen wurden, wurde die Servicefunktionalität wiederhergestellt und der Vorfall als behoben betrachtet. Die technischen Teams überwachten nach der Restaurierung weiter, um eine anhaltende Servicestabilität zu gewährleisten.
**Wurzelursache**
Der Vorfall wurde durch ein Authentifizierungsproblem innerhalb der EU-Berichtsumgebung verursacht. Dieses Problem verhinderte, dass betroffene Berichte und Dashboards die für die Anzeige der Ergebnisse erforderlichen Daten erfolgreich abrufen konnten, was zu Ladefehlern bei den betroffenen Kunden führte.
**Abhilfemaßnahmen**
Während der Incident Response wurden folgende Maßnahmen ergriffen:
1. Regionale Folgenabschätzung: Technische Teams untersuchten Kundenberichte und bestätigten, dass das Problem in der EU-Produktionsumgebung isoliert war. Zusätzliche Validierungen wurden in anderen Regionen durchgeführt, um zu überprüfen, ob die Berichtsfunktionalität außerhalb der betroffenen Umgebung funktionsfähig bleibt.
2. Authentifizierungsfehleranalyse: Technische Teams haben die Berichtsverarbeitung, die Authentifizierungsworkflows, die Berichtsarbeitsbereiche und die jüngsten Plattformänderungen überprüft, um die Quelle der Fehler zu identifizieren. Die Untersuchung ergab, dass die betroffenen Berichte nicht erfolgreich authentifiziert werden konnten, wenn die zugrunde liegenden Daten für die Darstellung von Berichten abgerufen wurden.
3. Restaurierungs- und Validierungsaktivitäten: Technische Teams haben Aktualisierungen in betroffenen Kundenumgebungen und Berichtsarbeitsbereichen durchgeführt, um den erfolgreichen Datenabruf von Berichten wiederherzustellen. Nach der Implementierung wurden betroffene Kundenorganisationen validiert, um zu bestätigen, dass Berichte und Dashboards erfolgreich geladen wurden und die Daten wie erwartet angezeigt wurden.
4. Überprüfung nach der Wiederherstellung: Im Anschluss an die Wiederherstellung wurden zusätzliche Überwachungs- und Validierungstätigkeiten durchgeführt, um die fortlaufende Berichtsfunktionalität zu überprüfen, eine erfolgreiche Wiederherstellung zu bestätigen und die Servicestabilität in der gesamten EU-Produktionsumgebung zu gewährleisten.
** Künftige Präventivmaßnahmen**
Folgende Folgemaßnahmen wurden während des Vorfalls identifiziert:
Überprüfung des Authentifizierungsaktualisierungsprozesses: Technische Teams überprüfen den Authentifizierungsaktualisierungsprozess, um zu verstehen, warum das Update nicht erfolgreich in allen betroffenen Berichtsarbeitsbereichen in der EU-Produktionsumgebung angewendet wurde, und um Verbesserungen zu identifizieren, die dazu beitragen, ähnliche Probleme bei zukünftigen Updates zu vermeiden.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera One- IT Asset Management- US - Degradierte Performance
Beginn 22. Juli 2026 um 08:25 UTC · 7h 51m
OutageSchwerwiegender Vorfall
Betroffene Komponenten
IT Asset Management - US Inventory Upload
identified
Vorfallbeschreibung: Wir haben ein Problem identifiziert, das sich auf die Bestandsverarbeitung in Flexera One IT Asset Management auswirkt, nachdem das Release 2026 R1.1 in unserer US-Produktionsumgebung bereitgestellt wurde. Infolgedessen können bei einigen Kunden beim Zugriff auf bestimmte Bereiche der Benutzeroberfläche und bei der Ausführung systembezogener Aufgaben Leistungseinbußen und intermittierende Zuverlässigkeitsprobleme auftreten.
Priorität: P2
Wiederherstellungsaktivität: Unsere Untersuchung hat ergeben, dass das Problem mit einem Softwarefehler zusammenhängt, der mit dem Release 2026 R1.1 eingeführt wurde.
Während der Defekt zuvor identifiziert und Minderungsverfahren in den Bereitstellungsprozess integriert wurden, stieß die automatisierte Behebung auf unerwartete Ausführungsprobleme. Infolgedessen haben technische Teams alternative Minderungsmaßnahmen implementiert, um die Auswirkungen der Kunden zu reduzieren und die Systemleistung zu stabilisieren.
Wir überwachen weiterhin aktiv die Umgebung und ergreifen Korrekturmaßnahmen, um den zugrunde liegenden Defekt zu beheben und den normalen Servicebetrieb wiederherzustellen.
identified
Unsere Teams arbeiten weiterhin daran, einen Hotfix zu implementieren, um das Problem anzugehen. Während der Bereitstellung stieß der Hotfix auf Datenbankbedingungen, die ihn am erfolgreichen Abschluss hindern.
Unsere technischen Teams arbeiten aktiv daran, dies zu beheben und evaluieren gezielte Minderungsmaßnahmen, damit der Hotfix abgeschlossen werden kann. Sobald der Hotfix erfolgreich angewendet wurde, validieren die Teams die Serviceleistung und überwachen die Wiederherstellung weiter.
Wir werden ein weiteres Update bereitstellen, sobald mehr Informationen verfügbar sind.
monitoring
Der Hotfix wurde erfolgreich eingesetzt, und die Ingenieurteams validieren derzeit seine Wirksamkeit. Die Teams überwachen weiterhin das Verhalten der Plattform und überprüfen die Telemetrie, um die Problemlösung zu bestätigen.
resolved
Unsere Teams haben die Validierung nach der Bereitstellung abgeschlossen und bestätigt, dass die Serviceleistung auf das erwartete Niveau zurückgekehrt ist. Die kontinuierliche Überwachung hat einen stabilen Plattformbetrieb ohne weitere Auswirkungen gezeigt. Basierend auf diesen Ergebnissen gilt dieses Problem nun als gelöst.
postmortem
**Beschreibung:** Flexera One – IT Asset Management – Nordamerika – Degradierte Performance
**Zeitrahmen:** 20. Juli 2026, 8:13 Uhr PDT – 22. Juli 2026, 8:41 Uhr PDT
**Incident Summary**
Am 20. Juli 2026, um ca. 20:13 Uhr PDT, begann ein Problem mit Flexera One IT Asset Management Kunden in der nordamerikanischen Produktionsumgebung nach Abschluss der Produktionsfreigabe.
Während des betroffenen Zeitraums erlebten einige Kunden intermittierende Anwendungslangsamkeit, verzögerte Verarbeitung, Abgleichfehler, Timeout-Bedingungen und verschlechterte Leistung in inventarbezogenen Workflows. Die technischen Teams untersuchten die nach der Veröffentlichung beobachteten Leistungs- und Zuverlässigkeitsprobleme und arbeiteten daran, die zugrunde liegende Ursache und den Umfang der Auswirkungen zu bestimmen.
Die Untersuchung ergab, dass das beobachtete Verhalten mit einem zuvor in der Veröffentlichung identifizierten Defekt verbunden war. Korrekturänderungen, die den Defekt beheben sollten, wurden als Teil der Release-Aktivität aufgenommen; die Korrekturänderungen wurden jedoch während des Bereitstellungsprozesses nicht erfolgreich in allen nordamerikanischen Produktionsdatenbanken angewendet. Infolgedessen verzeichneten einige Umgebungen weiterhin eine signifikant erhöhte Datenbankverarbeitungsaktivität während inventarbezogener Operationen, was zu einem erhöhten Ressourcenverbrauch, Verarbeitungsverzögerungen, Timeout-Bedingungen und einer verschlechterten Anwendungsleistung führte.
Die technischen Teams arbeiteten daran, die Korrekturänderungen in den betroffenen nordamerikanischen Produktionsdatenbanken erfolgreich einzusetzen. Nach der Bereitstellung führten die Teams Validierungsaktivitäten durch und überwachten Verarbeitungsworkflows, um die Wiederherstellung zu bestätigen.
Am 22. Juli 2026, um ca. 8:41 Uhr PDT, bestätigte die Validierung die erfolgreiche Verarbeitung zuvor betroffener Workloads und dass die zuvor beobachteten Fehlermuster nicht mehr auftreten. Der Vorfall galt als behoben und die technischen Teams überwachten weiterhin, um die Stabilität des Dienstes zu bestätigen.
**Wurzelursache**
Der Vorfall wurde durch Korrekturänderungen verursacht, die einen zuvor identifizierten Fehler beheben sollten, der während des Release-Bereitstellungsprozesses nicht erfolgreich in allen nordamerikanischen Produktionsdatenbanken angewendet wurde.
Infolgedessen blieb der zugrunde liegende Defekt in den betroffenen Umgebungen aktiv und verursachte deutlich mehr Datenbankverarbeitungsaktivitäten als bei inventarbezogenen Verarbeitungsvorgängen vorgesehen. Diese erhöhte Arbeitsbelastung führte zu einem erhöhten Ressourcenverbrauch, Verarbeitungsverzögerungen, Timeout-Bedingungen und einer verschlechterten Plattformleistung.
Diese Bedingungen trugen zu intermittierender Langsamkeit der Anwendung, verzögerter Verarbeitung, Abgleich von Fehlern und verminderter Leistung bei, was sich auf einige IT Asset Management-Funktionalitäten in der nordamerikanischen Produktionsumgebung auswirkte.
**Abhilfemaßnahmen**
**Incident Investigation Initiiert:** Die technischen Teams untersuchten Berichte über Langsamkeit der Anwendung, Verarbeitungsverzögerungen, Ausfälle beim Abgleich und verschlechterte Plattformleistung, die sich auf die nordamerikanische Produktionsumgebung auswirkten.
2. **Wirkungsbeurteilung durchgeführt:** Die Teams überprüften von Kunden gemeldete Symptome, Systemleistungsdaten, Verarbeitungsaktivität und Plattformverhalten, um den Umfang und die Art des Problems zu bestimmen.
3. **Ursache identifiziert:** Die Untersuchung ergab, dass Korrekturänderungen, die einen zuvor identifizierten Defekt beheben sollten, während des Release-Bereitstellungsprozesses nicht erfolgreich in allen nordamerikanischen Produktionsdatenbanken angewendet wurden.
4. **Verhalten korrigiert:** Technische Teams implementierten Korrekturen, um das ineffiziente Verarbeitungsverhalten zu beseitigen, das zu einer erhöhten Datenbankauslastung, Verarbeitungsverzögerungen, Timeout-Bedingungen und einer verschlechterten Anwendungsleistung beitrug.
5. **Validierte Wiederfindung:** Die Teams validierten die Wirksamkeit der bereitgestellten Änderungen durch Überwachung und erfolgreiche Durchführung zuvor betroffener Verarbeitungsaktivitäten.
6. ** Überwachung nach der Wiederherstellung durchgeführt:** Eine zusätzliche Überwachung bestätigte, dass die zuvor beobachteten Fehlermuster und Leistungseinbußen nicht mehr auftraten und dass die Servicestabilität wiederhergestellt wurde.
** Künftige Präventivmaßnahmen**
Auf der Grundlage der Untersuchung wurden folgende Folgemaßnahmen ermittelt:
* **Verarbeitungslogik Verbesserungen:** Die technischen Teams implementierten und validierten Korrekturänderungen an der Inventarverarbeitungslogik, die für die nach der Veröffentlichung beobachtete erhöhte Arbeitsbelastung der Datenbank verantwortlich sind. Diese Änderungen wurden entwickelt, um das ineffiziente Verarbeitungsverhalten zu beseitigen, das zu Verarbeitungsverzögerungen, Ausfällen, Timeout-Bedingungen und verschlechterter Anwendungsleistung beigetragen hat.
* **Critical Hotfix Deployment Process Review:** Die technischen Teams werden den Bereitstellungsprozess für kritische Datenbank-Hotfixes überprüfen und alternative Ansätze evaluieren, um sicherzustellen, dass die erforderlichen Korrekturänderungen bei zukünftigen Release-Aktivitäten erfolgreich angewendet werden.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera- Spot- Alle Regionen - Falsche Abrechnungsdaten für AWS-Kunden
Beginn 17. Juli 2026 um 10:24 UTC · 2d 2h
OutageSchwerwiegender Vorfall
Betroffene Komponenten
Spot UISpot Website
investigating
Beschreibung des Vorfalls: Wir haben ein Problem identifiziert, das sich auf die Abrechnung und Kostensichtbarkeit für AWS-Kunden in allen Regionen auswirkt. Infolge einer aktiven Serviceprovider-Störung können Kunden ungenaue, unvollständige oder verspätete Kosten- und Nutzungsinformationen in der Abrechnungs- und Kostenmanagement-Konsole feststellen.
Dieses Problem ist auf AWS-basierte Dienste beschränkt und hat keine Auswirkungen auf Kunden, die andere Cloud-Plattformen nutzen.
Priorität: P2
Wiederherstellungsaktivität: Unsere technischen Teams haben bestätigt, dass das Problem mit einem aktiven AWS-Serviceereignis zusammenhängt, das alle Regionen betrifft. Wir beobachten die Situation aktiv und arbeiten eng mit AWS-Updates zusammen, um die Auswirkungen auf die Kunden zu bewerten. Die Servicewiederherstellung hängt davon ab, dass AWS das zugrunde liegende Problem löst, und wir werden weiterhin Updates bereitstellen, sobald zusätzliche Informationen verfügbar sind.
investigating
Wir werden dieses Problem weiter untersuchen.
identified
Wir beobachten weiterhin den Ausfall des Dienstleisters und seine Auswirkungen auf die betroffenen Dienste. Weitere Updates werden bereitgestellt, sobald neue Informationen verfügbar werden.
identified
Unsere bisherigen Untersuchungs- und Validierungsbemühungen haben keine Auswirkungen auf Spot-Rechnungs- oder Kostenanalysedaten festgestellt. Die überprüften Abrechnungs- und Preisdaten bleiben konsistent mit den erwarteten Werten. Während die ersten Validierungsergebnisse positiv sind, setzen wir zusätzliche Validierungsaktivitäten fort, da weitere Daten zur Verfügung stehen, um diese Ergebnisse zu bestätigen. Wir arbeiten weiterhin mit AWS zusammen und werden die Situation weiterhin genau beobachten. Wir werden zusätzliche Updates teilen, während unsere Validierungsaktivitäten fortgesetzt werden.
identified
Wir arbeiten weiterhin aktiv mit AWS zusammen und beobachten die Situation weiterhin genau. AWS hat die Ursache identifiziert und Minderungsmaßnahmen implementiert, um das zugrunde liegende Problem zu beheben, das dazu führte, dass falsche geschätzte Kosten- und Nutzungsdaten angezeigt wurden.
AWS hat mit dem Ausfüllen von Daten begonnen, um genaue Kosten- und Nutzungsinformationen für alle Kunden wiederherzustellen, und die vollständige Wiederherstellung wird bis zum 18. Juli 2026, 12:00 Uhr PDT, erwartet.
monitoring
Wir überwachen weiterhin das AWS-Service-Event und bleiben mit AWS verbunden, während sie ihre Wiederherstellungsaktivitäten abschließen. Die bisher abgeschlossene Validierung hat keine Auswirkungen auf Spot-Rechnungs- oder Kostenanalysedaten festgestellt. Wir beobachten die Situation weiterhin und schließen alle verbleibenden Validierungsaktivitäten ab, bevor wir die Schließung dieses Vorfalls feststellen.
resolved
AWS hat seine Serviceunterbrechung am 18. Juli um 6:57 Uhr PDT behoben. Nach erfolgreicher Validierung durch unsere technischen Teams haben wir bestätigt, dass die Servicefunktionalität wiederhergestellt wurde.
postmortem
**Beschreibung:** Flexera Spot – AWS Billing Service Disruption
Zeitrahmen: 17. Juli 2026, 1:33 Uhr PDT - 18. Juli 2026, 6:57 Uhr PDT
**Incident Summary**
Am 17. Juli 2026, um etwa 1:33 Uhr PDT, wurden die technischen Teams von Flexera auf ein AWS-Problem aufmerksam, das sich auf die geschätzten Abrechnungs- und Nutzungsdaten auswirkte, die in AWS Billing and Cost Management, Cost Explorer und Cost and Usage Reports angezeigt wurden.
Angesichts der Art der Unterbrechung des AWS-Services leiteten technische Teams eine Untersuchung ein, um festzustellen, ob Spot-Abrechnungen, Kostenanalysen oder Einsparungsberechnungen für AWS-Kunden betroffen waren. Während der Untersuchung überprüften die Teams die von Spot verwendeten Abrechnungs- und Preisdaten, validierten relevante Kosten- und Preistabellen, überwachten AWS-Updates und bewerteten, ob Kundendaten betroffen waren.
Die technischen Teams validierten die von Spot verwendeten Abrechnungs- und Preisdaten und bestätigten, dass die entsprechenden Kosten- und Preistabellen wie erwartet funktionierten. Die Untersuchung ergab keine Probleme bei den von Spot verwendeten Daten, und es wurden keine falschen Abrechnungs- oder Einsparungsberechnungen festgestellt.
AWS bestätigte daraufhin, dass das Problem aus den AWS-Abrechnungs- und Kostenverwaltungsdiensten stammte, identifizierte und entschärfte das zugrunde liegende Problem und schloss Datenwiederherstellungs- und -abfüllungsaktivitäten ab.
Auf der Grundlage der während der gesamten Untersuchung durchgeführten Validierung wurden innerhalb von Spot keine Auswirkungen auf die Kunden beobachtet. Nach der Bestätigung der AWS-Wiederherstellung und dem Abschluss der Validierungsaktivitäten nach der Wiederherstellung galt der Vorfall als behoben.
**Wurzelursache**
Der Vorfall wurde durch ein AWS-Serviceproblem verursacht, das sich auf geschätzte Abrechnungs- und Nutzungsdaten auswirkt, die in AWS Billing and Cost Management, Cost Explorer und Cost and Usage Reports angezeigt werden. AWS identifizierte und entschärfte das zugrunde liegende Problem und schloss Datenwiederherstellungsaktivitäten ab.
**Abhilfemaßnahmen**
Während der Incident Response wurden folgende Maßnahmen ergriffen:
Incident Investigation Initiated: Technische Teams begannen mit der Untersuchung des AWS-Abrechnungs- und Nutzungsdatenproblems, um festzustellen, ob Spot-Kunden betroffen waren.
• Durchführung einer Folgenabschätzung: Technische Teams bewerteten, ob sich die Unterbrechung des AWS-Services auf die Spot-Abrechnungsanalyse und Einsparungsberechnungen auswirkte.
• Datenvalidierung abgeschlossen: Die Teams überprüften und validierten die von Spot verwendeten Abrechnungs- und Preisdaten und bestätigten, dass die relevanten Kosten- und Preistabellen wie erwartet funktionierten.
• AWS Recovery Monitored: Technische Teams überwachten die AWS-Kommunikation, Service-Updates und Wiederherstellungsaktivitäten während des gesamten Vorfalls.
• Validierung nach Wiederherstellung: Zusätzliche Validierung wurde nach AWS-Wiederherstellungs- und Daten-Backfill-Aktivitäten abgeschlossen, um die Integrität der von Spot verwendeten Abrechnungs- und Preisdaten zu bestätigen.
Incident Resolved: Der Incident wurde geschlossen, nachdem AWS die Wiederherstellung bestätigt hatte und die technische Validierung keine Auswirkungen innerhalb von Spot identifiziert hatte.
** Künftige Präventivmaßnahmen**
Folgende Folgemaßnahmen wurden während des Vorfalls identifiziert:
• AWS-Zusammenarbeit und -Überprüfung: Arbeiten Sie weiterhin eng mit AWS zusammen, um die zugrunde liegende Ursache von vom Anbieter verwalteten Vorfällen zu verstehen und alle Empfehlungen oder Erkenntnisse aus ihrer Untersuchung zu überprüfen.
Resilienz- und Validierungsprüfung: Überprüfung von Möglichkeiten zur weiteren Stärkung der Validierungsprozesse für abrechnungsbezogene Daten, um eine schnellere Folgenabschätzung und Reaktion bei ähnlichen Serviceunterbrechungen von Drittanbietern in der Zukunft zu unterstützen.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera One- IT Asset Management- APAC & EU - Langsamkeit und eingeschränkte Performance
Beginn 17. Juli 2026 um 08:24 UTC · 1d 11h
OutageSchwerwiegender Vorfall
Betroffene Komponenten
IT Asset Management - APAC Inventory UploadIT Asset Management - EU Inventory Upload
identified
Incident Description: Wir haben ein Problem identifiziert, das sich auf die Bestandsverarbeitung in Flexera One IT Asset Management auswirkt, nachdem das Release 2026 R1.1 in unseren APAC- und Europa-Umgebungen bereitgestellt wurde. Infolgedessen kann eine Teilmenge von Kunden beim Zugriff auf bestimmte Bereiche der Benutzeroberfläche und bei der Ausführung systembezogener Aufgaben eine beeinträchtigte Leistung aufweisen.
Priorität: P2
Restaurierungsaktivität: Unsere technischen Teams haben das Problem als Softwarefehler identifiziert, der mit dem Release 2026 R1.1 eingeführt wurde. Minderungsmaßnahmen wurden implementiert, um die Auswirkungen auf den Kunden zu reduzieren, und die Teams arbeiten aktiv daran, die Serviceleistung vollständig wiederherzustellen. Wir werden weiterhin Updates bereitstellen, wenn Fortschritte gemacht werden.
identified
Wir machen weiterhin Fortschritte bei der Bewältigung der Leistungsprobleme, die eine Teilmenge von Kunden in den Produktionsumgebungen APAC und Europa betreffen. Die identifizierten Fixes wurden nun bereitgestellt, und wir überwachen die Umgebung aktiv, während die Kundenverarbeitungsaktivitäten fortgesetzt werden. Unsere Teams validieren die Wirksamkeit dieser Änderungen und bewerten die Gesamtleistung der Plattform. Wir werden zusätzliche Updates bereitstellen, sobald weitere Informationen verfügbar sind.
monitoring
Unsere Teams validieren weiterhin die kürzlich eingesetzten Hotfixes, und die ersten Ergebnisse sehen positiv aus. Wir überwachen die betroffenen Verarbeitungsaktivitäten genau, um die Wirksamkeit des Fixes zu bestätigen und die Stabilität der Plattform zu gewährleisten.
Die Validierung läuft noch, und wir werden die Leistung weiterhin überwachen, bevor wir die vollständige Auflösung bestätigen. Wir werden ein weiteres Update bereitstellen, sobald mehr Informationen verfügbar sind.
resolved
Nach der Bereitstellung der identifizierten Fixes werden die zuvor betroffenen Verarbeitungsaktivitäten nun erfolgreich abgeschlossen, und wir sehen keine Wiederholung der nach der jüngsten Veröffentlichung beobachteten Probleme mehr. Basierend auf den Ergebnissen, die nach dem Einsatz der Fixes beobachtet wurden, ist dieser Vorfall nun behoben. Wir werden in den kommenden Tagen eine vollständige RCA veröffentlichen, die eine detaillierte Zusammenfassung des Problems, der Ursache und der vorbeugenden Maßnahmen enthält, die umgesetzt werden, um ein Wiederauftreten zu verhindern.
postmortem
**Beschreibung:** Flexera One – IT Asset Management – APAC & EU – Langsamkeit und eingeschränkte Performance
**Zeitrahmen:** 13. Juli 2026, 13.00 Uhr PDT – 18. Juli 2026, 7:10 Uhr PDT
**Incident Summary**
Am 13. Juli 2026, um etwa 13:00 Uhr PDT, begann ein Problem mit Flexera One IT Asset Management-Kunden in den Produktionsumgebungen APAC und Europa nach dem Einsatz des Releases 2026 R1.1.
Während des betroffenen Zeitraums erlebten einige Kunden eine intermittierende Anwendungslangsamkeit, verzögerte Verarbeitung, Abgleichfehler und verminderte Leistung beim Zugriff auf bestimmte Bereiche der Anwendung oder bei der Durchführung von Bestandsaktivitäten. Als die Kundenberichte zunahmen, begannen die technischen Teams, gemeinsame Muster der gemeldeten Symptome zu untersuchen, um die zugrunde liegende Ursache zu bestimmen.
Die Untersuchung identifizierte einen Fehler, der im Rahmen des Flexera One IT Asset Management 2026 R1.1 Release eingeführt wurde. Unter bestimmten Bedingungen führte der Defekt zu einer deutlich höheren Datenbankverarbeitungsaktivität bei inventarbezogenen Operationen. Während die Bestandsdaten verarbeitet wurden, trug der erhöhte Arbeitsaufwand zu Verarbeitungsverzögerungen, Timeout-Bedingungen und einer verschlechterten Anwendungsleistung für einige Kunden bei.
Die technischen Teams entwickelten und setzten Hotfixes ein, um das Problem in den betroffenen Produktionsumgebungen anzugehen. Nach der Bereitstellung führten die Teams Validierungsaktivitäten durch und überwachten die betroffenen Verarbeitungsworkflows, um die Wiederherstellung zu bestätigen.
Bis zum 18. Juli 2026, etwa um 7:10 Uhr PDT, bestätigte die Validierung die erfolgreiche Verarbeitung zuvor betroffener Workloads und dass die mit dem Problem verbundenen Fehlermuster nicht mehr auftreten. Der Vorfall galt als behoben und die technischen Teams überwachten weiterhin, um die Stabilität des Dienstes zu bestätigen.
**Wurzelursache**
Der Vorfall wurde durch einen Fehler verursacht, der im Flexera One IT Asset Management 2026 R1.1-Release eingeführt wurde und sich auf inventarbezogene Verarbeitungsvorgänge auswirkte.
Unter bestimmten Bedingungen verursachte der Defekt deutlich mehr Datenbankverarbeitungsaktivitäten als bei inventarbezogenen Verarbeitungsvorgängen vorgesehen. Diese erhöhte Arbeitsbelastung führte zu einem erhöhten Ressourcenverbrauch, Verarbeitungsverzögerungen und Timeout-Bedingungen.
Diese Bedingungen trugen zu intermittierender Langsamkeit der Anwendung, verzögerter Verarbeitung, Abgleich von Fehlern und verminderter Leistung bei, was sich auf einige IT Asset Management-Funktionalitäten auswirkte.
**Abhilfemaßnahmen**
1. Incident Investigation Initiated: Technische Teams begannen mit der Untersuchung von Berichten über langsame Anwendungen, Verarbeitungsverzögerungen und Zuverlässigkeitsprobleme, die sich auf die Produktionsumgebungen von APAC und Europa auswirken.
2. Folgenabschätzung durchgeführt: Teams überprüften von Kunden gemeldete Symptome, Systemleistungsdaten und Verarbeitungsverhalten, um den Umfang und die Art des Problems zu bestimmen.
3. Ursache identifiziert: Die Untersuchung ergab, dass ein in der R1.1-Version von 2026 eingeführter Defekt eine übermäßige Verarbeitungsaktivität während inventarbezogener Operationen erzeugte.
4. Hotfixes Entwickelt und eingesetzt: Technische Teams entwickelten und setzten Hotfixes ein, um das betroffene Verarbeitungsverhalten in den Produktionsumgebungen des APAC und Europas zu korrigieren.
5. Recovery Validated: Teams validierten die Wirksamkeit der Hotfixes durch Überwachung und erfolgreiche Durchführung von zuvor betroffenen Verarbeitungsaktivitäten.
6. Überwachung nach der Wiederherstellung: Zusätzliche Überwachung bestätigte, dass die zuvor beobachteten Ausfälle und Leistungseinbußen nicht mehr auftreten und dass die Servicestabilität wiederhergestellt wurde.
** Künftige Präventivmaßnahmen**
Auf der Grundlage der Untersuchung wurden folgende Folgeaktivitäten ermittelt:
Verbesserungen der Verarbeitungslogik: Technische Teams haben Korrekturen an der betroffenen Verarbeitungslogik vorgenommen, um das ineffiziente Verhalten zu beseitigen, das zu einem erhöhten Ressourcenverbrauch und einer Leistungsminderung beigetragen hat.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera One - IT Asset Management - EU - Zugriff auf Congnos Analytics
Beginn 14. Juli 2026 um 09:13 UTC · 0m
OutageSchwerwiegender Vorfall
Betroffene Komponenten
IT Asset Management - EU Business Reporting
resolved
Incident Description: Unsere Teams haben ein Problem identifiziert, das Cognos Analytics in der EU-Produktionsumgebung betrifft. Während des Impact-Fensters konnten betroffene Kunden möglicherweise nicht auf Cognos Analytics zugreifen oder diese laden. Diese Untersuchung bestätigte, dass die Auswirkungen auf die Produktionsregion in der EU beschränkt waren.
Priorität:P2
Restaurierungsaktivität: Unsere technischen Teams stellten fest, dass das Problem mit einem kürzlich durchgeführten Upgrade auf Cognos Analytics zusammenhing, das im Rahmen der Release-Aktivitäten für EU Production IT Asset Management abgeschlossen wurde. Das Team identifizierte ein während des Upgrades eingeführtes Konfigurationsproblem, implementierte die erforderlichen Konfigurationskorrekturen und stellte die normale Servicefunktionalität wieder her. Die Umwelt bleibt unter Überwachung stabil. Weitere Einzelheiten, einschließlich der Ursache und der vorbeugenden Maßnahmen, werden in einem Post-Mortem-Bericht vorgestellt.
postmortem
**Beschreibung:** Flexera One - IT Asset Management - EU - Zugriff auf Congnos Analytics
**Zeitrahmen:** 13. Juli 2026, 12:51 Uhr PDT bis 14. Juli 2026, 1:52 Uhr PDT
**Incident Summary**
Am Montag, den 13. Juli 2026, um 12:51 Uhr PDT, identifizierten unsere Teams nach dem Upgrade von Cognos Analytics 12.1.2, das im Rahmen der Flexera One IT Asset Management-Version in der Produktionsumgebung Europa implementiert wurde, ein Problem, das Kunden daran hinderte, auf Cognos Analytics zuzugreifen. Infolgedessen konnten die betroffenen Benutzer die Anwendung nach Abschluss der geplanten Wartungsarbeiten nicht erfolgreich starten.
Die technischen Teams leiteten sofort eine Untersuchung ein und bestätigten, dass das Problem in der EU-Produktionsumgebung isoliert war, ohne dass in anderen Produktionsregionen Auswirkungen beobachtet wurden. Weitere Analysen ergaben, dass das Upgrade selbst erfolgreich abgeschlossen war; jedoch wurde ein Teil der erforderlichen Post-Upgrade-Konfigurationsaktivitäten nicht vollständig angewendet, wodurch verhindert wurde, dass Cognos Analytics korrekt gestartet wurde.
Die verbleibenden Konfigurationsaufgaben wurden umgehend abgeschlossen und die normale Cognos Analytics-Funktionalität wiederhergestellt. Nach einer umfassenden Validierung des Kundenzugangs und einer Phase verbesserter Überwachung wurde bestätigt, dass der Dienst normal funktioniert und der Vorfall für behoben erklärt.
**Wurzelursache**
* Unvollständige Post-Upgrade-Konfiguration: Obwohl das Upgrade von Cognos Analytics 12.1.2 erfolgreich abgeschlossen wurde, wurden die erforderlichen Post-Upgrade-Konfigurationsaufgaben nicht vollständig abgeschlossen, bevor die Umgebung wieder in Betrieb genommen wurde.
* Service-Initialisierung fehlgeschlagen: Die unvollständige Konfiguration verhinderte, dass Cognos Analytics korrekt initialisiert wurde, was dazu führte, dass Kunden nicht auf die Anwendung zugreifen konnten.
* Regionale Auswirkungen: Das Problem beschränkte sich auf das EU-Produktionsumfeld. In Nordamerika, APAC oder anderen Produktionsregionen wurden keine Auswirkungen festgestellt.
**Abhilfemaßnahmen**
Um den Service wiederherzustellen, technische Teams:
* Die erforderlichen Post-Upgrade-Konfigurationsaktivitäten abgeschlossen, die während der Bereitstellung nicht vollständig angewendet wurden.
* Neustart und Validierung der Cognos Analytics-Dienste zur Bestätigung der erfolgreichen Anwendungsinitialisierung.
* Durchführung von Funktionstests und Validierung des Kundenzugriffs, um sicherzustellen, dass die Berichtsfunktionen wie erwartet funktionieren.
* Die Umgebung wurde nach der Wiederherstellung einer verbesserten Überwachung unterzogen, um eine kontinuierliche Servicestabilität zu gewährleisten.
** Künftige Präventivmaßnahmen**
* Erweiterte Post-Upgrade-Validierung: Verbesserte Validierungsverfahren für die Bereitstellung, um sicherzustellen, dass alle erforderlichen Post-Upgrade-Konfigurationsaktivitäten erfolgreich abgeschlossen wurden, bevor Wartungsaktivitäten abgeschlossen werden.
Verbesserte Überwachung und Alarmierung: Verbesserung der Überwachung und Alarmierung von Cognos Analytics, um eine frühere Erkennung von Service-Degradation nach Upgrades zu ermöglichen.
Verbesserungen der Bereitstellungs-Checkliste: Aktualisieren Sie die Bereitstellungs-Runbooks und die Betriebs-Checklisten, um eine zusätzliche Überprüfung des Abschlusses der Konfiguration nach dem Upgrade vor der Rückgabe der Umgebung an den Produktionsdienst einzuschließen.
* Operational Readiness Review: Überprüfen Sie die Upgrade-Ausführungsverfahren, um sicherzustellen, dass alle obligatorischen Aufgaben nach der Bereitstellung abgeschlossen und validiert werden, bevor die Wartungsfenster geschlossen werden.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera One - IT Asset Management - APAC - Fehlende Menüelemente
Beginn 12. Juli 2026 um 23:51 UTC · 3h 53m
OutageSchwerwiegender Vorfall
Betroffene Komponenten
IT Asset Management - APAC Business Reporting
investigating
Vorfallbeschreibung: Wir haben ein Problem mit Flexera One IT Asset Management (ITAM) Kunden in der APAC-Region. Kunden können feststellen, dass bestimmte Navigations- und Menüpunkte innerhalb der ITAM-Schnittstelle nicht sichtbar sind, was zu einem eingeschränkten Zugriff auf einige Funktionen führt.
Priorität: P2
Restaurierungsaktivität: Unsere technischen Teams untersuchen dieses Problem aktiv und arbeiten daran, die volle Funktionalität wiederherzustellen. Wir werden weiterhin Updates bereitstellen, sobald mehr Informationen verfügbar sind.
identified
Unsere Untersuchung hat eine erhöhte Ressourcenauslastung festgestellt, die sich auf die Funktionalität des gemeldeten Problems auswirkt. Derzeit laufen Minderungsmaßnahmen, einschließlich der Erhöhung der Systemkapazität zur Unterstützung der Wiederherstellungsbemühungen.
Wir überwachen aktiv die Umgebung und validieren das Verhalten der Plattform, wenn diese Änderungen umgesetzt werden. Die Arbeit an der Wiederherstellung der vollen Funktionalität für betroffene Kunden wird fortgesetzt, und wir werden zusätzliche Updates veröffentlichen, wenn Fortschritte erzielt werden.
identified
Unsere Untersuchung hat ein mögliches Konfigurationsproblem identifiziert, das mit der betroffenen Funktionalität verbunden ist. Im Rahmen der laufenden Minderungsbemühungen wurden Konfigurationsänderungen rückgängig gemacht und zuvor eingeleitete Kapazitätssteigerungen nun abgeschlossen.
Wir überwachen aktiv die Umgebung und validieren das Verhalten der Plattform, wenn diese Änderungen wirksam werden. Die Arbeit an der Wiederherstellung der vollen Funktionalität für betroffene Kunden wird fortgesetzt, und wir werden weitere Updates bereitstellen, sobald Fortschritte erzielt werden.
resolved
Nach einer erweiterten Überwachung haben wir bestätigt, dass die Serviceleistung stabil geblieben ist und wie erwartet funktioniert. Dieses Problem ist nun gelöst.
postmortem
**Description:** Flexera One - IT Asset Management - APAC - Missing Menu Items
**Timeframe:** July 12, 2026, 3:00 PM PDT - July 12, 2026, 7:16 PM PDT
**Incident Summary**
On Sunday, July 12, 2026, at 3:00 PM PDT, customers in the APAC production environment began reporting that several IT Asset Management \(ITAM\) menu items, including functionality such as Reports and All Applications, were no longer visible within the Flexera One user interface. Multiple customers were affected, impacting their ability to navigate and access portions of the ITAM application.
Technical teams immediately began investigating the issue and identified authentication-related errors affecting the ITAM user interface. During the investigation, teams reviewed infrastructure health, application behavior, and recent platform changes to determine the source of the problem.
The investigation determined that an application configuration change associated with a newly introduced authentication capability had been incorrectly applied to the production environment. The issue became apparent when application instances were refreshed, resulting in authentication-related failures that prevented certain ITAM menu items from loading correctly for affected users.
Technical teams reverted the affected configuration, refreshed the impacted application instances, and validated recovery across the environment. Following these actions, menu functionality was restored, affected customers confirmed recovery, and the incident was resolved on July 12, 2026, at 7:16 PM PDT after validation and monitoring confirmed normal operation had returned.
**Root Cause**
Investigation determined that an application configuration change associated with a new authentication capability was incorrectly applied to the production environment.
When application instances were subsequently refreshed, the incorrect configuration resulted in authentication-related errors within the ITAM user interface. These errors prevented certain navigation components from loading correctly, causing affected users to experience missing menu items until the configuration was corrected and the affected instances were refreshed.
**Remediation Actions**
The following actions were taken during the incident response:
1. Incident Investigation Initiated: Technical teams began investigating after receiving reports from multiple customers regarding missing ITAM menu items.
2. Application Configuration Reviewed: Recent application and configuration changes were reviewed to identify the source of the menu-loading failures.
3. Incorrect Configuration Identified: Technical teams determined that an authentication-related configuration change had been incorrectly applied to the production environment.
4. Configuration Corrected: The affected configuration was removed from the impacted production instances.
5. Application Instances Refreshed: Impacted application instances were refreshed to ensure the corrected configuration was consistently applied across the environment.
6. Recovery Validation Performed: Technical teams validated menu visibility and functionality across the affected environment and confirmed recovery with impacted customers.
**Future Preventative Measures**
Following the incident, corrective measures were implemented to prevent recurrence of the issue and improve detection of similar conditions in the future.
1. Health Check Monitoring Improvements: The existing health check was updated to detect the application behavior associated with this failure condition. The revised monitoring is designed to identify similar menu-loading and authentication-related application failures more effectively and accelerate detection should a similar issue occur in the future.
2. Deployment Process Reinforcement: The incident highlighted the importance of ensuring new authentication-related features are applied only to their intended environments. The deployment approach and expected application process for these changes have been reinforced with the technical team to reduce the risk of similar configuration issues in the future.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Incident Description: Wir untersuchen derzeit die verschlechterte Leistung von Spot Ocean ECS für AWS-Kunden. Kunden können erhebliche Langsamkeit oder Verzögerungen beim Zugriff auf die Konsole oder bei der Nutzung bestimmter Ocean ECS-Funktionen feststellen.
Priorität: P2
Restaurierungsaktivität: Unsere technischen Teams untersuchen aktiv und arbeiten daran, die normale Funktionalität wiederherzustellen. Wir werden weitere Updates bereitstellen, sobald weitere Informationen verfügbar sind.
monitoring
Unsere Untersuchung ergab, dass die Verschlechterung mit einem AWS-Service-Gesundheitsereignis in der US-Ost-1-Region zusammenhängt. AWS hat seitdem berichtet, dass das Problem behoben wurde, und wir sehen jetzt Anzeichen einer Wiederherstellung auf unserer Seite, einschließlich einer verbesserten Leistung der Spot Ocean ECS-Konsole und des erfolgreichen Abschlusses der damit verbundenen AWS-Workflows.
Die Produktionsumgebung erscheint zu diesem Zeitpunkt stabil. Unsere Teams werden die Überwachung für einen kurzen Validierungszeitraum fortsetzen, um sicherzustellen, dass die Leistung stabil bleibt, bevor der Vorfall behoben wird.
resolved
Wir haben die Umwelt für einen längeren Zeitraum weiter überwacht und die Dienstleistungen sind stabil geblieben, ohne dass weitere Probleme beobachtet wurden.
Dieser Vorfall wurde behoben.
postmortem
**Beschreibung:** Spot Ocean – AWS – Ocean ECS Console Performance Degradation
**Zeitrahmen:** 6. Juli 2026, 05:45 Uhr PDT bis 6. Juli 2026, 07:53 Uhr PDT
**Incident Summary**
Am Montag, den 6. Juli 2026, um 05:45 Uhr PDT identifizierten unsere Teams eine Leistungsminderung, die sich auf das Spot Ocean ECS für AWS-Kunden auswirkte. Während des Impact-Fensters erlebten die Kunden eine erhöhte Latenz beim Zugriff auf die Ocean ECS-Konsole, und einige AWS-bezogene Operationen verzögerten sich oder wurden nicht erfolgreich abgeschlossen.
Technische Teams leiteten sofort eine Untersuchung ein, um die Ursache des Problems zu identifizieren. Da eine Unterbrechung des AWS-Services gleichzeitig in der AWS-US-Ost-1-Region stattfand, betrachtete die Untersuchung zunächst sowohl das externe AWS-Ereignis als auch eine kürzlich abgeschlossene Produktionsbereitstellung als potenzielle Faktoren.
Durch detaillierte Analysen stellten die Teams fest, dass die Hauptursache für die Kundenauswirkungen Instabilität war, die durch die jüngste Gateway-Bereitstellung eingeführt wurde. Die daraus resultierende Verschlechterung der Gateway-Leistung beeinflusste die Anfrageverarbeitung und Reaktionsfähigkeit innerhalb des Spot Ocean ECS. Während die gleichzeitige Unterbrechung des AWS-Services die Untersuchung komplizierter machte, wurde bestätigt, dass sie nicht der Haupttreiber der Kundenauswirkungen ist.
Um den Service wiederherzustellen, haben die Teams die Bereitstellung auf die vorherige stabile Version zurückgesetzt. Nach dem Rollback kehrte die Plattformleistung auf das erwartete Niveau zurück und die Kundenworkflows nahmen den normalen Betrieb wieder auf. Ein längerer Überwachungszeitraum bestätigte eine anhaltende Servicestabilität, bevor das Ereignis formell gelöst wurde.
**Wurzelursache**
Der Vorfall wurde durch Instabilität verursacht, die in einer Gateway-Bereitstellung eingeführt wurde. Die Bereitstellung führte zu einer verschlechterten Leistung innerhalb des Gateway-Dienstes, wodurch die Fähigkeit, Kundenanfragen effizient zu bearbeiten, verringert wurde. Dies führte zu erhöhten Reaktionszeiten und intermittierenden Ausfällen für den Betrieb der Spot Ocean ECS-Konsole und AWS-bezogene Workflows.
Durch die Rückkehr zur vorherigen stabilen Gateway-Version wurde die normale Plattformleistung wiederhergestellt und die Auswirkungen des Kunden behoben.
Beitragende Faktoren
* Eine gleichzeitige Unterbrechung des AWS-Services in der US-East-1-Region trat im gleichen Zeitraum auf. Obwohl es nicht die Ursache des Vorfalls war, komplizierte es die erste Untersuchung und verzögerte die Identifizierung des zugrunde liegenden Gateway-Problems.
* Das Gateway-Rollback erforderte aufgrund des Umfangs der Produktionsbereitstellung zusätzliche Zeit, wodurch der gesamte Wiederherstellungsprozess verlängert wurde.
* Operationen mit Ressourcenerstellung und -updates hatten aufgrund der verschlechterten Reaktionsfähigkeit des Gateways größere Auswirkungen als schreibgeschützte Aktivitäten.
**Abhilfemaßnahmen**
* Technische Teams untersuchten die Verschlechterung und identifizierten eine kürzliche Gateway-Bereitstellung als Hauptquelle des Problems.
* Die betroffene Gateway-Bereitstellung wurde auf die letzte stabile Version zurückgerollt, wodurch die Servicestabilität wiederhergestellt wurde.
* Plattformleistung und kundenorientierte Workflows wurden nach dem Rollback validiert.
* Die technischen Teams haben einen längeren Überwachungszeitraum abgeschlossen, um den stabilen Servicebetrieb zu bestätigen, bevor der Vorfall beendet wurde.
** Künftige Präventivmaßnahmen**
Verbesserte Deployment-Sicherheitsvorkehrungen - Engineering-Teams werden Deployment-Kontrollen und Validierungsprozesse verstärken, um die Wahrscheinlichkeit ähnlicher Deployment-bezogener Probleme in Produktionsumgebungen zu verringern.
Erweiterte Plattformüberwachung - Zusätzliche Überwachung und Alarmierung werden implementiert, um ein früheres Erkennen von abnormalem Gateway-Verhalten zu ermöglichen, einschließlich der Reaktionsfähigkeit der Dienste, der Ressourcenauslastung und der Stabilität der Anwendungen.
Verbesserte Wiederherstellungsverfahren - Rollback-Verfahren werden verbessert und regelmäßig validiert, um die Wiederherstellungszeit zu verkürzen und die Betriebseffizienz bei einsatzbezogenen Vorfällen zu verbessern.
* Proaktive Service-Gesundheitsvalidierung - Synthetische Gesundheitschecks werden erweitert, um kritische Ocean ECS-Benutzer-Workflows kontinuierlich zu validieren und eine frühere Identifizierung von Leistungseinbußen beim Kunden zu ermöglichen.
Verbesserte Abhängigkeitsüberwachung - Engineering-Teams werden die Transparenz von externen Cloud-Service-Ereignissen und Plattformabhängigkeiten weiter verbessern, um eine schnellere Unterscheidung zwischen internen Plattformproblemen und Serviceunterbrechungen von Drittanbietern bei zukünftigen Untersuchungen zu ermöglichen.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera One – APAC – Intermittierende Zugangsprobleme
Incident Description: Wir haben ein Problem identifiziert, das eine Teilmenge der Flexera One-Dienste in der APAC-Region betrifft, was zu intermittierenden Zugriffsproblemen oder Ausfällen für einige Benutzer geführt haben kann. Die Auswirkungen waren intermittierend und andere Regionen waren nicht betroffen. Das Problem wurde behoben und die betroffenen Dienste funktionieren normal.
Priorität: P2
Wiederherstellungsaktivität: Unsere technischen Teams haben das Problem untersucht und eine kürzliche Änderung zur Wiederherstellung des Dienstes rückgängig gemacht. Wir haben bestätigt, dass die betroffenen Dienste normal funktionieren, und die Überwachung fortgesetzt, um die Stabilität der Plattform zu gewährleisten. Dieser Vorfall wurde behoben.
postmortem
**Beschreibung:** Flexera One – APAC – Intermittierende Zugriffsprobleme
**Zeitrahmen:** 3. Juli 2026, 11:20 Uhr PDT – 3. Juli 2026, 11:50 Uhr PDT
**Incident Summary**
Am 3. Juli 2026, um ca. 11:20 Uhr PDT, wurde ein Problem identifiziert, das eine Teilmenge der Flexera One-Dienste in der APAC-Produktionsumgebung betrifft.
Während des Ereignisfensters haben einige Kunden möglicherweise intermittierende Zugriffsprobleme oder Ausfälle beim Zugriff auf bestimmte Bereiche der Flexera One-Plattform. Die Auswirkungen waren intermittierend, da redundante Servicekapazitäten verfügbar blieben und während des Vorfalls weiterhin den Verkehr bedienten. Sonstige Flexera Eine Region, einschließlich NAM und EU, war nicht betroffen.
Die technischen Teams begannen sofort mit der Untersuchung und überprüften die betroffenen Dienste und unterstützenden Plattformkomponenten innerhalb der APAC-Umgebung. Die Untersuchung ergab, dass eine kürzlich in der APAC-Umgebung vorgenommene Änderung dazu beitrug, dass intermittierende Serviceausfälle beobachtet wurden.
Im Rahmen der Wiederherstellungsbemühungen wurde die Änderung rückgängig gemacht und das Serviceverhalten überwacht, um die Wiederherstellung zu validieren. Nach dem Rollback wurde die Servicestabilität wiederhergestellt und die Kunden konnten normal auf die betroffene Funktionalität zugreifen. Gegen 11:50 Uhr PDT funktionierten die Dienste wie erwartet und der Vorfall galt als gelöst.
**Wurzelursache**
Der Vorfall wurde durch eine Konfigurationsänderung innerhalb der APAC-Umgebung verursacht, die die Kommunikation zwischen einer Teilmenge von Plattformdiensten und einer Backend-Plattformkomponente unbeabsichtigt beeinflusste.
Während der Untersuchung stellten technische Teams fest, dass die Änderung dazu führte, dass bestimmte Plattformdienste nicht in der Lage waren, richtig mit der betroffenen Komponente zu kommunizieren. Dies führte zu intermittierenden Ausfällen, die eine Teilmenge der Flexera One-Dienste in der APAC-Region betrafen.
Während das Problem auftrat, blieben ein oder mehrere Pods, die die betroffenen Dienste unterstützten, verfügbar und dienten weiterhin dem Traffic. Infolgedessen erlebten die Kunden intermittierende Zugriffsprobleme und nicht einen vollständigen Serviceausfall.
**Abhilfemaßnahmen**
Während der Incident Response wurden folgende Maßnahmen ergriffen:
Initiiert: Technische Teams begannen, intermittierende Zugriffsprobleme zu untersuchen, die eine Teilmenge der Flexera One-Dienste in der APAC-Region betreffen.
Plattformüberprüfung abgeschlossen: Technische Teams haben die betroffenen Dienste und unterstützenden Plattformkomponenten in der APAC-Umgebung überprüft, um die Ursache des Problems zu identifizieren.
• Aktuelle Änderung identifiziert: Die Untersuchung identifizierte eine kürzlich implementierte Änderung, die mit der beobachteten Service-Degradation korreliert.
• Change Reverted: Die identifizierte Änderung wurde als Teil der Minderungsbemühungen zur Wiederherstellung des normalen Serviceverhaltens rückgängig gemacht.
Service Recovery Validated: Technische Teams überwachten das Serviceverhalten nach dem Rollback und bestätigten, dass die betroffene Funktionalität normal funktionierte.
Plattformstabilitätsüberwachung fortgesetzt: Nach der Wiederherstellung wurde eine zusätzliche Überwachung durchgeführt, um die fortgesetzte Servicestabilität zu überprüfen, bevor der Vorfall beendet wurde.
** Künftige Präventivmaßnahmen**
Dieser Vorfall hob die Bedeutung der Validierung von Plattformänderungen hervor, um sicherzustellen, dass unbeabsichtigte Auswirkungen identifiziert werden, bevor sie die Verfügbarkeit des Dienstes beeinträchtigen.
Basierend auf der Untersuchung werden folgende Folgeaktivitäten verfolgt:
Verbesserungen bei der Konfigurationsvalidierung: Überprüfung und Verbesserung der Validierungsprozesse für Änderungen der Infrastruktur- und Plattformkonfiguration, um unbeabsichtigte Auswirkungen zu identifizieren, bevor Änderungen in Produktionsumgebungen implementiert werden.
Verbesserung der Verifizierung nach der Bereitstellung: Überprüfen Sie die Verifizierungsverfahren nach der Bereitstellung, um sicherzustellen, dass kritische Serviceabhängigkeiten nach Konfigurationsänderungen zugänglich bleiben und wie erwartet funktionieren.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera One- IT Asset Management- APAC & EU - Inventory Import Failures
Beginn 25. Juni 2026 um 06:54 UTC · 0m
Pending
Betroffene Komponenten
IT Asset Management - APAC Inventory UploadIT Asset Management - EU Inventory Upload
resolved
Incident Description: Wir haben ein Problem identifiziert, das die Bestandsverarbeitung in Flexera One IT Asset Management nach dem Release 2026 R1 in den APAC- und Europa-Umgebungen betrifft. Infolgedessen wurden einige Inventar-Uploads nicht erfolgreich verarbeitet, was dazu führte, dass die in Flexera One IT Asset Management angezeigten Inventardaten verzögert wurden und nicht das zuletzt hochgeladene Kundeninventar widerspiegelten.
Priorität: P2
Restaurierungsaktivität: Technische Teams identifizierten ein kapazitätsbezogenes Problem, das sich auf die Bestandsverarbeitung auswirkte, und führten gezielte Serviceneustarts in den betroffenen Regionen durch, um die normale Verarbeitung wiederherzustellen. Der Service wurde am 24. Juni 2026 um 23:00 Uhr PDT wiederhergestellt, und die Inventardateien werden nun erfolgreich verarbeitet. Unsere Teams überwachen die Plattform weiterhin, um nachhaltige Stabilität zu gewährleisten. Ein Post-Mortem-Bericht, der die Ursache und die vorbeugenden Maßnahmen detailliert beschreibt, wird geteilt, sobald die Untersuchung abgeschlossen ist.
postmortem
**Beschreibung:** Flexera One- IT Asset Management- APAC & EU - NDI Inventory Import Failures
**Zeitrahmen:** 18. Juni 2026, 09:00 Uhr PDT bis 25. Juni 2026, 02:42 Uhr PDT
**Incident Summary**
Am Mittwoch, den 24. Juni 2026, 23:35 Uhr PDT, nach dem Einsatz des Flexera One IT Asset Management 2026 R1-Releases in den Produktionsumgebungen Australien und Europa haben unsere Teams ein Problem identifiziert, das die Verarbeitung von NDI-Inventardateien betrifft. Infolgedessen ist eine erhebliche Anzahl von Inventardateien während der Verarbeitung fehlgeschlagen und wurde nicht in den Kundeninventardaten berücksichtigt, wodurch die in Flexera One ITAM angezeigten Inventarinformationen für betroffene Kunden veraltet sind.
Die technischen Teams leiteten sofort eine Untersuchung ein und stellten fest, dass das Problem innerhalb des mit dem 2026 R1-Release eingeführten Inventarverarbeitungsworkflows aufgetreten war. Gescheiterte Bestandsdateien, die nach wiederholten Verarbeitungsfehlern gesammelt wurden, verhindern den erfolgreichen Abschluss von Bestandsaktualisierungen und tragen zu einer erhöhten Verarbeitungsbelastung der betroffenen Dienste bei.
Um den Service wiederherzustellen, implementierten die technischen Teams Korrekturmaßnahmen, indem sie die betroffenen Anwendungsdienste in den betroffenen Umgebungen aktualisierten. Nach den Restaurierungsaktivitäten wurde die Bestandsverarbeitung erfolgreich fortgesetzt und neue Inventar-Uploads wurden wie erwartet verarbeitet. Die fortgesetzte Überwachung bestätigte ein stabiles Plattformverhalten, und der Vorfall wurde nach einer nachhaltigen Validierung für behoben erklärt.
**Wurzelursache**
Das Problem wurde durch einen Defekt verursacht, der mit dem Flexera One IT Asset Management 2026 R1-Release eingeführt wurde und die Verarbeitung von NDI-Inventardateien beeinträchtigte. Unter bestimmten Bedingungen konnten Inventardateien aufgrund eines Problems im Authentifizierungs- und Verarbeitungsworkflow nicht erfolgreich verarbeitet werden, was dazu führte, dass die Dateien abgelehnt wurden, bevor die Verarbeitung abgeschlossen werden konnte.
Da ausgefallene Dateien akkumuliert wurden, wurde die Verarbeitungskapazität zunehmend durch wiederholte Fehler verbraucht, wodurch eine erfolgreiche Bestandsverarbeitung verhindert und Bestandsaktualisierungen für betroffene Kunden verzögert wurden.
Beitragende Faktoren
* Gescheiterte Bestandsdateien, die im Verarbeitungsworkflow angesammelt wurden, erhöhen die Ressourcenauslastung für betroffene Bestandsdienste.
* Die erhöhte Verarbeitungslast reduzierte die verfügbare Kapazität für neue Inventarverarbeitungsanforderungen.
* Das Problem betraf Produktionsumgebungen mit dem Release 2026 R1; North America Production war nicht betroffen, da das Release noch nicht bereitgestellt wurde.
**Abhilfemaßnahmen**
* Technische Teams identifizierten den betroffenen Inventarverarbeitungsworkflow und implementierten Korrekturmaßnahmen, um den Service wiederherzustellen.
* Anwendungsdienste wurden in den betroffenen Produktionsumgebungen aktualisiert und die normale Bestandsverarbeitung wiederhergestellt.
* Die Verarbeitung neuer Inventardateien wurde nach der Wiederherstellung des Dienstes erfolgreich wieder aufgenommen.
* Die Umgebung blieb unter einer verbesserten Überwachung, um die Verarbeitungsleistung zu validieren und eine nachhaltige Erholung zu bestätigen.
** Künftige Präventivmaßnahmen**
Verbesserte Release-Validierung - Release-Validierungsverfahren werden erweitert, um zusätzliche End-to-End-Tests von Inventarverarbeitungs-Workflows nach wichtigen Plattform-Releases aufzunehmen.
* Verbesserte Verarbeitungsüberwachung - Die Überwachung und Alarmierung wird überprüft und erweitert, um abnorme Fehler in der Bestandsverarbeitung und übermäßige Dateianhäufung in Verarbeitungswarteschlangen früher zu erkennen.
* Operationelle Resilienz - Zusätzliche Sicherheitsvorkehrungen werden innerhalb des Inventarverarbeitungsworkflows implementiert, um die Wiederherstellung von Verarbeitungsfehlern zu verbessern und die Auswirkungen auf den Kunden zu minimieren, sollten in Zukunft ähnliche Bedingungen auftreten.
* Code Qualität und Review Verbesserungen \(Abgeschlossen\) - Im Rahmen der Post-Incident-Überprüfung wurde der betroffene Code korrigiert, um sicherzustellen, dass Fehler in der Kommunikation angemessen behandelt werden und nicht zu breiteren Verarbeitungsauswirkungen führen. Darüber hinaus wurde der Entwicklungs- und Überprüfungsprozess verstärkt, um sicherzustellen, dass die Überprüfungsergebnisse angemessen bewertet und berücksichtigt werden, bevor zukünftige Änderungen zur Veröffentlichung genehmigt werden.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Flexera One – EU – Login Access Disruption
Beginn 24. Juni 2026 um 08:00 UTC · 1h 0m
OutageSchwerwiegender Vorfall
Betroffene Komponenten
IT Visibility EUIT Asset Management - EU Login PageIT Asset Management - EU Batch Processing SystemCloud License Management - EUIT Asset Management - EU Business ReportingIT Asset Management - EU Beacon CommunicationIT Asset Management - EU SaaS ManagerIT Asset Management - EU Inventory Upload
investigating
Incident Description: Wir haben ein Problem identifiziert, das den Login-Zugang zu Flexera One in der EU-Region betrifft. Kunden können Fehler beim Versuch erhalten, sich bei Flexera One anzumelden.
Priorität: P1
Wiederherstellungsaktivität: Unsere technischen Teams untersuchen das Problem aktiv und arbeiten daran, Korrekturmaßnahmen zu implementieren, um die normale Anmeldefunktion wiederherzustellen. Die Untersuchungs- und Stabilisierungsbemühungen gehen weiter.
Wir werden die Situation weiterhin genau beobachten und im weiteren Verlauf weitere Informationen bereitstellen.
resolved
Das Problem wurde behoben und die Anmeldefunktionalität für betroffene Kunden wiederhergestellt. Technische Teams identifizierten die Ursache des Problems und implementierten Korrekturmaßnahmen, um den normalen Servicebetrieb wiederherzustellen. Die Umgebung bleibt stabil, und die laufende Überwachung hat eine erfolgreiche Authentifizierung und den Zugriff auf die Plattform bestätigt. Ein Post-Mortem-Bericht mit zusätzlichen Details wird nach Abschluss der Untersuchung veröffentlicht.
postmortem
**Beschreibung:** Flexera One – EU – Login Access Disruption
**Zeitrahmen:** 24. Juni 2026, 12:41 Uhr PDT bis 24. Juni 2026, 02:04 Uhr PDT
**Incident Summary**
Am Mittwoch, den 24. Juni 2026, um 12:41 Uhr PDT haben unsere Teams ein Problem festgestellt, das Kunden in der EU-Region betrifft. Betroffene Benutzer erlebten Authentifizierungsfehler beim Versuch, sich bei Flexera One mit Single Sign-On (SSO) anzumelden, was zu Serverfehlern führte und den Zugriff auf die Plattform verhinderte.
Nach der Erkennung leiteten die technischen Teams sofort eine Untersuchung ein und bestätigten, dass das Problem im Authentifizierungsworkflow isoliert war. Die Validierung der Anwendung und der zugrunde liegenden Plattformdienste zeigte, dass die gesamte Kerninfrastruktur gesund und funktionsfähig blieb. Eine weitere Analyse ergab, dass ein Dienstkonto, das zur Kommunikation mit dem Identitätsanbieter verwendet wurde, nicht mehr verfügbar war, wodurch Authentifizierungsanforderungen fehlschlugen.
Das Servicekonto wurde umgehend wiederhergestellt, wodurch die normale Authentifizierungsverarbeitung wiederhergestellt und der Kundenzugriff vollständig wiederhergestellt wurde. Nach der Wiederherstellung wurde die Umgebung genau überwacht und die Anmeldefunktionalität umfassend validiert, um die Servicestabilität zu gewährleisten. Es wurden keine zusätzlichen Kundenauswirkungen beobachtet und der Vorfall wurde anschließend für behoben erklärt.
**Wurzelursache**
Das Problem wurde durch die unbeabsichtigte Sperrung eines Dienstkontos verursacht, das die Authentifizierung zwischen Flexera One und dem Identitätsanbieter unterstützt. Dadurch konnten Authentifizierungsanforderungen nicht erfolgreich bearbeitet werden, sodass betroffene Kunden in der EU-Produktionsregion nicht über Single Sign-On (SSO) auf die Plattform zugreifen konnten.
Beitragende Faktoren
* Ein Dienstkonto, das für den Authentifizierungsworkflow entscheidend ist, wurde während einer routinemäßigen Bereinigungsaktivität versehentlich gesperrt.
* Die Aussetzung verhinderte, dass Authentifizierungsanforderungen erfolgreich validiert wurden, was zu Anmeldefehlern für betroffene Kunden führte.
* Das Problem wurde vom Authentifizierungsdienst isoliert und hatte keinen Einfluss auf die Verfügbarkeit der zugrunde liegenden Anwendung oder Plattforminfrastruktur.
**Abhilfemaßnahmen**
* Das betroffene Servicekonto wurde wiederhergestellt und die Authentifizierung beim Identitätsanbieter wiederhergestellt.
* Die Login-Funktionalität wurde nach der Wiederherstellung validiert.
* Die Engineering-Teams überwachten weiterhin die Stabilität der Plattform und die erfolgreiche Kundenauthentifizierung.
** Künftige Präventivmaßnahmen**
* Service Account Governance - Prozesse, die kritische Service Accounts regeln, werden gestärkt, um das Risiko von unbeabsichtigten Änderungen bei Produktionsdienstleistungen zu verringern.
Verbesserte Überwachung - Die Überwachung und Alarmierung wird verbessert, um Authentifizierungsfehler, die sich auf die Anmelde-Workflows der Kunden auswirken, früher zu erkennen.
* Betriebsverbesserungen - Unsere Teams haben dies als Lektion dokumentiert und werden Prozessverbesserungen implementieren, um die Wahrscheinlichkeit ähnlicher Vorfälle zu reduzieren.
Automatisch aus der offiziellen Störungsmeldung übersetzt.
Snow Atlas - Westeuropa - Service Disruption
Beginn 18. Juni 2026 um 15:33 UTC · 2h 35m
OutageKritischer Vorfall
Betroffene Komponenten
Snow Atlas - Europe
monitoring
Vorfallbeschreibung: Wir hatten ein Problem mit Schneeatlas in der westeuropäischen Region.
Während des Incident-Fensters sind möglicherweise Fehler aufgetreten, die den Zugriff auf die Plattform verhinderten und die Funktionalität beeinträchtigten.
Priorität: P1
Restaurierungsaktivität: Der Service wurde wiederhergestellt und ist derzeit stabil. Unsere technischen Teams untersuchen weiterhin eine Störung der zugrunde liegenden abhängigen Dienste in der Region. Die Bemühungen konzentrieren sich auf die Gewährleistung von Stabilität und die Verhinderung von Wiederholungen. Wir werden weiterhin genau beobachten und Updates bereitstellen, sobald mehr Informationen verfügbar sind.
resolved
Das Problem, das Snow Atlas in der westeuropäischen Region betrifft, wurde behoben, und der Service funktioniert derzeit normal. Unsere technischen Teams haben die zugrunde liegende Service-Instabilität gemildert und überwachen weiterhin genau, um eine nachhaltige Stabilität zu gewährleisten. Wir werden einen detaillierten Bericht nach dem Vorfall vorlegen, in dem die Ursache und die Präventionsmaßnahmen in den kommenden Tagen dargelegt werden.
postmortem
**Beschreibung:** Snow Atlas - Westeuropa - Service Disruption
**Zeitrahmen:** 18. Juni 2026, 07:00 Uhr PDT bis 18. Juni 2026, 08:23 Uhr PDT
**Incident Summary**
Am Donnerstag, den 18. Juni 2026 um 07:00 Uhr PDT erlebten Kunden in der westeuropäischen Produktionsregion eine Servicestörung, die den Zugang zu Snow Atlas beeinträchtigte. Während dieses Service-Events stießen Benutzer auf HTTP 504-Timeout- und HTTP 404-Fehler, die den Zugriff auf die Plattform verhinderten und die Nutzung der Snow Atlas-Funktionalität beeinträchtigten.
Nach der Erkennung leiteten die technischen Teams sofort eine Untersuchung ein und identifizierten das Problem innerhalb einer zentralen Plattformkomponente, die für die Kommunikation zwischen Backend-Diensten verantwortlich ist. Die Degradation unterbrach die Service-Interaktionen, was zu Anforderungsausfällen und vorübergehender Nichtverfügbarkeit führte.
Die betroffenen Messaging-Komponenten wurden wiederhergestellt, sodass abhängige Dienste wiederhergestellt und der normale Plattformbetrieb wieder aufgenommen werden konnte. Nach der Wiederherstellung bestätigten umfangreiche Validierungsaktivitäten, dass die Servicefunktionalität vollständig wiederhergestellt wurde. Die Umgebung blieb unter verbesserter Überwachung stabil, es wurden keine weiteren Auswirkungen auf den Kunden beobachtet und die Serviceunterbrechung wurde formell behoben.
**Wurzelursache**
Die Serviceunterbrechung entstand durch einen unerwarteten Fehler innerhalb einer Kernplattformkomponente, die die Kommunikation zwischen Backend-Diensten erleichtert. Während der Veranstaltung wurden mehrere Messaging-Komponenten gleichzeitig nicht verfügbar, wodurch die kritische Kommunikation zwischen Backend-Diensten, die für die Verarbeitung von Kundenanfragen verantwortlich sind, verhindert wurde.
Die Verschlechterung beeinträchtigte die Fähigkeit der abhängigen Dienste, Anfragen auszutauschen und zu verarbeiten, was zu Timeouts und Routingfehlern führte. Infolgedessen hatten Kunden in der betroffenen Region Schwierigkeiten, auf die Snow Atlas-Plattform zuzugreifen, bis die Servicekommunikation wiederhergestellt und der normale Betrieb wieder aufgenommen wurde.
Beitragende Faktoren
* Mehrere Messaging-Service-Komponenten wurden gleichzeitig nicht verfügbar, wodurch die Fähigkeit der Plattform, die Kommunikation zwischen den Diensten zu verarbeiten, verringert wurde.
* Service-Kommunikationsfehler breiten sich über abhängige Plattformkomponenten aus, was zu HTTP 504-Timeout- und HTTP 404-Fehlern führt.
* Das Problem betraf die Shared-Messaging-Infrastruktur, die die westeuropäische Produktionsumgebung unterstützt, was zu weit verbreiteten Auswirkungen auf die Kunden in der Region führte.
**Abhilfemaßnahmen**
* Die technischen Teams identifizierten die betroffenen Komponenten der Messaging-Infrastruktur und stellten den normalen Servicebetrieb wieder her.
* Abhängige Plattformdienste wurden automatisch wiederhergestellt, da die Messaging-Funktionalität wiederhergestellt wurde.
* Die Servicefunktionalität wurde nach der Wiederherstellung validiert, um den erfolgreichen Kundenzugang zu bestätigen.
* Die verbesserte Überwachung wurde nach der Wiederherstellung beibehalten, um die anhaltende Stabilität der Plattform zu überprüfen.
** Künftige Präventivmaßnahmen**
* Problem Management Review – Eine umfassende Überprüfung ist im Gange, um die Ursache weiter zu validieren und langfristige Korrekturmaßnahmen zu identifizieren, um ein Wiederauftreten zu verhindern.
* Platform Resiliency Enhancements – Chancen zur Stärkung der Resilienz der Messaging-Infrastruktur der Plattform werden bewertet, um die Auswirkungen von Fehlern auf Komponentenebene auf die Serviceverfügbarkeit zu reduzieren.
Verbesserungen bei der Überwachung und Erkennung – Die Überwachungs- und Alarmierungsfunktionen für kritische Plattformkomponenten werden verbessert, um eine frühere Erkennung von Degradation zu ermöglichen und die Reaktions- und Wiederherstellungsbemühungen zu beschleunigen.
Automatisch aus der offiziellen Störungsmeldung übersetzt.