已降解的遥测性能
- investigating
遥测仪表板可能无法为一些客户提供 因为一个数据库问题,我们正在调查.
- resolved
此事已经解决, 我们为这起不雅事件表示歉意.
自动翻译自官方事件更新。
39 Better Uptime incidents · 2023年2月 — official updates, affected components, duration and resolution details.
遥测仪表板可能无法为一些客户提供 因为一个数据库问题,我们正在调查.
此事已经解决, 我们为这起不雅事件表示歉意.
自动翻译自官方事件更新。
We'll be migrating some Telemetry sources to new, more robust infrastructure. Each source will be affected for no more than 90 minutes. During the migration there may be brief gaps in dashboard charts and delayed Live tail data. Queries through the SQL Connections API may briefly return an error rather than incomplete results. Please reach out to us at [email protected] if you have any questions.
目前我们正经历一些关于遥测源配置变化和创建新源的问题. 查询和摄取不受影响。 我们正在调查.
这个问题现已解决,所有来源和配置的更新现在应如所期望的那样予以传播.
自动翻译自官方事件更新。
我们的AWS直接连接传输基础设施目前处于停用状态;这可能造成数据摄入的延误或失败.
造成这一问题的网络问题已经得到解决.
自动翻译自官方事件更新。
目前我们正面临一个基础设施问题,它正在影响我们欧洲区域的一些客户查询.
基础设施问题已经解决.
自动翻译自官方事件更新。
我们正在调查一些瞬间错误 影响我们Uptime平台的性能 我们为不便感到非常抱歉.
我们已经解决了Uptime性能退化的问题.
自动翻译自官方事件更新。
我们正在缓解。 需要帮忙吗? 以 Hello@ betterstack.com 通知我们
我们的DDoS保护成功地缓解了这次袭击。 诚恳地为不便道歉. 需要帮忙吗? 在[email protected]上告诉我们.
自动翻译自官方事件更新。
我们的CDN供应商之一Bunny CDN正在他们位于英国的PoP上遇到一个软件错误。 我们与他们保持联系,这个问题应该在几分钟内解决. 我们为不方便而道歉。 如果您急需使用仪表盘,请使用VPN连接到任何美国地点. 谢谢.
兔子CDN解决了这个问题。 我们为不方便而道歉.
自动翻译自官方事件更新。
目前我们正看到美国东组的一些来源的数据处理被延迟。 根本原因已经解决;然而,所有历史数据在Live尾巴中完全出现可能需要一些时间. 请注意,**没有数据丢失**——所有输入的数据被摄入,随着系统追上,将变得可视. 如果你有任何问题,请在 ** [[email protected]] (mail:[email protected]) ** 上自行联系.
早先影响我们美国东方集群某些来源的拖延已经完全得到解决。 所有数据现已处理完毕,可见于Live尾部,**无数据丢失**. 如有任何问题,请与我们联系,地址是:**[[email protected]](mail:[email protected])**.
自动翻译自官方事件更新。
我们的eu-nbg-2组群中, 收到的数据正在被摄取,但某些来源的处理可能被拖延,一些查询也可能失败或返回不完整的结果。 我们的工程小组正在积极开展这方面的工作,积压的工作已在减少,我们预计不久将全面恢复。 我们一有更新.
Eu-nbg-2中的查询问题现在大多得到解决. 摄入滞后也同时完全赶上,数据正在按预期处理。 我们继续密切监测集群, 并审查摄取管道, 感谢您的耐心!
自动翻译自官方事件更新。
目前我们正面临一个问题, 我们的后端服务、监测基础设施、API和警报已经全面投入使用——然而,Cloudflare正在经历全球停电,影响航道和阻止我们的仪表板装载。 您可以在此追踪上游事件:https://www.cloudflarestatus.com/incicents/8gmgl950y3h7 我们正积极监测情况, 一旦云浮解决了他们的路线问题, 所有核心功能——检查、心跳、警报、日志摄取和度量仪——继续正常地在背景中运作。 谢谢你的耐心
Better Stack UI现在大多可以再次访问,许多用户应该能够正常地加载仪表板. Cloudflare的全球停电仍在继续,虽然他们的网络变得更加稳定,但断断续续的路由问题可能会继续. 这意味着随着情况完全恢复,您仍然会偶尔看到加载缓慢或出错率升高的情况。 我们继续监控上游事件.
Cloudflare主要解决了与其全球停电有关的基本路线问题,其系统现在正常运行. 随着他们的网络稳定,"更好的堆栈UI"和所有相关服务再次被完全开放. 我们这边的一切现在都按预期运行,我们不再看到错误率高或性能下降。 我们将继续监视局势, 如果你有任何问题或发现任何异常情况, 谢谢你在整个事件中的耐心
自动翻译自官方事件更新。
目前我们看到时断时续的超时问题, 第一批错误开始于协调世界时下午1点55分左右出现,有些请求在多个地区没有回复。 并很快分享最新消息.
暂停问题现已解决。 我们于协调世界时下午2点15分左右实施缓解措施,受影响状态页面重新开始正常反应。 非常感谢你耐心地对待我们.
我们发现, 一小部分自定义状态页面在协调世界时下午2点15分的初始修复后并未完全恢复。 其中一些页面现在遇到了与SSL相关的错误,例如证书验证失败或超时,因为内部组件在早先中断后表现不正确. 我们继续调查.
我们解决了一个问题, 问题涉及证书处理工作流程,这暂时阻碍了某些页面获得或刷新其SSL证书. 所有受影响的页面现在都在正常地装入. 非常感谢你的耐心和理解。 请在[email protected]上通知我们.
自动翻译自官方事件更新。
由于AWS持续停用,我们看到我们的电子邮件发送服务错误率上升。 因此,一些通知邮件可能会被延迟. 超时监测和数据处理工作已全面展开.
电子邮件发送恢复正常.
自动翻译自官方事件更新。
造成数据摄入延迟。 我们的小组正同提供方积极合作,以尽快解决这一问题。 只要我们掌握更多细节, 谢谢你的耐心 在我们努力让一切恢复正常的时候.
我们的网络大部分现已恢复;请在插入任何延迟数据时与我们一起承受,并恢复全部查询功能.
这一问题已经解决;所有待决数据均已被吸收,查询工作已全面展开.
自动翻译自官方事件更新。
我们正调查一个问题, 数字海洋通过RSyslog发送的日志没有到达摄入端点。 这是在旧的Rsyslog来源按计划迁移到我们的新云基础设施之后开始的,而且似乎只是影响了数字海洋平台。 我们正与数字海洋团队合作.
数字海洋的DNS记录似乎还没有更新, 这造成日志摄入不兼容和暂时得不到。 我们正积极与数字海洋团队合作解决这个问题。 我们很快会分享更多细节.
我们在数字海洋和更好的堆栈之间发现了一个DNS分辨率的问题。 现在这个问题已经解决,现在正在正常处理日志.
自动翻译自官方事件更新。
一些客户在日志摄入方面再次出现延误和查询性能更慢. 我们对一再中断表示诚挚的歉意。 我们的小组正在积极努力查明根源,并将在我们获得更多信息后立即提供进一步的最新资料。 谢谢你的耐心和理解.
这个问题现已得到解决。 对所有受影响的客户来说,日志摄取延迟和查询性能已恢复正常。 我们为一再中断道歉 并感谢你在我们努力恢复服务时的耐心 我们的小组继续密切监测局势,以确保目前的稳定。 如果你继续遇到任何问题 请马上联系我们.
自动翻译自官方事件更新。
一些客户再次遇到日志摄入延迟和查询性能较慢的问题. 我们对此事件再次发生表示歉意,并理解其破坏力有多大。 我们的团队正在积极调查根本原因, 感谢你的耐心和理解!
这个问题现已得到解决。 日志摄入和查询性能现在稳定. 我们再次为这种干扰表示歉意,并感谢你在我们处理这种重犯时的耐心。 如果你发现有问题 请立刻联系我们.
自动翻译自官方事件更新。
目前我们正在调查零星的日志摄取延迟的报告, 我们的工程团队正勤奋地努力查明原因,并尽快使系统恢复正常速度. 我们一有更多信息, 就会分享最新消息!
这个问题已经得到解决。 日志摄取和查询性能已恢复正常. 谢谢你的耐心 在我们努力处理这个事件时 如果你继续遇到任何问题.
自动翻译自官方事件更新。
我们知道有报道说, 记录摄取时有间歇性延误, 且查询表现慢于正常, 我们的工程队正积极调查根源,并努力尽快恢复全部工作. 感谢您的耐心!
我们找出并解决了问题的根源。 日志摄入延迟被清除,查询性能已恢复正常. 如果你继续遇到任何问题,请在`[email protected]'与我们联系。 谢谢你的耐心!
自动翻译自官方事件更新。
目前,我们正在调查一个造成记录摄入间歇性延误和一些客户查询性能缓慢的问题。 我们的工程队正在努力尽快恢复全部服务. 一旦有更多细节 我们会通知你 谢谢你的耐心!
查询性能恢复正常,所有被延迟的日志现在都被摄入;没有丢失数据. 我们继续监控这个系统, 谢谢你的耐心和与我们相处 如果你看到任何遗留问题,请在`[email protected]'上告诉我们.
自动翻译自官方事件更新。