米国のエラーレポーティングAPIの関連する障害率
- resolved
19:54 と 20:07 UTC の 8 月 15 日、US のエラー報告 API へのリクエスト (api.honeybadger.io) は、高い故障率を経験しました。 このウィンドウでは、エラーやイベントをタイムアウトまたは受信するリクエストの大部分が5xx応答を送信します。 ブラウザ(JavaScript)エラーレポート、ソースマップのアップロード、ハネバッガーウェブアプリケーション、ダッシュボード、稼働時間監視、およびEU地域は影響を受けていません。 何が起こったのか: 19:54 UTCで始まり、単一のソースは、約150倍の正常な速度でエラーレポートを提出し始め、ペイロードは平均よりも数倍大きい。 これは、私たちの摂取層に到着したデータの総量を1分以内に飽和させる倍以上のものです。 飽和サービスは、エラーアウトライトではなく、接続を受け付け続けたため、エラー応答を監視する自動スケーリングと警告 — 問題を迅速に登録しませんでした。また、問題が発生したよりも、容量が後で追加されました。 追加容量がオンラインで来れば20:07 UTCで回復サービス。 ほとんどの影響を受けたレポートは、APIが回復した後、クライアントライブラリによって正常に取得されたため、ウィンドウ中に送信された大量のデータが最終的に受信されました。 再試行ロジックなしでライブラリによって送信されたレポートは受信されず、復元できません。 私たちがやったこと:私たちのインジェクション層は、エラーレートに加えて、応答レイテンシをスケールアップしました。そのため、この種の飽和は、一度だけエラーが表示されるのではなく、分または2分以内に検出されます。 また、tierのベースライン容量を上げ、サーバーのエラーとして表面しない故障をカバーするために、当社のメッセージングアラートを広めました。 単一のソースが送信できるデータ量に制限を追加しています。 中断を申し立ててお詫び申し上げます。また、ウィンドウ中のエラーデータに生じたいかなるギャップについてもお詫び申し上げます.
公式のインシデント更新を自動翻訳しています。