Sprites API の部分的な Outage
- investigating
Sprites ユーザーのサブセットに影響を与える問題を認識しています。 問題の発生源を調査しています.
- monitoring
エラー率が減少しました。 APIヘルスを継続的に監視しています.
- resolved
この事件は解決しました.
公式のインシデント更新を自動翻訳しています。
104 Flyio incidents · 2026年4月 — official updates, affected components, duration and resolution details.
Sprites ユーザーのサブセットに影響を与える問題を認識しています。 問題の発生源を調査しています.
エラー率が減少しました。 APIヘルスを継続的に監視しています.
この事件は解決しました.
公式のインシデント更新を自動翻訳しています。
LAXでは、上流ネットワークの問題が起きています。 一部の目的地への接続では、レイテンシーとパケットロスが上昇する場合があります。 私たちは、この問題を解決するために、上流に取り組んでいます.
弊社では、当社提供者との間で臨時の緩和措置を講じています。 しかし、この問題の根本的な原因は、上流のトランジットプロバイダ内にあるため、影響を受けた地域におけるレイテンシーや接続の問題が引き続き確認されることがあります。 根本的な原因を解決するために、引き続き密接に取り組んでいます.
影響を受けた地域リストを更新し、米国の西海岸でより広い上流問題となっているため、SJC も含まれています.
修正を実装し、結果を監視しています.
この事件は解決しました.
公式のインシデント更新を自動翻訳しています。
API のバックグラウンド・ジョブ・ランナーの問題について調査しています。 アプリの作成、IPアドレスの割り当て、証明書の作成/更新などのバックグラウンドジョブが必要なアクションは、この時点で失敗する可能性があります.
修正を実装し、結果を監視しています.
この事件は解決しました.
公式のインシデント更新を自動翻訳しています。
設定更新により、ホストのサブセットにある Fly Machine 用の HTTP/2 トラフィックの受信が一時的に失敗しました。 この事件は、この事件を解決しました。 管理されたpostgresはHTTP/2に依存し、一部の制御面のopsも影響を受けている可能性があります。 しかしながら、HTTP2ハンドラを使用しないため、下流のPostgres接続はこれによって影響を受けていないとは違っていました.
公式のインシデント更新を自動翻訳しています。
上流プロバイダーにより、ORD のホストのサブセットで~50%のパケット損失が見られます。 ORD の MPG クラスターによっては、結果として再計算が遅くなります.
ORDのパケットロスは改善され、影響を受けたサービスが回復しています。私たちは断続的な問題の監視を続けています
この事件は解決しました.
公式のインシデント更新を自動翻訳しています。
21:18 と 22:05 UTC の間に失敗した Sprite の削除ジョブを見ました。 この問題は解決しました.
公式のインシデント更新を自動翻訳しています。
GRU(サンパウロ、ブラジル)地域におけるいくつかのホストに影響を及ぼすネットワークの問題について調査しています。 GRUのアプリによっては、レイテンシーやパケットロスが増加する可能性があります.
GRUのネットワーク性能は正常化しており、問題が見つかりません。 完全な回復を保障するために私達は監視し続けます.
GRUではネットワークの問題点を明らかにしています。 地域内の一部のアプリでは、レイテンシーやパケットロスが増加する可能性があります。 弊社では、上流のネットワークプロバイダと連携して解決しています.
上流プロバイダが修正を実施しました。 GRUのネットワーク性能は正常化しています.
この事件は解決しました.
公式のインシデント更新を自動翻訳しています。
現在、この問題を調査中です.
この事件は解決しました.
公式のインシデント更新を自動翻訳しています。
WireGuardゲートウェイの課題を調査しています。 "flyctl ssh console` や `flyctl proxy` などの CLI コマンドは、この時に動作しません。 アプリは引き続き実行されます.
修正を実装し、結果を監視しています.
私たちのテストと監視は、ゲートウェイが正常に戻るべきであることを示しています。 `flyctl ssh コンソールを使用してまだ問題がある場合、 `flyctl` エージェントを `flyctl` エージェントを `bootl` で再起動してみてください.
この事件は解決しました.
公式のインシデント更新を自動翻訳しています。
現在、一部の地域でサーバーにいくつかのメトリックの遅延が発生しています。 バックログとキャッチアップに対応するメトリック処理のインスタンスをさらにプロビジョニングしています.
すべてのホストはメトリクスで捕捉され、状況を監視しています
解決しました
公式のインシデント更新を自動翻訳しています。
ロサンゼルス地域におけるネットワーク問題の調査を行っています。 アプリは、より高いレイテンシを経験したり、この時点で到達不能である可能性があります.
ネットワーク上の問題が解決しました.
この事件は解決しました.
公式のインシデント更新を自動翻訳しています。
Anycast DNS が、適切な DNS インフラストラクチャなしで一部のノードにルーティングする BGP 構成エラーが発生しました。 問題は一時的なもので、BGPからそのノードを削除した直後に解決されました.
公式のインシデント更新を自動翻訳しています。
認証エラーを「flyctl」から特定しました。 これらの操作は、次のようなエラーで失敗します。 `このエンドポイントは、レガシーの OAuth トークンを受け入れなくなり (`fo1 ` で開始)。 代わりにmacaroonトークン(`fm2 `)を使用してください。 問題を識別し、修正を転がしている
修正が展開され、このエラーは発生しなくなる。 完全な回復を保障するために私達は監視しています.
この事件は解決しました.
公式のインシデント更新を自動翻訳しています。
私たちは、ord-0 Fly Kubernetesクラスターと問題があり、多くのMPGクラスターは再起動に失敗しています。 当社のMPGチームは積極的に取り組んでいます.
今後もこの問題について調査を続けてまいります.
修正を実装し、結果を監視しています.
この事件は解決しました.
公式のインシデント更新を自動翻訳しています。
6PN は、エラーに気づいたときにロールアウトされた状態で YYZ のマシン間で問題をネットワーク化します。 今回は、他のDB、その他のアプリ、MPGクラスターなどの内部リソースに触れることができないマシンもあります.
公式のインシデント更新を自動翻訳しています。
容量が不足しているため、ARNで新しい機械が作成できないことがあります.
ARN領域の容量問題が解決しました.
公式のインシデント更新を自動翻訳しています。
未導入後の秘密サービスを回復するために取り組んでいます。 アプリは続行しますが、この時点で新しいアプリを作成したり、シークレットを更新したりすることはできません.
We have failed over the secrets database to a replica, and the Machines API appears healthy now. We are monitoring for any further issues.
This incident has been resolved.
公式のインシデント更新を自動翻訳しています。
We are currently investigating degraded ipv6 networking on a subset of hosts
We are continuing to investigate this issue.
The issue has been identified and a fix is being implemented.
A fix has been implemented and we are monitoring the results.
We are continuing to monitor for any further issues.
This incident has been resolved.
We are currently investigating app-not-found errors returned by Machines API calls made shortly after creating new applications.
We have identified the issue as failed insertions in a subset of Corrosion batches. These failures trigger retries, which can cause timeouts for other batches.
We’ve applied a mitigation to reduce the impact from Corrosion batch insertion retries and are continuing to monitor while affected nodes catch up.
We’ve deployed an additional mitigation to further reduce Corrosion retry pressure and are seeing improvement; we’re continuing to monitor while remaining affected nodes catch up.
A fix has been implemented and we are monitoring the results
This incident has been resolved.
High CPU pressure on a shared etcd instance is causing lags on MPG creation in the IAD region
Etcd is stable. Services are back to normal.