Потенциал некоторых пропущенных сообщений для подписчиков в US East PoP
- investigating
По состоянию на 12:15 UTC, пользователи в нашем Восточном PoP США в настоящее время испытывают проблемы с сервисом Publish and Subscribe, что приводит к тому, что некоторые сообщения не появляются в звонках на этот сервис. Никакие ошибки не возвращаются из сервиса, несмотря на то, что сообщения не возвращаются правильно. Мы расследуем этот вопрос.
- monitoring
По состоянию на 13:55 UTC проблема, затрагивающая услуги публикации и подписки в Восточном ПоП США, была смягчена. Синтетический мониторинг вернулся в норму, и никаких пропущенных сообщений обнаружено не было. В настоящее время считается, что инцидент был связан с провалом мониторинга. Продолжается дальнейшее расследование, и служба продолжает находиться под пристальным наблюдением.
- resolved
После того, как в течение последних 30 минут не было никаких дальнейших проблем, инцидент был решен. В ближайшее время мы проведем анализ первопричин. Если вы считаете, что испытали воздействие, связанное с этим инцидентом, пожалуйста, сообщите об этом в службу поддержки PubNub по адресу [email protected].
- postmortem
###** Описание проблемы, влияние и решение** Во вторник, 25 августа 2026 года, в 12:10 UTC, наш внутренний мониторинг предупредил нас о проблеме, когда очень небольшое подмножество сообщений в пределах одной зоны доступности одного региона может не быть немедленно доставлено абонентам в том же регионе. Все сообщения обычно сохранялись в службе PubNub Persistence, поэтому данные сообщений не были потеряны. Трафик в или из любого другого региона или АЗ не был затронут, и никакие другие услуги PubNub не были затронуты. Клиенты не сообщили о воздействии. ###*Корневая причина** В ходе планового внутреннего нагрузочного тестирования была удалена группа внутренних серверов маршрутизации. Из-за недостатка конфигурации их сетевые адреса не были полностью удалены и оставались кэшированными на нашем уровне публикации. По большей части это не представляло проблем. Однако впоследствии один адрес был переназначен на несвязанный внутренний компонент, который обычно отвечал по одному и тому же протоколу и порту. Поскольку этот ответ оказался успешным, издательский уровень не получил ошибки, и сообщения, отправленные на этот адрес, были неправильно маршрутизированы. Перезапуск затронутых серверов очистил устаревшие адреса в 13:25 UTC. Смягчение мер и рекомендуемые будущие превентивные меры После того, как затронутые серверы были идентифицированы, был выполнен перезапуск для очистки устаревших адресов маршрутизации. После расследования, которое подтвердило первопричину, исправление, обеспечивающее правильное удаление устаревших внутренних адресов маршрутизации, было развернуто на всех издательских серверах по всему миру 25 августа 2026 года в 22:00 UTC.
Автоматический перевод официального обновления инцидента.