Сейсмограф интернета: как Downdetector узнает о сбоях раньше компаний

Когда падает крупный сайт или мессенджер, первые пользовательские сигналы нередко появляются раньше официального подтверждения компании. На графике Downdetector в это время уже растет число жалоб. Сервис не подключен к серверам компаний и не тестирует их сам, он просто он анализирует пользовательские сигналы. 

Разбираемся, как платформа, придуманная за один вечер двумя голландцами, превратилась в главный сейсмограф интернета, почему ее метод математически уязвим и при чем тут продажа за 1,2 млрд долларов.

Когда падает крупный сайт или мессенджер, первые пользовательские сигналы нередко появляются раньше официального подтверждения компании.

Немного истории

Идея сервиса родилась в феврале 2012 года в баре города Харлем в Нидерландах — в этот день Том Сандерс, главный редактор издательства IDG, и Сандер ван де Грааф, разработчик того же издательства, обсуждали как повысить оперативность публикации инфоповодов о сбоях. Читатели регулярно звонили в редакцию с сообщениями о том, что у банка или провайдера не работает сайт, а пресс-службы отвечали на запросы журналистов часами или не отвечали вовсе. Коллеги задались вопросом, можно ли автоматизировать сбор таких сигналов и получать данные напрямую, минуя пресс-службы.

Прототип был собран за один вечер. Сервис запустился в апреле 2012 года и сначала покрывал только Нидерланды, местные банки, компании и мобильных операторов. Через год в него добавили Германию, а уже к концу третьего года работы карта разрослась до 21 страны. Все это время в компании числилось ровно два сотрудника, оба основатели. 

В августе 2018 года Downdetector приобрела группа j2 Global и включила сервис в Ookla, владельца Speedtest. Сандерс ушел из Ookla в 2020 году, а Сандер ван де Грааф продолжал работать над Downdetector еще несколько лет, но позднее также покинул Ookla. 

В марте 2026 года Ziff Davis договорилась продать Accenture все подразделение Connectivity, куда входили Ookla, Speedtest, Downdetector, Ekahau и RootMetrics, за $1,2 млрд. Сделка закрылась 17 июня 2026 года. 

Откуда детекторы узнают о проблемах

Как работает Downdetector

Сервис не мониторит сайты в классическом смысле — у него нет армии ботов, которые пингуют серверы каждую минуту. В документации сервиса отдельно описаны два механизма: 

  • Жалобы пользователей. Человек, у которого не открывается приложение банка, заходит на страницу этого банка, нажимает «У меня проблема» и выбирает тип неполадки из заранее заданного списка. Такие варианты называются индикаторами и настраиваются для каждой компании отдельно. Для банка это вход в приложение, переводы, оплата картой, а для игровых сетей это вход в аккаунт, матчмейкинг, покупки. Вместе с жалобой система фиксирует дату, время и страну.
  • Наплыв посетителей на страницу статуса компании. Если на страницу мессенджера, которую обычно открывают сто человек в час, за пять минут зашли десять тысяч, люди явно что-то ищут. Downdetector умеет учитывать и такой косвенный шум, хотя детали механизма не раскрывает и называет его собственной разработкой.

Раньше Downdetector также прямо указывал, что анализирует сообщения в Twitter с помощью анализа тональности. 

Однако «голые» жалобы на сбой еще ничего не значат. Десять сообщений о проблемах для небольшого интернет-магазина — это катастрофа, а для WhatsApp* — фоновый шум. Ядро механики Downdetector — это не сбор жалоб, а их сравнение с нормой.

Основная версия сайта Downdetector 
Основная версия сайта Downdetector

Для каждого отслеживаемого сервиса вычисляется базовый уровень — среднее количество жалоб для конкретного времени суток, измеренное за последние шесть месяцев. Ночью жалоб меньше просто потому, что люди спят, и система это понимает. Инцидент фиксируется только тогда, когда поток жалоб значимо превышает базовый уровень именно для этого конкретного часа.

Дальше срабатывает трехступенчатая шкала:

  • нет проблем, доказательств инцидента нет или они слабые;
  • возможные проблемы, умеренные доказательства, которые держатся достаточно долго;
  • проблемы, сильные доказательства, устойчивые во времени.

Ключевая деталь здесь в словах про длительность — статус зависит не только от высоты всплеска, но и от того, как долго он держится. Так работает защита от случайных выбросов. Система пересчитывает статус каждой компании каждые четыре минуты.

Есть и защита от многократных жалоб одного пользователя. Downdetector ограничивает частоту, с которой повторные сообщения одного человека попадают в публичный счетчик. Дополнительные отчеты система все равно сохраняет и может использовать во внутреннем анализе. Комментарии под страницей, которые обслуживает внешняя система Disqus (дискус), в расчет не берутся вовсе.

Сегодня через сервис проходят десятки миллионов жалоб в месяц на больше 35 тыс. сервисов в 72 странах, у каждой страны есть свой сайт. Один лишь корпоративный продукт Downdetector Explorer обрабатывает свыше 25 млн пользовательских сообщений ежемесячно.

Так выглядит сбой Spotify в 2022 году // Источник: Ookla
Так выглядит сбой Spotify в 2022 году // Источник: Ookla

Помимо бесплатного пользовательского сайта, у Downdetector есть корпоративная линейка Explorer с подпиской, API, историческими данными, алертами и инструментами коммуникации. 

Как работает Detector404 — российский аналог Downdetector

В России работает независимый сервис Detector404 с похожей задачей, но другой методикой. Помимо пользовательских жалоб, он использует сетевую телеметрию и активные проверки собственными сенсорами. Сам сервис подчеркивает, что опубликованные данные не являются официальным подтверждением сбоя.

Российская версия Downdetector — detector404.ru 
Российская версия Downdetector — detector404.ru

Сам сервис подчеркивает, что опубликованные данные не являются официальным подтверждением сбоя.

Как сервис понимает местоположение сбоя

Для жалобы Downdetector определяет примерное местоположение по IP через MaxMind GeoIP. На мобильных устройствах при разрешении пользователя сервис может получить более точные данные о местоположении. Из этого складывается тепловая карта сбоев, где концентрация жалоб видна до уровня города.

География решает и обратную задачу. Если пользователь из Берлина зашел на сайт другой страны и пожаловался на местный сервис, его сообщение засчитывается не той стране, чей сайт он открыл, а его реальному местоположению. Если сервис в этой стране не отслеживается, жалоба сохраняется в базе, но публично не показывается.

Карта жалоб оказалась полезна не только для диагностики. По характеру пятен на ней можно угадать природу аварии еще до официальных объяснений. Например, локальное пятно над одним городом говорит о проблеме у регионального провайдера, а равномерный румянец над всей страной намекает на сбой самого сервиса. В свою очередь, одновременное свечение у нескольких не связанных между собой компаний выдает падение общего подрядчика, облачной платформы или CDN.

Карта жалоб на Facebook* над Европой // Источник: UNIAN
Карта жалоб на Facebook* над Европой // Источник: UNIAN

Почему Downdetector иногда ошибается

У метода есть встроенная математическая слабость, и рассказ о сервисе без нее неполон. Downdetector знает числитель, количество пожаловавшихся, но не знает знаменатель, общее число пользователей сервиса в этот момент. А без знаменателя нельзя посчитать реальную долю сбоев.

Возьмем интернет-магазин с тысячей посетителей в день, из которых жалуется один человек. В черную пятницу посетителей сто тысяч и жалоб сто — доля недовольных та же самая, один процент. Такой всплеск может выглядеть для системы как признак инцидента, хотя доля недовольных пользователей не изменилась. Скользящий базовый уровень со временем адаптируется к изменению обычного потока жалоб, но напрямую на текущее число активных пользователей он не нормируется. 

Вторая слабость это каскад. Когда падает действительно крупный сервис, люди массово идут проверять все подряд, включая совершенно здоровые сайты. Их страницы на Downdetector получают всплеск посещений и жалоб, и система может пометить их как пострадавших. 

Так произошло в феврале 2022 года, когда всплеск жалоб на Slack, работавший на инфраструктуре AWS, был частью аудитории воспринят как сбой самого облака Amazon. Компания заявила, что никакого инцидента не было, и оказалась права. Ookla тогда признала, что пользователи ошибочно приписали облачному провайдеру проблему его клиента.

Из этого следует, что Downdetector показывает не состояние серверов, а состояние толпы. Всплеск это сильная улика, но не приговор, и опытные наблюдатели всегда сверяют его с официальными статус-страницами и картой географии жалоб.

Рекордные дни сейсмографа

Предельное испытание система прошла 4 октября 2021 года, когда примерно на шесть часов ушли в офлайн Facebook*, Instagram*, WhatsApp* и Messenger*. Причиной стала ошибка в конфигурации BGP-маршрутов, из-за которой DNS-серверы компании стали недостижимы для всего интернета. Жалобы на Downdetector начали расти через считанные минуты после начала сбоя. 

К вечеру счетчик перевалил за 10,6 млн сообщений, а к концу инцидента, по подсчетам Ookla, превысил 14 млн. Это до сих пор крупнейший сбой в истории наблюдений сервиса. Больше всего жалоб пришло из США — свыше 1,7 млн, дальше шли Германия с 1,3 млн и Нидерланды с 915 тысячами.

Характерный побочный эффект того дня показывает, насколько Downdetector встроен в рефлексы пользователей. Люди, потерявшие мессенджеры, пошли проверять другие сервисы, и там также начался всплеск активности. Толпа не разбиралась в причинах, а карта каскада дорисовалась сама собой.

Вместо вывода

Таким образом, Downdetector следит не за состоянием серверов, а за тем, как работу сервиса видят его пользователи. В этом и сила, и ограничение метода: толпа способна заметить аварию очень быстро, но ее сигналы остаются косвенным свидетельством, которое лучше сверять с официальными статус-страницами и техническими данными. 

* Facebook, Instagram, WhatsApp и Messenger принадлежат Meta Platforms, признанной экстремистской организацией и запрещенной в РФ.

Что будем искать? Например,ChatGPT

Мы в социальных сетях