Сервер может отвечать на ping, но сайт при этом отдавать 500, зависать на базе или показывать пустую страницу. Такой мониторинг создает ложное чувство безопасности.

В чем проблема

Проверка доступности только по ping или открытому порту не видит ошибок приложения, SSL, базы, PHP-FPM, редиректов и некорректного HTML.

Что проверяю

  • Что именно проверяет текущий мониторинг.
  • Проверяется ли HTTP-статус сайта.
  • Есть ли контроль текста на странице.
  • Проверяется ли база или важный endpoint.
  • Куда уходят алерты и есть ли задержка.

Как исправляю

Я настраиваю проверки по реальному пользовательскому сценарию: домен, HTTPS, ответ приложения и ключевой контент.

  • Анализирую текущие проверки.
  • Добавляю HTTP/HTTPS health check.
  • Настраиваю проверку контента или API.
  • Разделяю предупреждения по типам сбоев.
  • Тестирую алерт на искусственном отказе.

Что получает заказчик

  • Мониторинг замечает реальное падение сайта.
  • Алерты становятся полезнее.
  • Можно отличать серверную и прикладную проблему.
  • Простои обнаруживаются быстрее.

Что нужно для старта

  • Список сайтов или сервисов.
  • Текущий инструмент мониторинга.
  • Куда отправлять уведомления.
  • Критичные страницы или API endpoints.

Вопросы и ответы

Достаточно проверять главную страницу?

Для простого сайта часто да, но для сервисов лучше добавить отдельные health endpoints.

Нужно ли проверять форму заявки?

Если заявки критичны, полезно настроить отдельный синтетический тест.

Нужна похожая задача?

Напишите, что именно сломалось или что нужно запустить. Я разберу симптомы, проверю техническую причину и предложу понятный план работ с адекватными сроками.