Настройка уведомлений

Смысл мониторинга — узнать об инциденте раньше клиентов. В этом разделе мы разберем, как подключить Telegram и Webhook для приема сообщений, как гибко настроить условия срабатывания алертов и как отключить ночной спам с помощью правил маршрутизации.

Все настройки выполняются в панели управления во вкладке Оповещения (или разделе Проблемы).


1. Подключение каналов связи (куда отправлять)

Первым делом укажите, куда система должна слать тревожные сигналы.

  1. Перейдите во вкладку Каналы.
  2. Нажмите кнопку Добавить канал.
  3. Выберите нужный тип:
    • Telegram — мгновенные оповещения в личные сообщения или рабочий чат команды (система предложит подключить бота);
    • Webhook — отправка JSON-запроса в ваши корпоративные системы (Slack, Mattermost, тикет-систему или на ваш личный сервер).
  4. Следуйте подсказкам на экране для подтверждения привязки.

Результат: После добавления все активные оповещения начнут отправляться в настроенные каналы.


2. Управление триггерами алертов (вкладка «Оповещения»)

После установки сервисов на сервер система автоматически создает готовый набор алертов под каждый сервис (падение Nginx/Clickhouse, нехватка места на диске, критическая нагрузка на процессор, репликация баз данных и т.д.).

Быстрое включение и выключение

В таблице напротив каждого оповещения есть статус Подключен. Нажмите на него, если хотите временно отключить проверку конкретного условия без его удаления.


Создание или изменение оповещения

Вы можете отредактировать любой существующий алерт (кнопка Изменить) или создать новый с нуля (кнопка Добавить):

  1. Сервис — выберите службу, к которой относится проверка (например, clickhouse, nginx, mysql).
  2. Важность — уровень критичности: Предупреждение, Высокая или Чрезвычайная.
  3. Expression — формула на языке Prometheus (PromQL), по которой рассчитывается сбой.
    Например: up{job=»clickhouse»} == 0 (сервис недоступен).
  4. Параметры удержания (защита от ложных срабатываний):
    • For — сколько времени условие должно непрерывно выполняться до отправки тревоги (например, 2 m — если нагрузка кратковременно подскочила на 10 секунд и упала, уведомление не побеспокоит вас).
    • Keep firing for — сколько времени удерживать статус ошибки после ее повторения.
  5. Оповещать только об ошибке — поставьте галочку, если вам не нужно отдельное сообщение о восстановлении сервиса («OK / Resolved»).
  6. Заголовок и Описание — понятный текст сообщения, который придет вам в мессенджер (внизу формы есть наглядный блок «Пример уведомления»).
  7. Нажмите Сохранить.


3. Расписание и фильтрация (вкладка «Правила уведомлений»)

Правила уведомлений позволяют настроить умную маршрутизацию: например, не отправлять некритичные алерты ночью или отключить уведомления с тестового контура.

Как настроить правило:

  1. Перейдите во вкладку Правила уведомлений и нажмите кнопку Добавить.
  2. Заполните условия:
    • Серверы — выберите конкретный сервер (например, тестовый DEV) или оставьте Все.
    • Правило — выберите конкретный алерт (например, Host high CPU load) или оставьте Все правила.
    • Время — задайте временное окно действия правила (например, с 23:00 до 08:00).
    • Применить — для кого действует правило (Для меня или для всей команды).
    • Действие — выберите:
      • Не отправлять — заглушить оповещения в указанных условиях;
      • Отправлять — принудительно доставлять уведомления.
  3. Нажмите Сохранить.
Связаться: