Описание инструментов
В решении Bercut ESB реализован алертинг с использованием Grafana Alerting. Ниже приведена функциональность, поддерживаемая в ESB.
- Настройка правил по ключевым метрикам: задержки, ошибки, недоступность сервисов.
- Уведомления: email, вебхуки (в Jira, ServiceNow и др.).
- Интеграция с внешними системами мониторинга: Prometheus, ELK.
Алертинг в Grafana
Alerting в Grafana - механизм настройки автоматических оповещений (алертов) о событиях, связанных с отслеживаемыми метриками и данными.
Основная задача - оперативно уведомлять о:
- превышении пороговых значений (например, загрузка CPU > 80 %);
- падении сервисов;
- аномалиях в работе системы;
- других критических или значимых изменениях.
Ключевые компоненты:
-
Alert rule (правило алертинга) - определяет:
- запрос к источнику данных (например, на PromQL);
- условие срабатывания (например,
$A > 80); - интервал проверки (evaluation interval);
- аннотации и метки для контекста оповещения.
-
Contact points (канал уведомлений) - задаёт способ доставки оповещений:
- email;
- веб‑хуки и др.
-
Notification policies (политика уведомлений) - настраивает маршрутизацию:
- кому отправлять (команда, дежурный);
- при каких метках (например,
team=backend,environment=prod); - с какой критичностью (
severity=critical).