Перейти к содержанию

Мониторинг в Bootsman

Внимание!

StorageClass (например, Longhorn, Ceph CSI) — обязателен для хранения метрик. Один из выбранных стореджей должен быть установлен в качестве StorageClass по умолчанию (default) для корректной работы мониторинга.
Это требование относится ко всем сценариям развертывания, где устанавливаются VictoriaMetrics (в качестве хранилища метрик) или Grafana

Варианты установки

В данном сценарии каждый Kubernetes-кластер разворачивает собственный стек мониторинга.

Преимущества:
- Полная автономность: сбой одного кластера не влияет на работу мониторинга в других. - Простота настройки локальных метрик и оповещений.
- Возможность отдельной конфигурации для различных окружений (dev, stage, prod).

Недостатки:
- Повышенные требования к ресурсам: каждый кластер содержит полный стек мониторинга.

Обязательные компоненты:
- @storage (Longhorn, Ceph CSI и т.п.)
- victoria-metrics
- grafana-operator (опционально, для визуализации метрик)

Схема потока метрик:

flow 1 monitoring flow 1 monitoring

В этом случае весь стек мониторинга разворачивается исключительно в управляющем (management) кластере, а в остальных кластерах только компонент отправки метрик в управляющий кластер.

Преимущества:
- Единое централизованное хранилище метрик.
- Упрощённый доступ к дашбордам и оповещениям.
- Экономия ресурсов за счёт одного экземпляра стека мониторинга.

Недостатки:
- Потенциальный сбой сбора метрик при недоступности связи с подчиненными кластерами - Более сложная настройка сетевого доступа и безопасности.

Обязательные модули в управляющем кластере: - @storage (Longhorn, Ceph CSI и т.п.)
- victoria-metrics
- grafana-operator (опционально, для визуализации)
- kube-vip
- kube-vip-cloud-provider

Обязательные модули в подчиненных кластерах:
- victoria-metrics (включенный компонент vmagent, kube-state-metrics, prometheus-node-exporter, victoria-metrics-operator, vmpushproxy-controller-manager, vmpushproxy-etcd, vmpushproxy-scheduler)
- Включение дополнительных модулей не требуется

Схема потока метрик:

flow 2 monitoring flow 2 monitoring


Сравнение реализаций

Характеристика Кластерный мониторинг Централизованный мониторинг
Автономность Присутствует Отсутствует
Масштабирование ресурсов Линейный рост потребления Незначительный рост
Сложность настройки Легко Сложнее (сеть, безопасность)
Дашборды Независимые Единые для всех подключенных кластеров
Оповещения Независимые Единые для всех подключенных кластеров

Заметка

Документацию по настройке централизованного мониторинга можно использовать и для отправки данных в другой кластер Bootsman, так и во внешние системы хранения метрик.

Следующий шаг