В современных распределённых системах мониторинг инфраструктуры становится не просто полезным инструментом, а обязательным компонентом. Он позволяет своевременно обнаруживать сбои, отслеживать нагрузку на серверы и прогнозировать рост потребления ресурсов. В этой статье мы рассмотрим один из самых популярных стеков для мониторинга — связку Prometheus и Grafana. Мы настроим сбор метрик с серверов с помощью Node Exporter, организуем алертинг через Alertmanager и визуализируем все данные в удобных дашбордах Grafana. Это решение подходит как для небольших проектов, так и для корпоративных сред, благодаря своей гибкости, производительности и открытому исходному коду.
Настройка системы #
sudo -i
apt update && apt upgrade -y
reboot
apt install mc htop tcpdump curl wget traceroute net-tools iperf3 iptraf tree -y
nano ~/.bashrc
# Tuning Command Line History (only current user)
export HISTSIZE=10000
export HISTTIMEFORMAT="%h %d %H:%M:%S "
PROMPT_COMMAND='history -a'
export HISTIGNORE="ls:ll:history:w:htop:pwd:mc:docker ps"
source ~/.bashrc