netdata: мониторинг сервера за одну команду

Поднять Zabbix или связку Prometheus+Grafana ради разового взгляда на нагрузку сервера — избыточно. netdata ставится одной командой и сразу даёт веб-дашборд с сотнями метрик: CPU по ядрам, память, диски, сеть, процессы — всё с обновлением раз в секунду. # установка (собственный inline-скрипт, ставит как systemd-сервис) curl -Ss https://get.netdata.cloud/kickstart.sh | sh # дашборд доступен сразу # http://<server-ip>:19999 Из коробки — без настройки алертов, retention всего несколько часов и заметный расход CPU/RAM на самого агента при большом числе метрик. Для разовой диагностики “что жрёт сервер прямо сейчас” — быстрее, чем разворачивать полноценный стек. Для долгосрочной истории и алертинга на проде — всё равно Zabbix или Prometheus. ...

24 июля 2026 г. · llexa

Уровни паники по цвету алерта в Zabbix

Zabbix красит триггеры по severity — но по факту это шкала внутренней паники дежурного, не важности инцидента. Not classified / Information — даже не открываешь вкладку, само пройдёт. Warning — открыл, подумал «ну ладно», закрыл обратно. Average / High — уже читаешь description триггера и ищешь runbook. Disaster — звонишь тому, кто «точно знает», даже если сейчас 3 часа ночи. Корреляция между severity и пульсом почти линейная — впору вешать vital-мониторинг на самого дежурного, не только на сервер. ...

19 июля 2026 г. · llexa

iostat и sar: где потерялась производительность

Общая картина по CPU и памяти не отвечает на вопрос «какой конкретно диск тормозит». Для этого — iostat (снимок сейчас) и sar (история за прошлые дни). iostat -xz 1 5 # расширенная статистика, обновление раз в секунду, 5 раз # %util — занятость диска, await — латентность запроса в мс await выше 10-20 мс на HDD или 1-2 мс на SSD — сигнал упереться в диск. sar из пакета sysstat собирает метрики в фоне и хранит историю: ...

16 июля 2026 г. · llexa

vmstat: мониторинг памяти и активности ядра

vmstat выводит снапшот состояния системы: очередь процессов, память, своп, блочный IO, прерывания, нагрузку CPU. vmstat 1 5 # 5 замеров раз в секунду vmstat -s # сводка памяти одной колонкой vmstat -d # активность дисков vmstat -SM 1 # память в МБ Ключевые поля: r — в очереди CPU, b — ждут IO, swpd — своп использован, bi/bo — блоков прочитано/записано, wa — %CPU в ожидании диска. Если wa > 20% — узкое место в дисковой подсистеме. Если r > числа ядер — CPU перегружен. ...

6 июля 2026 г. · llexa