iostat и sar: диск и CPU за интервал, не мгновенный снимок

top/vmstat без параметров показывают текущий момент — iostat и sar (пакет sysstat) считают статистику за интервал и показывают тренд: iostat -x 2 5 — расширенный вывод каждые 2 секунды, 5 раз, с %util (загрузка диска) и await (время ожидания I/O). sar идёт дальше — если sysstat настроен таймером (сбор каждые 10 минут), он копит историю в /var/log/sa/, и sar -u -f /var/log/sa/sa15 покажет загрузку CPU за 15-е число без настройки мониторинга заранее — спасает при разборе уже закончившегося инцидента. ...

8 сентября 2026 г. · llexa

dasha: дашборд здоровья кластера PostgreSQL

Обычно здоровье кластера PostgreSQL собирают вручную из pg_stat_statements, pg_stat_activity и логов VACUUM. dasha (github.com/dbulashev/dasha) сводит это в один веб-дашборд: медленные запросы, неэффективные индексы, блокировки, размер таблиц и прогресс VACUUM — с итоговым Health Score по формуле с весами. cd deploy/compose docker compose up -d # веб-интерфейс: http://localhost:3000 Бэкенд на Go 1.26, фронт на Vue 3.5, поддерживает PostgreSQL 14-18, аутентификацию через OIDC и RBAC, снимки состояния кластера для истории. Есть MCP-коннектор — можно подключить ИИ-ассистента прямо к метрикам кластера, и интеграция с Yandex Cloud для поиска по логам. ...

5 сентября 2026 г. · llexa

Vector: сборка логов без Logstash на JVM

Logstash тянет за собой JVM и легко съедает гигабайт памяти на пустом месте. vector (Datadog, Rust) решает ту же задачу — собрать логи, разобрать, отправить — без этого веса. [sources.app_logs] type = "file" include = ["/var/log/myapp/*.log"] [transforms.parse] type = "remap" inputs = ["app_logs"] source = '. = parse_json!(.message)' [sinks.loki] type = "loki" inputs = ["parse"] endpoint = "http://loki:3100" labels.job = "myapp" Три секции — источник, трансформация, приёмник — читаются в конфиге так же прямо, как выполняются. remap (язык VRL) заменяет отдельные grok-паттерны Logstash на обычные выражения. Один бинарник, без плагин-менеджера и без JVM warm-up — годится и на слабом Pi-подобном хосте. ...

1 августа 2026 г. · llexa

netdata: мониторинг сервера за одну команду

Поднять Zabbix или связку Prometheus+Grafana ради разового взгляда на нагрузку сервера — избыточно. netdata ставится одной командой и сразу даёт веб-дашборд с сотнями метрик: CPU по ядрам, память, диски, сеть, процессы — всё с обновлением раз в секунду. # установка (собственный inline-скрипт, ставит как systemd-сервис) curl -Ss https://get.netdata.cloud/kickstart.sh | sh # дашборд доступен сразу # http://<server-ip>:19999 Из коробки — без настройки алертов, retention всего несколько часов и заметный расход CPU/RAM на самого агента при большом числе метрик. Для разовой диагностики “что жрёт сервер прямо сейчас” — быстрее, чем разворачивать полноценный стек. Для долгосрочной истории и алертинга на проде — всё равно Zabbix или Prometheus. ...

24 июля 2026 г. · llexa

Уровни паники по цвету алерта в Zabbix

Zabbix красит триггеры по severity — но по факту это шкала внутренней паники дежурного, не важности инцидента. Not classified / Information — даже не открываешь вкладку, само пройдёт. Warning — открыл, подумал «ну ладно», закрыл обратно. Average / High — уже читаешь description триггера и ищешь runbook. Disaster — звонишь тому, кто «точно знает», даже если сейчас 3 часа ночи. Корреляция между severity и пульсом почти линейная — впору вешать vital-мониторинг на самого дежурного, не только на сервер. ...

19 июля 2026 г. · llexa

iostat и sar: где потерялась производительность

Общая картина по CPU и памяти не отвечает на вопрос «какой конкретно диск тормозит». Для этого — iostat (снимок сейчас) и sar (история за прошлые дни). iostat -xz 1 5 # расширенная статистика, обновление раз в секунду, 5 раз # %util — занятость диска, await — латентность запроса в мс await выше 10-20 мс на HDD или 1-2 мс на SSD — сигнал упереться в диск. sar из пакета sysstat собирает метрики в фоне и хранит историю: ...

16 июля 2026 г. · llexa

vmstat: мониторинг памяти и активности ядра

vmstat выводит снапшот состояния системы: очередь процессов, память, своп, блочный IO, прерывания, нагрузку CPU. vmstat 1 5 # 5 замеров раз в секунду vmstat -s # сводка памяти одной колонкой vmstat -d # активность дисков vmstat -SM 1 # память в МБ Ключевые поля: r — в очереди CPU, b — ждут IO, swpd — своп использован, bi/bo — блоков прочитано/записано, wa — %CPU в ожидании диска. Если wa > 20% — узкое место в дисковой подсистеме. Если r > числа ядер — CPU перегружен. ...

6 июля 2026 г. · llexa