lenec ru

← все теги

#monitoring

9 постов

Prometheus metrics: правильные метрики для веб-сервиса

# Grafana Loki: централизованные логи без Elasticsearch Если вы устали от тяжеловесного ELK stack, который съедает гигабайты RAM и требует постоянного внимания к шардам — пора познакомиться с Grafana…

0 105
Dmitry Volkov

Distributed tracing с OpenTelemetry: что включить и как читать спаны

Запрос пришёл от пользователя в API gateway, оттуда — в orders, оттуда — в payments и inventory параллельно, payments позвал внешний эквайер, ответ собрался обратно. Где-то в этой цепочке произошёл…

178 12K
Алексей Морозов

Grafana dashboards: проектируем информативные дашборды для микросервисов

HTTP создавался для request-response: клиент спрашивает, сервер отвечает. Но современные приложения требуют push-данных от сервера — уведомления, чаты, live-обновления. Три основных подхода: Long…

0 19K
devnotes_ru

OpenTelemetry в Node.js: трейсинг от разработки до прода

# Grafana Loki: централизованные логи без Elasticsearch Если вы устали от тяжеловесного ELK stack, который съедает гигабайты RAM и требует постоянного внимания к шардам — пора познакомиться с Grafana…

0 46
Дмитрий Соколов

pg_stat_statements: находим и оптимизируем медленные запросы в PostgreSQL

Логи медленных запросов — это хорошо, но они показывают только то, что уже взорвалось. А что если нужно найти запросы, которые по отдельности быстрые, но вызываются 100 000 раз в минуту и суммарно…

0 11K
Игорь Беляев

Grafana Alerting: настраиваем оповещения для микросервисов — от PromQL до notification policies

Мониторинг без алертинга — это просто красивые графики. Grafana Alerting превращает PromQL-запросы в автоматические оповещения нужной команде в нужный канал. Разбираем полный путь: от alert rule до…

0 10K
Николай Ломов

PostgreSQL pg_stat_activity: диагностика блокировок и медленных запросов в реальном времени

Когда приложение тормозит и пользователи жалуются на таймауты — первое место для DBA это pg_stat_activity. Представление показывает все соединения к PostgreSQL в реальном времени: кто подключён, что…

0 16K
Игорь Беляев

Мониторинг VPS: Netdata vs Grafana с Prometheus

Без мониторинга на VPS — как ехать без зеркал заднего вида. Можно, но плохо. У меня в проде стоит Grafana + Prometheus на одном кластере и Netdata на пяти других серверах. И тот, и другой инструмент…

406 15K
Эльвира Соболева

Health checks: liveness, readiness и startup probes на практике

Когда первый раз настраиваешь health checks в Kubernetes, кажется, что разница между liveness и readiness — формальность. Оба возвращают 200, оба смотрят на «жив ли сервис». Через пару инцидентов…

388 14K
Ирина Лисицына