Мониторинг и наблюдаемость: Prometheus, Grafana, OpenTelemetry

observability

Monitoring expert — это скилл для Claude Code, который настраивает системы мониторинга и наблюдаемости: реализует структурированное логирование, разворачивает Prometheus/Grafana-стеки, определяет правила алертинга, инструментирует распределённый трейсинг через OpenTelemetry и проводит нагрузочное тестирование с k6 и Artillery. Берут, когда сервис падает в продакшне и непонятно почему, когда нужно добавить метрики и дашборды к новому микросервису, когда требуется настроить алерты без лавины ложных срабатываний, или когда необходимо выяснить, где именно «тормозит» приложение под нагрузкой. Скилл выдаёт готовый код: счётчики и гистограммы prom-client для Node.js, spans OpenTelemetry с экспортом в Jaeger, Prometheus-правила с выражениями PromQL, сценарии k6 с порогами по p95-латентности. Визуализацию строит по методологиям RED (Rate/Errors/Duration) и USE (Utilization/Saturation/Errors). Дополнительно охватывает профилирование CPU/памяти и планирование ёмкости инфраструктуры. Направление — инструментирование и наблюдение за работающей системой, а не отладка кода до деплоя (для этого debugging-wizard). Подойдёт командам на Node.js-стеке; примеры на других языках не задокументированы в первоисточнике. Лицензия MIT, автор Jeffallan, версия 1.1.0.