Prometheus & Grafana — stack d'observabilité production
Pipeline métriques minimum viable : architecture scrape, signaux RED/USE, alerting SLO et routage astreinte sans fatigue d'alertes.
Lire le nodePrometheus, Grafana, Loki, alerting, SLO et dashboards NOC.
Visibilité production — métriques, logs, traces, alerting et gouvernance SLO. Cette catégorie couvre les stacks sur lesquelles s'appuient les équipes NOC et SRE : Prometheus, Grafana, Loki, OpenTelemetry, routage PagerDuty et design de dashboards.
Nous documentons quoi superviser, comment alerter sans fatigue, et comment relier les signaux d'observabilité aux SLO métier. Distinct de la détection SOC : ici il s'agit de la santé plateforme et applicative, pas de la chasse aux menaces.