Alerting et production
Labs pratiques
Mettez en pratique ce que vous avez appris dans les cours ci-dessus.
Labs du module (6)
Alertmanager — règles et routing
GuidéConfigurer Alertmanager avec règles Prometheus et routing avancé
Alertes Slack et PagerDuty
GuidéMaîtrise le routage intelligent des alertes avec Slack et PagerDuty. Configure Alertmanager comme un chef d'orchestre qui réveille les pompiers (PagerDuty) ou prévient l'équipe (Slack) selon la gravité. À la fin : zéro alerte perdue, zéro spam.
SLO et SLA avec Prometheus
GuidéMaîtrise les SLO/SLA avec Prometheus : transforme tes promesses de disponibilité en contrats mesurables, configure l'error budget et les alertes intelligentes pour garder ton service en vie (et tes clients heureux). Analogie : ton compte bancaire d'indisponibilité.
Stack monitoring production complète
GuidéConfigurer alerting Prometheus/Grafana en production avec règles complexes
On-call et escalation policies
GuidéMets en place une rotation on-call et des politiques d'escalation.
Capacity planning avec Prometheus
GuidéUtilise les métriques historiques pour prédire les besoins en ressources.