Supervision proactive
Définition
La supervision proactive repose sur un principe simple : la plupart des pannes ne surviennent pas instantanément, elles se préparent. Un disque qui sature, une fuite mémoire, une charge qui augmente progressivement — ces dérives laissent une fenêtre d'intervention avant que l'incident ne devienne visible pour les utilisateurs. La supervision proactive consiste à détecter cette fenêtre et à alerter suffisamment tôt pour agir dans le calme plutôt que dans l'urgence.
Différence avec la supervision réactive
| Supervision réactive | Supervision proactive | |
|---|---|---|
| Déclenchement | L'incident est déjà survenu | La dérive est détectée avant l'incident |
| Contexte d'intervention | Sous pression, souvent en urgence | Planifiée, fenêtre calme |
| Exemple | « Le disque est plein, le service a planté » | « Le disque se remplit à un rythme qui atteindra 100 % dans 5 jours » |
Métriques qui s'y prêtent le mieux
Toutes les métriques ne sont pas adaptées à une alerte préventive — il faut une dérive progressive et mesurable : capacité disque, tendance mémoire, charge CPU moyenne sur plusieurs jours, croissance du nombre de connexions. Un événement binaire (service arrêté, machine injoignable) relève plutôt d'une alerte réactive classique.
À ne pas confondre avec
- Un seuil d'alerte : le seuil est la valeur utilisée ; la supervision proactive est la stratégie qui consiste à choisir ce seuil suffisamment tôt dans la dérive, pas au dernier moment.
- La fatigue d'alertes : la supervision proactive, mal réglée, peut elle-même devenir une source de bruit si trop de dérives mineures déclenchent des alertes non prioritaires.