Métriques système
Définition
Les métriques système sont les mesures de l'état interne d'une machine, relevées à intervalle régulier par un agent installé dessus. Elles se distinguent des vérifications externes, qui constatent seulement qu'un service répond depuis le réseau sans rien savoir de ce qui se passe à l'intérieur.
Les principales familles
- Processeur : utilisation globale, décomposition (utilisateur, système, attente disque), charge moyenne.
- Mémoire : mémoire disponible, utilisation du fichier d'échange ou du swap.
- Stockage : espace libre par système de fichiers, inodes sur Linux, débit et latence des entrées-sorties.
- Réseau : trafic entrant et sortant par interface, erreurs et paquets rejetés.
- Services et processus : état des services système, nombre de processus, temps de fonctionnement.
Métrique système ou métrique applicative
Une métrique système décrit la machine ; une métrique applicative décrit le service qu'elle rend — temps de réponse, taux d'erreur, longueur d'une file d'attente.
Les deux sont complémentaires et ne se remplacent pas : un serveur dont toutes les métriques système sont au vert peut héberger une application complètement bloquée, et inversement une application peut répondre correctement sur une machine dont le disque saturera dans deux jours.
Pourquoi la tendance compte
Une métrique système lue à un instant donné a peu de valeur. C'est son évolution qui permet d'anticiper : un disque à 60 % qui gagne 3 % par jour est plus préoccupant qu'un disque stable à 88 % depuis six mois.
C'est la différence essentielle entre une vérification ponctuelle et une supervision continue.
À ne pas confondre avec
- Les journaux : ils décrivent des événements datés, pas des valeurs mesurées à intervalle régulier.
- Les traces applicatives : elles suivent le parcours d'une requête à travers plusieurs composants, ce qui relève de l'observabilité applicative.