Services systemd
Surveillez les services systemd de vos hôtes Linux avec Watchflare : un inventaire des unités activées et actives, l'état de santé en direct, et la détection des services failed, collectés via D-Bus.
Sur les hôtes Linux qui exécutent systemd, l’agent signale les services de l’hôte : quelles unités existent, si elles sont activées au démarrage, et leur état en direct. Cela vous permet de voir ce qui doit s’exécuter, de repérer d’un coup d’œil les services failed, et de parcourir le catalogue de services d’un hôte depuis l’onglet Services de sa page de détail.
Remarque
Les services systemd ne sont collectés que sur les hôtes Linux qui exécutent systemd. Sous macOS, Windows, ou Linux sans systemd, l’onglet Services reste vide.
Ce qui est suivi
L’agent suit les unités .service qui sont activées au démarrage ou actives actuellement, l’union des deux. C’est l’ensemble qui compte en exploitation : un service prévu pour s’exécuter en permanence, ou un service actif à cet instant.
Les services à la fois disabled et inactive ne figurent pas dans la liste. Ils sont installés mais inutilisés, et n’ajouteraient que du bruit.
Les instances de template (par exemple systemd-fsck@dev-BOOT.service) héritent de l’état enabled de leur unité template (systemd-fsck@.service).
Fonctionnement
L’agent lit systemd via D-Bus en utilisateur sans privilèges. Il n’invoque jamais systemctl en shell et ne lit jamais le journal, donc la collecte est légère et ne demande aucun privilège élevé.
Deux flux distincts gardent les données à jour, au bon coût :
Inventaire : le catalogue complet (nom d’unité, description, état enabled) est envoyé 60 secondes après le démarrage de l’agent, puis toutes les 15 minutes. Le Hub actualise le catalogue de services de l’hôte à chaque inventaire.
Santé : l’état en direct de chaque service (active, failed, etc.) est signalé toutes les 30 secondes et transmis en flux vers l’interface. Un service qui quitte l’ensemble suivi, par exemple un service non enabled qui s’est arrêté, est retiré en moins de 30 secondes.
Remarque
L’onglet Services est vide pendant les 60 premières secondes après le démarrage de l’agent, car le premier inventaire n’est pas encore terminé.
L’onglet Services
Ouvrez la page de détail d’un hôte et sélectionnez l’onglet Services. Chaque service affiche :
| Colonne | Description |
|---|---|
| Name | Le nom de l’unité systemd (ex. nginx.service). Survolez pour voir sa description. |
| Enabled | L’état du fichier d’unité : enabled, disabled, static, masked, etc. Affiche - pour les unités transitoires qui n’ont pas de fichier d’unité. |
| State | L’état actif : active, inactive ou failed. |
| Substate | Le sous-état plus fin : running, exited, dead, failed, etc. |
| Updated | L’heure de la dernière collecte. Affiché en vert tant que l’hôte remonte des données, et passe à l’ambre si l’hôte cesse de remonter. Survolez pour la date et l’heure complètes. |
Les services failed sont mis en évidence et peuvent être triés en haut en cliquant sur la colonne State. L’en-tête affiche le nombre total de services et combien sont failed. Vous pouvez rechercher par nom, trier sur n’importe quelle colonne, et choisir les colonnes visibles.
Cadence de rafraîchissement
L’état en direct de chaque service se rafraîchit toutes les 30 secondes et est poussé vers le navigateur en temps réel.
Les champs d’inventaire (état enabled, description) et tout nouveau service suivi apparaissent avec l’inventaire : 60 secondes après le démarrage, puis toutes les 15 minutes. Activer un service ou changer l’état de son fichier d’unité se reflète en environ 15 minutes, ou immédiatement après un redémarrage de l’agent. Un service qui sort de l’ensemble suivi est retiré plus tôt, en 30 secondes, au rapport de santé suivant.
Astuce
Si, sur un hôte en bonne santé, tous les services passent à l’ambre dans la colonne Updated, l’agent a cessé de remonter des données. Vérifiez que le service watchflare-agent s’exécute sur cet hôte.