Watchflare docs
Sur cette page

Alertes et notifications

Consultez et gérez les alertes actives depuis la page Incidents. Comprenez comment les règles de seuil, les fenêtres de durée et les états d'alerte fonctionnent dans Watchflare.

Watchflare envoie une notification lorsqu’une métrique dépasse un seuil ou lorsqu’un hôte passe hors ligne. Les alertes sont évaluées toutes les 30 secondes. Les défauts globaux s’appliquent à tous les hôtes, et chaque hôte peut remplacer n’importe quelle règle depuis son onglet Alerts.

Pour la liste complète des types d’alertes et des options de configuration, voir la référence des alertes du Hub.

Remarque

L’envoi par e-mail exige un SMTP configuré. Allez dans Settings → Notifications. Voir Notifications e-mail.


Types d’alertes

AlerteSe déclenche quandUnité
Host offlineAucun heartbeat depuis plus de 15 secondesAucune
CPU usageLe % CPU dépasse le seuil%
Memory usageLe % mémoire dépasse le seuil%
Disk usageLe % disque dépasse le seuil%
Load average (1 min)La charge moyenne 1 min dépasse le seuilAucune
Load average (5 min)La charge moyenne 5 min dépasse le seuilAucune
Load average (15 min)La charge moyenne 15 min dépasse le seuilAucune
TemperatureLa température CPU dépasse le seuil°C

Configurer les alertes

Défauts globaux

Allez dans Settings → Alerts pour définir les seuils par défaut qui s’appliquent à tous les hôtes. C’est un bon point de départ, et vous pouvez les remplacer par hôte là où c’est nécessaire.

Règles par hôte

  1. Ouvrez la page de détail d’un hôte.
  2. Cliquez sur l’onglet Alerts.
  3. Activez les types d’alertes que vous voulez et définissez le seuil de chacun.
  4. Les changements sont enregistrés immédiatement.

Les règles par hôte priment sur les défauts globaux.


Fenêtre de durée

Chaque règle a une durée (5 minutes par défaut). La métrique doit dépasser le seuil en continu pendant toute la durée avant qu’un incident s’ouvre et qu’une notification soit envoyée. Les pics brefs plus courts que la durée sont ignorés.


Incidents

Lorsqu’un seuil est franchi pendant la durée configurée, le Hub ouvre un incident :

  1. Une notification est envoyée lorsque l’incident s’ouvre.
  2. Une seconde notification est envoyée lorsque l’incident se résout (la métrique redescend sous le seuil, ou l’hôte revient en ligne).

Les incidents sont visibles dans l’onglet Alerts et la section Incidents de la page de détail de chaque hôte, avec l’heure de début, l’heure de résolution, et la valeur qui a déclenché le dépassement.

Les incidents ont trois états : active (le dépassement est en cours), paused (l’hôte a été mis en pause pendant que l’incident était ouvert), et resolved. Mettre un hôte en pause suspend ses incidents ouverts au lieu de les résoudre : ils sont exclus de la liste active et marqués d’un badge paused. Reprendre l’hôte les ramène dans le traitement actif, sans fausse résolution. Voir Mettre un hôte en pause.

La page /incidents dans la barre latérale affiche les incidents de tous les hôtes en une seule vue, filtrable par état.


Alertes hôte hors ligne

L’alerte host offline se déclenche lorsque le stale checker du Hub ne détecte aucun heartbeat depuis plus de 15 secondes. L’agent envoie un heartbeat toutes les 5 secondes, donc environ 3 heartbeats manqués déclenchent le passage hors ligne.

L’incident se résout automatiquement au prochain heartbeat réussi.

Astuce

Mettez un hôte en pause avant une maintenance prévue pour supprimer les alertes hors ligne. Voir Mettre un hôte en pause.


Alertes de température

La collecte de température ne s’exécute que sur les hôtes physiques. Elle est omise sur les VM et les conteneurs Docker, donc activer une alerte de température sur une VM ne la déclenchera jamais.


Envoi des notifications

Les notifications sont livrées à un ou plusieurs canaux de notification (Discord, Slack, Telegram, Matrix, Ntfy, Gotify, SMTP, HTTP générique, et d’autres via Shoutrrr). Les canaux se configurent dans Settings > Notifications.

Chaque notification contient :

  • Le nom de l’hôte et le type d’alerte
  • La valeur qui a déclenché le dépassement et le seuil configuré
  • L’heure d’ouverture ou de résolution de l’incident

E-mail exige un SMTP configuré. Utilisez le bouton Send test email pour vérifier votre configuration avant de compter sur les alertes. Voir Notifications e-mail.

Les canaux de notification livrent les mêmes alertes vers n’importe laquelle des destinations Shoutrrr listées ci-dessus. Voir Canaux de notification.