Quiet et Exclude hours
Les Quiet hours fonctionnent en somme comme l’ancien Exclude, et à la fin de l’intervalle de silence, les alertes remontent sur la durée de répétition.
Exclude hours
Définit une fenêtre pendant laquelle les seuils de performance ne sont pas évalués.
Les valeurs de métriques relevées pendant cette période sont ignorées par l’évaluation des alertes. Elles ne comptent ni pour la durée de dépassement, ni pour la génération d’alerte, ni pour aucun état d’alerte.
Cette option sert quand une charge prévisible est attendue : travaux de sauvegarde, fenêtres de maintenance, traitements par lots, ou activités système programmées qui ne doivent pas peser sur les alertes.
Exemple
Une sauvegarde de base de données tourne chaque nuit entre 01:00 et 03:00 et fait dépasser à la latence du stockage le seuil configuré.
En configurant une Monitoring Exclusion sur cette période, XorMon ignore entièrement ces mesures. La durée de dépassement ne s’accumule pas, et aucune alerte n’est générée sur l’intervalle exclu.
Quiet hours
Définit une fenêtre pendant laquelle les notifications d’alerte ne sont pas envoyées.
À la différence des Exclude hours, l’évaluation des seuils se poursuit normalement. Les valeurs sont traitées, la durée de dépassement continue de s’accumuler, et l’état d’alerte est tenu à jour.
Si une condition d’alerte est active à la fin de la période de silence, XorMon envoie l’alerte selon la politique de répétition configurée.
Cette option sert quand un administrateur veut éviter de recevoir des notifications à certaines heures, tout en gardant un historique de supervision et une évaluation d’alerte complets.
Exemple
Les notifications sont suspendues entre 22:00 et 06:00.
Un seuil d’utilisation CPU est franchi à 23:30 et reste dépassé jusqu’à 08:00.
XorMon supervise toute la nuit sans envoyer aucune notification pendant la fenêtre de silence.
Après 06:00, si le seuil est toujours dépassé, une alerte part avec tout son contexte, y compris la période pendant laquelle la notification a été suspendue.
Une alerte est levée dès qu’une erreur matérielle ou logicielle critique est détectée sur un équipement.
En somme, l’alerte part quand un équipement passe au statut « red » dans le tableau de bord global d’état de santé.
Dès que l’équipement repasse au « green », une alerte de retour à la normale est envoyée.
Cela se configure dans UI ➡ Settings ➡ Alerting ➡ HW Events
Définissez d’abord les groupes d’e-mail sous l’onglet « Email ».