Alerting

Quiet et Exclude hours

Alerting quiet vrs exclude hours
Les Quiet hours fonctionnent en somme comme l’ancien Exclude, et à la fin de l’intervalle de silence, les alertes remontent sur la durée de répétition.

Exclude hours

Définit une fenêtre pendant laquelle les seuils de performance ne sont pas évalués.
Les valeurs de métriques relevées pendant cette période sont ignorées par l’évaluation des alertes. Elles ne comptent ni pour la durée de dépassement, ni pour la génération d’alerte, ni pour aucun état d’alerte.
Cette option sert quand une charge prévisible est attendue : travaux de sauvegarde, fenêtres de maintenance, traitements par lots, ou activités système programmées qui ne doivent pas peser sur les alertes.

Exemple
Une sauvegarde de base de données tourne chaque nuit entre 01:00 et 03:00 et fait dépasser à la latence du stockage le seuil configuré.
En configurant une Monitoring Exclusion sur cette période, XorMon ignore entièrement ces mesures. La durée de dépassement ne s’accumule pas, et aucune alerte n’est générée sur l’intervalle exclu.

Quiet hours

Définit une fenêtre pendant laquelle les notifications d’alerte ne sont pas envoyées.
À la différence des Exclude hours, l’évaluation des seuils se poursuit normalement. Les valeurs sont traitées, la durée de dépassement continue de s’accumuler, et l’état d’alerte est tenu à jour.
Si une condition d’alerte est active à la fin de la période de silence, XorMon envoie l’alerte selon la politique de répétition configurée.
Cette option sert quand un administrateur veut éviter de recevoir des notifications à certaines heures, tout en gardant un historique de supervision et une évaluation d’alerte complets.

Exemple
Les notifications sont suspendues entre 22:00 et 06:00.
Un seuil d’utilisation CPU est franchi à 23:30 et reste dépassé jusqu’à 08:00.
XorMon supervise toute la nuit sans envoyer aucune notification pendant la fenêtre de silence.
Après 06:00, si le seuil est toujours dépassé, une alerte part avec tout son contexte, y compris la période pendant laquelle la notification a été suspendue.

Suivez ce lien pour les alertes d’anomalie.
Les alertes d’événement sur les ports SAN fonctionnent selon trois modes :
  • Default ➡ une alerte est levée dès qu’un port SAN passe au statut « red ».
  • Offline ➡ une alerte est levée dès qu’un port SAN passe de l’état « green » à l’état Offline ou Down.
  • Any change ➡ une alerte est levée dès qu’un port SAN passe de l’état « green » à une autre couleur.

SAN port alerting

Alertes de prévision

Employez des alertes fondées sur l’utilisation prévue des ressources pour renforcer la supervision proactive.

Configuration

  • Settings ➡ Alerting ➡ onglet Prediction ➡ New Alert Group
  • Sélectionnez les métriques dont vous voulez être averti du comportement prévu
  • Days to Threshold : alerte si la prévision atteint le seuil dans le nombre de jours indiqué
  • Model : modèle de prévision ; « Auto » sélectionne le modèle réactif, sinon vous pouvez employer une prévision de tendance précise
  • Comme pour les alertes de performance, les alertes de prévision peuvent transmettre les événements par e-mail ou par une autre intégration configurée

Configuration de l’alerte :
Predictive alerting 1

Exemple de message d’alerte
Predictive alerting 2
Suivez ce lien pour les alertes Ping.
Vous pouvez créer des alertes sur les métriques de performance de tous les équipements configurés.
Toute métrique collectée par l’outil peut faire l’objet d’une alerte.
Cela se configure dans UI ➡ Settings ➡ Alerting ➡ Performance
Définissez d’abord les groupes d’e-mail sous l’onglet « Email ».

Créer une alerte

Alerte sur du stockage : sélectionnez « Storage » ➡ New Alert Group
Alerting cfg 1

Donnez un nom, sélectionnez une classe, un subsystem (volume) et les volumes par une expression régulière ('.*' vaut tous les volumes de toutes les baies) ➡ Add
Alerting cfg 2

Sélectionnez une métrique (Latency)
Alerting cfg 3

Posez le seuil et les groupes d’e-mail définis à l’avance ➡ Save
Alerting cfg 4

Le signe « + » sur la ligne d’alerte, à droite, permet d’ajouter d’autres métriques au même groupe d’alerte.

Vidéo

  • Alerting
  • Filtrer les éléments par équipement parent

Exemples

Les alertes par e-mail embarquent des graphes par défaut ; la plage de temps du graphe se règle dans l’onglet Alerting Options

Alerte stockage par e-mail
Alerting example 1

Alerting example 1 attachement


Alerte serveur par e-mail
Alerting example 2

Alerting example 2 attachement


Une alerte est levée dès qu’une erreur matérielle ou logicielle critique est détectée sur un équipement.
En somme, l’alerte part quand un équipement passe au statut « red » dans le tableau de bord global d’état de santé.
Dès que l’équipement repasse au « green », une alerte de retour à la normale est envoyée.
Cela se configure dans UI ➡ Settings ➡ Alerting ➡ HW Events
Définissez d’abord les groupes d’e-mail sous l’onglet « Email ».

Alerting event