Aller au contenu

Canaux d'alerte

Page Alerting → Canaux : canaux configurés en haut, les autres prêts à ajouter

OKStatus supporte dix-huit canaux de notification. Chaque canal est un objet au niveau de l’organisation, associé aux monitors qui doivent le notifier. La case Appliquer à tous mes monitors de la fenêtre de création est cochée par défaut : un nouveau canal démarre donc attaché à tous les monitors que vous avez à cet instant — décochez-la pour choisir vous-même. Les monitors créés plus tard ne sont jamais attachés automatiquement.

CanalPlan
DiscordFree
WebhookFree
TelegramFree
EmailPro
SlackPro
Google ChatPro
AlertmanagerPro
PushoverPro
Rocket.ChatPro
MattermostPro
ntfyMax
Microsoft TeamsMax
Splunk (HEC)Max
PagerDutyMax
Grafana IRMMax
Jira Service ManagementMax
incident.ioMax
JiraEnterprise

Chaque palier inclut tous les canaux des paliers inférieurs. Le plan est vérifié à la création d’un canal — un canal créé avant un changement continue de fonctionner.

La configuration des canaux basés sur un webhook est détaillée sur leurs propres pages : Discord, Webhooks, Alertmanager, Pushover, Rocket.Chat, Mattermost, Grafana IRM, Jira Service Management, incident.io et Jira. Slack, Telegram, ntfy, MS Teams, Splunk, Google Chat et PagerDuty sont couverts par Autres canaux.

Le canal le plus simple. Chaque changement d’état (UP → DOWN, DOWN → UP) génère un email.

Configuration :

  1. Allez dans Alerting → Canaux (ou associez-en un directement depuis la dernière étape de l’assistant de création de monitor).
  2. Cliquez sur « Ajouter un canal »Email.
  3. Saisissez l’adresse de réception.
  4. Cliquez sur « Créer ».

L’email de notification contient le nom du monitor et son URL, le nouveau statut, la région qui a détecté le problème, et l’heure exacte du changement d’état.

Un canal ne s’applique pas à tous les monitors du simple fait d’exister. Vous le configurez soit :

  • À la création du monitor — la dernière étape de l’assistant « Nouveau monitor » permet de sélectionner des canaux existants (ou d’en créer un) directement.
  • Depuis la page de détail du monitor — associez, dissociez ou ajustez les types d’alerte d’un canal à tout moment.
  • Depuis Alerting → Canaux — la page du canal permet de l’appliquer à tous les monitors, ou à tous les monitors portant un tag donné, en une seule action.

Pour chaque canal associé à un monitor, vous pouvez activer ou désactiver indépendamment les types d’événements qu’il doit notifier :

  • Up / down — l’état de disponibilité du monitor change.
  • Expiration du certificat SSL — le certificat TLS du monitor approche de son expiration.
  • Expiration du domaine — l’enregistrement du domaine surveillé approche de son expiration.

Les trois sont activés par défaut. Décochez-en si, par exemple, vous voulez que votre canal Discord n’alerte que sur les pannes tandis que l’email porte aussi les avertissements d’expiration de certificat.

1 · CHECK Region fails retries + 1 in a row 2 · MONITOR STATUS Majority rule 1 region → partial · >½ → down all healthy → recovered 3 · ONE EVENT PER TRANSITION PARTIAL OUTAGE DOWN RECOVERED not re-sent while it lasts lists the failing regions with total downtime 4 · CHANNELS ATTACHED TO THE MONITOR Email Slack Discord PagerDuty Webhook Telegram +12 more Each channel picks the kinds it wants: up/down · SSL expiry · domain expiry. Muted monitors and maintenance windows send nothing.

Un check échoué isolé ne vous réveille jamais. Deux garde-fous s’appliquent, pilotés par les réglages du monitor :

  1. Fenêtre de retries — une région ne confirme une panne qu’après retries + 1 échecs consécutifs (défaut : 2). Le premier échec s’affiche degraded ; pour un monitor mono-région il envoie aussi un avertissement léger.
  2. Règle de majorité — un monitor multi-région n’est down que lorsque plus de la moitié de ses régions confirment la panne. Une seule région = panne partielle : statut orange et une alerte qui nomme cette région — vous savez que quelque chose cloche depuis ce point de vue, sans faux « tout est down ».

Le rétablissement est annoncé une fois, quand toutes les régions sont de nouveau saines. Chaque type d’alerte part une seule fois par transition, jamais répété tant que l’état dure. Règles complètes et schémas : Statut & uptime.

Pour chaque monitor, vous pouvez également configurer :

OptionDescriptionDéfaut
Nouveaux essaisÉchecs consécutifs tolérés avant que le monitor soit marqué down1
MuteSilencer les alertes d’un monitor sans mettre en pause ses checksDésactivé
  • Combinez email + Discord/Slack — email pour l’archive, chat pour la réactivité.
  • Utilisez les webhooks pour alimenter votre outil d’astreinte (PagerDuty, Opsgenie).
  • Passez un monitor en mute pendant une période bruyante connue plutôt que de le désactiver entièrement — les checks continuent, seules les alertes se taisent.
  • Testez vos canaux après configuration avec le bouton « Envoyer un test » à côté de chacun.
  • Surveillez les lignes « aucun canal » de la page Alertes — une alerte détectée mais jamais envoyée est l’oubli le plus courant après l’ajout de monitors.