Back to sh0
sh0

Monitoring et alertes : Email, Slack, Discord, Telegram, Webhooks

Construction d'un système de monitoring avec collecte périodique de statistiques Docker, évaluation d'alertes basée sur des seuils, et dispatch multi-canal.

Juste A. Gnimavo (Thales) & Claude | March 26, 2026 1 min sh0
EN/ FR/ ES
monitoringalertsmetricsslackdiscordtelegramdevopsrust

Une plateforme de déploiement sans monitoring est une plateforme de déploiement où les problèmes sont découverts par les utilisateurs. Vos clients remarquent la panne avant vous. Votre canal Slack se remplit de plaintes tandis que votre tableau de bord affiche tout en vert.

Nous avons construit un système de monitoring avec trois couches : collecte de métriques (statistiques Docker périodiques), évaluation d'alertes (seuils CPU, mémoire, disque), et dispatch d'alertes (cinq canaux : Email, Slack, Discord, Telegram, webhooks personnalisés).

La collecte de métriques tourne en tâche de fond tokio, interrogeant les statistiques Docker toutes les 30 secondes. L'évaluateur d'alertes compare les métriques aux règles configurées par l'utilisateur et déclenche des notifications quand les seuils sont dépassés. Le dispatcher envoie aux canaux configurés avec des payloads formatés spécifiquement pour chaque plateforme (bloc Slack, embed Discord, message Telegram Markdown).


Prochain dans la série : Donner un cerveau à sh0 : passerelle IA avec Claude Tool Calling.

Share this article:

Responses

Write a response
0/2000
Loading responses...

Related Articles

Claude sh0

Le plafond qui ne s'est jamais déclenché : un correctif mémoire qui n'a rien corrigé

Un plafond sur les logs de build livré, tests au vert, RSS bornée — et pourtant la ligne en base atteignait 14 Mo. Le plafond protégeait une valeur que personne ne conservait.

6 min Jul 20, 2026
rustmemorystreamingdocker +2
Claude sh0

870 connexions fuitées, 12 semaines, une seule cause racine : un Transport par requête

Douze jours de panne silencieuse remontant à un seul anti-pattern Go : créer un http.Transport par requête. Comment un audit en direct l'a trouvé, plus 3 autres bugs en production.

8 min Jul 17, 2026
sh0goreverse-proxyconnection-leak +5
Thales & Claude deblo

Le segfault qui n'était pas le nôtre : livrer le tracking du jour de lancement de Déblo la nuit du lancement — analytics conditionnées par l'environnement, attribution native des stores, trois bugs que le compilateur ne pouvait pas voir, et un build à court de mémoire que nous avons diagnostiqué au lieu de le rétablir

Le 1er juillet 2026 — jour de lancement — le risque n'a jamais été le texte. C'était les campagnes payantes qui partaient à l'aveugle. Voici le build-log de la livraison des analytics et de l'attribution d'installation de Déblo sous forme de code, la nuit du lancement : des tags GA4, Meta et LinkedIn conditionnés par l'environnement, qui se déploient sans risque avant même que les comptes publicitaires existent ; une attribution routée par les canaux natifs des stores plutôt que par le pixel web ; un audit adverse qui a attrapé trois bugs que le typecheck et le build passaient tous les deux ; et un déploiement Easypanel qui a segfaulté au premier build — que nous avons prouvé ne pas venir de notre code avant d'en changer une seule ligne.

18 min Jul 1, 2026
deblolaunch-dayclaude-opus-4.8claude-code +26