Stage de 1ère année au Conseil Départemental de la Dordogne (CD24) — système de supervision d'infrastructure basé sur Prometheus, Grafana et Alertmanager, déployé en Docker sur une vingtaine de serveurs du SOC.
Mise en place d'un système complet de supervision des serveurs et services du SOC (Security Operations Center) du Conseil Départemental de la Dordogne, durant mon stage de 1ère année.
Le projet a démarré par une étude comparative documentée des principales solutions de supervision open-source (Nagios-Core, Zabbix, Prometheus) avec analyse des forces et faiblesses de chacune. La solution retenue est la stack Prometheus + Grafana + Alertmanager, déployée en Docker.
L'architecture est en deux parties : un module client installable sur chaque serveur cible (déploie Node Exporter via Docker + des scripts shell exécutés en cron qui collectent l'état des services et exportent les métriques au format texte Prometheus), et un module dashboard centralisé (Prometheus pour scraper, Grafana pour visualiser, Alertmanager pour router les alertes vers le webhook Shuffle du SOC).
Le système surveille une vingtaine de serveurs (Wazuh, Graylog, MISP, Iris, Velociraptor, Greenbone, etc.), monitore l'accessibilité et les certificats TLS des sites web via un script Python custom (website-info.py), et inclut une intégration Proxmox VE via pve-exporter. Des règles d'alerting (alerts.yml) déclenchent des notifications en cas de dépassement de seuils ou de service down.
Projet livré clé en main avec documentation complète : choix logiciel, procédure d'installation et documentation technique de la stack.
L'objectif central du projet est précisément la vérification continue des conditions de continuité des services informatiques : scraping toutes les 15 secondes, règles d'alerting (alerts.yml) déclenchant des notifications via webhook Shuffle en cas de service down ou de seuil dépassé, monitoring de l'accessibilité et des certificats TLS des sites web internes via un script Python custom.
Le projet a démarré par une analyse comparative documentée des solutions du marché (Nagios-Core, Zabbix, Prometheus) avec étude des points forts et faibles de chacune.
Service déployé en production sur l'infrastructure du SOC : stack Docker côté dashboard, script install.sh automatisant l'installation côté client (création du textfile_collector, déploiement Node Exporter, copie des scripts dans /usr/local/bin/, configuration du cron root), procédure documentée pour intégrer une nouvelle cible.
Accompagnement formel des utilisateurs SI du CD24 via une documentation complète en 3 volets : 'Choix logiciel' (justifie l'architecture retenue), 'Documentation installation' (procédure pas-à-pas pour client et serveur), 'Documentation technique' (explique le rôle de chaque composant et les flux de communication). Schéma d'architecture fourni pour les équipes opérationnelles.