Retour
Supervision SOC CD24

Supervision SOC CD24

Stage de 1ère année au Conseil Départemental de la Dordogne (CD24) — système de supervision d'infrastructure basé sur Prometheus, Grafana et Alertmanager, déployé en Docker sur une vingtaine de serveurs du SOC.

Description

Mise en place d'un système complet de supervision des serveurs et services du SOC (Security Operations Center) du Conseil Départemental de la Dordogne, durant mon stage de 1ère année.

Le projet a démarré par une étude comparative documentée des principales solutions de supervision open-source (Nagios-Core, Zabbix, Prometheus) avec analyse des forces et faiblesses de chacune. La solution retenue est la stack Prometheus + Grafana + Alertmanager, déployée en Docker.

L'architecture est en deux parties : un module client installable sur chaque serveur cible (déploie Node Exporter via Docker + des scripts shell exécutés en cron qui collectent l'état des services et exportent les métriques au format texte Prometheus), et un module dashboard centralisé (Prometheus pour scraper, Grafana pour visualiser, Alertmanager pour router les alertes vers le webhook Shuffle du SOC).

Le système surveille une vingtaine de serveurs (Wazuh, Graylog, MISP, Iris, Velociraptor, Greenbone, etc.), monitore l'accessibilité et les certificats TLS des sites web via un script Python custom (website-info.py), et inclut une intégration Proxmox VE via pve-exporter. Des règles d'alerting (alerts.yml) déclenchent des notifications en cas de dépassement de seuils ou de service down.

Projet livré clé en main avec documentation complète : choix logiciel, procédure d'installation et documentation technique de la stack.

Technologies utilisées

Prometheus Grafana Alertmanager Node Exporter Docker Bash Python PromQL Cron YAML

Compétences BTS SIO

B1 Gérer le patrimoine informatique
B1.4 Vérifier les conditions de la continuité d'un service informatique

L'objectif central du projet est précisément la vérification continue des conditions de continuité des services informatiques : scraping toutes les 15 secondes, règles d'alerting (alerts.yml) déclenchant des notifications via webhook Shuffle en cas de service down ou de seuil dépassé, monitoring de l'accessibilité et des certificats TLS des sites web internes via un script Python custom.

B4 Travailler en mode projet
B4.1 Analyser les objectifs et les modalités d'organisation d'un projet

Le projet a démarré par une analyse comparative documentée des solutions du marché (Nagios-Core, Zabbix, Prometheus) avec étude des points forts et faibles de chacune.

B5 Mettre à disposition des utilisateurs un service informatique
B5.2 Déployer un service

Service déployé en production sur l'infrastructure du SOC : stack Docker côté dashboard, script install.sh automatisant l'installation côté client (création du textfile_collector, déploiement Node Exporter, copie des scripts dans /usr/local/bin/, configuration du cron root), procédure documentée pour intégrer une nouvelle cible.

B5.3 Accompagner les utilisateurs dans la mise en place d'un service

Accompagnement formel des utilisateurs SI du CD24 via une documentation complète en 3 volets : 'Choix logiciel' (justifie l'architecture retenue), 'Documentation installation' (procédure pas-à-pas pour client et serveur), 'Documentation technique' (explique le rôle de chaque composant et les flux de communication). Schéma d'architecture fourni pour les équipes opérationnelles.

Informations

Type Propriétaire