MONITORING RESEAUX
I. La Supervision des Réseaux
1. Introduction
La supervision des réseaux est un processus essentiel pour assurer la fiabilité, la
sécurité et la performance des infrastructures informatiques. Elle permet de détecter
et de prévenir les incidents, d'assurer une qualité de service optimale et d'améliorer la
réactivité des équipes techniques.
Elle s'appuie sur divers outils et protocoles pour assurer le bon fonctionnement des
équipements réseau (routeurs, commutateurs, pare-feu, serveurs, applications, etc.).
La supervision offre une vision globale de l’état du réseau en temps réel et aide à
prévenir les interruptions de service. Un bon système de supervision intègre
également des fonctionnalités de reporting et d’historisation des événements,
permettant ainsi une analyse approfondie des tendances de performance et des
incidents passés.
2. Objectifs et enjeux
L'objectif principal de la supervision des réseaux est d'assurer un fonctionnement
optimal des infrastructures informatiques. Cela comprend :
• Garantir la disponibilité des ressources réseau : en identifiant et résolvant
rapidement les défaillances des équipements. Cela inclut la surveillance de
l’état des connexions, des liens réseau et des serveurs pour éviter les
interruptions de service.
• Assurer une réponse rapide en cas de panne : grâce à un système d'alertes
qui notifie les administrateurs dès qu'un problème est détecté. Les notifications
peuvent être envoyées par e-mail, SMS ou via des applications de messagerie
instantanée.
• Identifier les points faibles de l'infrastructure : en analysant les tendances
et les performances des équipements. La supervision permet d'identifier les
goulets d'étranglement et les zones à risque.
• Optimiser les performances et la qualité de service : en ajustant la
configuration des équipements et en évitant les engorgements du réseau. Cela
1
passe par l’ajustement dynamique des ressources et la priorisation du trafic
réseau selon les besoins critiques de l’entreprise.
• Garantir la sécurité des réseaux : en détectant les comportements anormaux,
tels que les tentatives d'intrusion, les attaques DDoS et les accès non autorisés.
3. Différence entre supervision, monitoring et métrologie
Ces trois concepts sont souvent confondus, mais ils recouvrent des aspects différents
de la gestion des réseaux :
• Supervision : Elle concerne la surveillance en temps réel des équipements et
des services réseau, avec des alertes en cas d'incident. Elle permet une
réaction immédiate en cas de défaillance.
• Monitoring : Il s'agit du suivi continu des performances du réseau afin de
détecter les dégradations progressives. Le monitoring fournit des données
historiques exploitables pour ajuster les performances du réseau.
• Métrologie : C'est l'analyse approfondie des données de performance du
réseau pour en extraire des indicateurs clés. Elle permet de prévoir les besoins
futurs et d'optimiser l’infrastructure en fonction des tendances observées.
4. Outils et technologies de supervision
Il existe plusieurs outils permettant d'assurer une supervision efficace des réseaux :
4.1 Systèmes de supervision centralisée
Ces solutions permettent de surveiller les performances du réseau et de détecter les
anomalies en temps réel :
• Nagios : Un des outils de supervision open-source les plus populaires,
permettant de surveiller aussi bien les équipements réseau que les serveurs
et applications.
• Zabbix : Outil offrant des fonctionnalités avancées de surveillance et
d’analyse des performances réseau.
• Centreon : Solution dérivée de Nagios qui propose une interface plus intuitive
et une intégration avec les standards ITIL.
• PRTG Network Monitor : Outil de supervision réseau avec une interface
graphique intuitive et des rapports détaillés.
4.2 Protocoles utilisés
Pour assurer la supervision des réseaux, plusieurs protocoles sont employés :
2
• SNMP (Simple Network Management Protocol) : Permet de récupérer des
informations sur l'état des équipements réseau. SNMP fonctionne sur un
modèle client-serveur où les équipements surveillés envoient des informations
à un gestionnaire SNMP.
• ICMP (Internet Control Message Protocol) : Utilisé pour tester la connectivité
des équipements réseau via des commandes comme ping. Il permet de vérifier
si un hôte est joignable et de mesurer le temps de réponse.
• NetFlow : Fournit des informations détaillées sur le trafic réseau, telles que les
adresses IP source et destination, les ports utilisés et le volume de données
échangé.
4.3 Tableaux de bord et visualisation des données
Pour faciliter l'analyse des données collectées, plusieurs solutions de visualisation sont
disponibles :
• Grafana : Plateforme open-source permettant de créer des tableaux de bord
interactifs avec des graphiques avancés.
• Kibana : Outil de visualisation intégré à Elasticsearch pour analyser les
journaux et événements du réseau.
• Cacti : Utilisé pour surveiller la bande passante et les performances des
équipements réseau sous forme de graphiques.
Ces outils permettent aux administrateurs réseau d’avoir une vue d’ensemble et de
réagir rapidement aux incidents tout en optimisant la gestion des ressources.
II. Le Monitoring des Réseaux
1. Définition et concepts clés du monitoring
Le monitoring des réseaux est une discipline essentielle qui consiste à surveiller en
continu les performances et l’état des infrastructures réseau afin de détecter les
anomalies, prévenir les pannes et assurer une qualité de service optimale.
Contrairement à la supervision, qui gère les alertes et incidents en temps réel, le
monitoring analyse à plus long terme les tendances et les performances du réseau. Il
permet d’identifier les goulots d’étranglement, les baisses de performance et les
3
comportements anormaux afin d’optimiser les ressources réseau et garantir leur bon
fonctionnement.
Le monitoring des réseaux s'appuie sur plusieurs méthodes :
• Surveillance active : envoi de requêtes et tests de connectivité pour évaluer
la réponse des équipements.
• Surveillance passive : analyse des flux réseau en temps réel sans générer de
trafic supplémentaire.
• Collecte de métriques : mesure des indicateurs de performance pour anticiper
d'éventuelles dégradations.
2. Paramètres surveillés
Le monitoring réseau repose sur la surveillance de plusieurs paramètres clés qui
influencent la qualité de service et les performances des infrastructures.
• Latence : Temps nécessaire pour qu'un paquet de données parcoure le réseau
d'un point A à un point B. Une latence élevée peut indiquer des congestions ou
des problèmes de routage.
• Bande passante : Capacité maximale de transmission des données sur un lien
réseau. Une faible bande passante peut causer des ralentissements et une
mauvaise expérience utilisateur.
• Disponibilité : Mesure du temps pendant lequel une ressource réseau
(serveur, routeur, switch) est fonctionnelle et accessible.
• Taux d'erreur : Nombre de paquets perdus ou corrompus, ce qui peut être
causé par des interconnexions défectueuses ou des interférences.
• Jitter : Variation du temps de transmission des paquets, qui peut affecter la
qualité des applications en temps réel comme la voix sur IP (VoIP) et la
visioconférence.
3. Techniques et protocoles de monitoring
Pour effectuer un monitoring efficace, plusieurs protocoles et technologies sont
utilisés afin de collecter des données de performance en temps réel ou en mode
historique.
3.1 ICMP (Internet Control Message Protocol)
ICMP est un protocole utilisé pour envoyer des messages de diagnostic et de rapport
d'erreur entre les équipements réseau. La commande ping est un exemple typique
4
d'utilisation d'ICMP, permettant de tester la connectivité entre deux appareils et de
mesurer la latence.
3.2 SNMP (Simple Network Management Protocol)
SNMP est un protocole standard de gestion réseau qui permet de surveiller et de
contrôler les équipements connectés (routeurs, commutateurs, serveurs,
imprimantes, etc.). Il repose sur l’utilisation d'agents installés sur les équipements, qui
collectent des informations et les transmettent à un gestionnaire SNMP.
• MIB (Management Information Base) : Base de données contenant des
informations sur l'état et la configuration des équipements supervisés.
• OID (Object Identifier) : Identifiants uniques permettant d'accéder à des
informations précises dans la MIB.
3.3 NetFlow
NetFlow est un protocole développé par Cisco permettant l'analyse des flux de trafic
réseau. Contrairement à SNMP qui fournit des informations sur l’état des équipements,
NetFlow donne une vue détaillée des données qui circulent sur le réseau :
• Identification des applications et des utilisateurs qui génèrent du trafic.
• Détection des anomalies et des attaques potentielles (ex. : transferts de
données inhabituels).
• Optimisation de la bande passante et des politiques de gestion du trafic.
4. Solutions et outils open-source et propriétaires
Le monitoring des réseaux repose sur différents outils permettant de collecter,
analyser et visualiser les performances. Ces outils peuvent être classés en deux
catégories : open-source et propriétaires.
4.1 Outils open-source
• Nagios : L'un des outils de monitoring les plus populaires, offrant des alertes
en cas de défaillance et un système de surveillance avancé.
• Zabbix : Solution complète qui permet de surveiller les infrastructures réseau,
les serveurs et les applications, avec des dashboards personnalisables.
• Prometheus : Outil puissant de monitoring et d'alerte, conçu pour une
intégration avec des systèmes cloud et des microservices.
5
• Cacti : Outil de surveillance basé sur SNMP qui permet de visualiser les
performances des équipements réseau sous forme de graphiques.
4.2 Outils propriétaires
• PRTG Network Monitor : Solution tout-en-un offrant une interface intuitive et
des rapports avancés pour la surveillance des infrastructures réseau.
• SolarWinds Network Performance Monitor : Outil de monitoring puissant qui
fournit des informations détaillées sur la performance du réseau et des analyses
de tendance.
• ManageEngine OpManager : Plateforme de surveillance réseau qui inclut des
alertes en temps réel, des tableaux de bord personnalisables et des outils
d'analyse de trafic.
L'utilisation d'un outil de monitoring adapté aux besoins de l'entreprise permet
d'assurer une gestion efficace du réseau et de garantir une expérience utilisateur
optimale en prévenant les problèmes avant qu'ils ne deviennent critiques.
6
III. Métrologie des Réseaux
1. Définition et importance de la métrologie
La métrologie des réseaux est l’ensemble des techniques et méthodes permettant de
mesurer, analyser et interpréter les performances des infrastructures réseau. Elle joue
un rôle essentiel dans l’optimisation des ressources, la détection des anomalies et
l’amélioration continue des services informatiques.
L’importance de la métrologie réseau réside dans :
• L’optimisation des performances : Elle permet d’ajuster les paramètres du
réseau pour garantir un fonctionnement efficace.
• La gestion proactive des incidents : En surveillant les tendances des
performances, il est possible d’anticiper et de prévenir les pannes.
• L’assurance de la qualité de service (QoS) : Elle permet d’évaluer si les
engagements de qualité sont respectés.
• La conformité aux normes et SLA : Les données de métrologie aident à vérifier
la conformité aux accords de niveau de service (SLA).
2. Indicateurs de performance des réseaux
La métrologie des réseaux repose sur plusieurs indicateurs permettant d’évaluer la
qualité et la performance des infrastructures.
2.1 QoS (Quality of Service)
La qualité de service (QoS) désigne l’ensemble des mécanismes permettant d’assurer
un bon niveau de performance du réseau pour les utilisateurs. Parmi les principaux
paramètres surveillés :
• Latence : Temps mis par un paquet pour voyager d'une source à une
destination.
• Jitter : Variabilité des temps de latence entre les paquets, importante pour les
services en temps réel (VoIP, streaming).
• Taux de perte de paquets : Pourcentage de paquets perdus durant la
transmission.
• Bande passante utilisée : Quantité de données transmises sur une période
donnée.
7
2.2 SLA (Service Level Agreement)
Les SLA sont des engagements contractuels entre un fournisseur de services et un
client garantissant un certain niveau de performance. Les indicateurs suivis sont :
• Disponibilité du service : Mesure du pourcentage de temps de fonctionnement
sans interruption.
• Temps de résolution des incidents : Délai moyen pour résoudre un problème
signalé.
• Fiabilité : Fréquence et durée moyenne des interruptions de service.
2.3 KPI (Key Performance Indicators)
Les KPI sont des indicateurs clés utilisés pour suivre les performances du réseau.
Exemples :
• Taux d’utilisation du processeur et de la mémoire des équipements réseau.
• Nombre de sessions concurrentes sur un pare-feu ou un routeur.
• Volume de trafic échangé entre différents segments de réseau.
3. Collecte et analyse des données
La collecte des données réseau est essentielle pour analyser les performances et
optimiser les infrastructures. Elle repose sur plusieurs méthodes :
3.1 Méthodes de capture des données
• SNMP (Simple Network Management Protocol) : Utilisé pour collecter des
informations sur l’état des équipements réseau.
• NetFlow / sFlow / IPFIX : Protocoles permettant d’analyser les flux de trafic
réseau en identifiant les sources, destinations et volumes de données.
• ICMP (Internet Control Message Protocol) : Utilisé pour tester la connectivité
et mesurer la latence.
• Syslog : Collecte des journaux d’événements des équipements réseau.
3.2 Stockage et traitement des logs
Une fois les données collectées, elles doivent être stockées et analysées pour identifier
les tendances et anticiper les problèmes. Plusieurs solutions existent :
• Elasticsearch : Moteur de recherche et d’analyse de journaux réseau.
8
• Grafana : Outil de visualisation et de monitoring en temps réel.
• Splunk : Plateforme d’analyse des logs réseau et de détection des anomalies.
4. Outils de métrologie réseau
Plusieurs outils permettent d'effectuer des mesures et d'analyser les performances
des réseaux :
4.1 Outils de capture et d'analyse de trafic
• Wireshark : Logiciel d’analyse des paquets réseau en temps réel.
• TCPDump : Outil en ligne de commande pour capturer les paquets réseau.
4.2 Outils de surveillance graphique
• Cacti : Plateforme de visualisation des performances réseau basée sur SNMP.
• MRTG (Multi Router Traffic Grapher) : Permet de surveiller l’évolution de la
bande passante.
4.3 Outils d’analyse avancée
• Nagios : Supervision des infrastructures réseau et des performances des
serveurs.
• Zabbix : Monitoring réseau avancé avec alertes et tableaux de bord interactifs.
Ces outils permettent aux administrateurs réseau d'obtenir une vision globale des
performances et d'identifier les problèmes avant qu'ils n'affectent les utilisateurs
finaux.
9
IV. Méthode ITIL
1. Introduction à ITIL et ses principes fondamentaux
L'ITIL (Information Technology Infrastructure Library) est un ensemble de bonnes
pratiques pour la gestion des services informatiques. Son objectif est d'assurer une
meilleure efficacité et qualité des services IT en optimisant les processus de gestion
des infrastructures, des applications et des services fournis aux utilisateurs.
ITIL repose sur plusieurs principes fondamentaux :
• L'orientation client : L'objectif principal est de garantir que les services
informatiques répondent aux besoins des utilisateurs et des entreprises.
• L'amélioration continue : ITIL met l'accent sur une évolution permanente des
services IT pour les rendre plus efficaces et performants.
• La gestion basée sur les processus : ITIL propose une approche structurée
avec des processus clairement définis pour garantir la stabilité et la cohérence
des services.
• La mesure des performances : L'utilisation d'indicateurs de performance (KPI)
permet d'évaluer l'efficacité des services et d'apporter des améliorations si
nécessaire.
• L'alignement des services IT avec les objectifs de l'entreprise : ITIL veille à ce
que l'IT soit au service des besoins stratégiques et opérationnels de
l'organisation.
2. Gestion des incidents et des problèmes
La gestion des incidents et des problèmes est une composante essentielle d'ITIL pour
assurer la disponibilité et la stabilité des services informatiques.
2.1 Gestion des incidents
Un incident est un événement imprévu qui perturbe ou dégrade un service IT. L'objectif
du processus de gestion des incidents est de restaurer rapidement le service normal
avec un impact minimal sur les opérations.
Les étapes principales de la gestion des incidents :
1. Identification et enregistrement : Détection de l'incident via des outils de
supervision ou signalement par un utilisateur.
10
2. Classification et prioritisation : Evaluation de l'impact et de l'urgence pour
attribuer un niveau de priorité.
3. Diagnostic initial : Analyse du problème et recherche d'une solution rapide.
4. Escalade si nécessaire : Transmission à un niveau supérieur si une résolution
immédiate n'est pas possible.
5. Résolution et restauration du service : Implémentation de la solution et
vérification du bon fonctionnement.
6. Clôture de l'incident : Documentation et analyse pour éviter la récurrence de
l'incident.
2.2 Gestion des problèmes
Un problème est la cause sous-jacente d'un ou plusieurs incidents répétitifs. La gestion
des problèmes vise à identifier et éliminer ces causes profondes pour réduire le risque
d'incidents futurs.
Les principales activités de la gestion des problèmes :
• Détection proactive des problèmes : Surveillance des tendances et des
performances pour anticiper les anomalies.
• Analyse des causes racines (RCA - Root Cause Analysis) : Investigation
approfondie pour identifier l'origine du problème.
• Mise en place de solutions correctives : Déploiement de mesures pour
éliminer la cause du problème.
• Base de connaissances : Documentation des incidents et problèmes pour
faciliter leur gestion future.
3. Gestion des services et des niveaux de service (SLA)
La gestion des services ITIL vise à s'assurer que les services fournis correspondent aux
attentes des utilisateurs et aux exigences de l'entreprise.
3.1 Gestion des services
La gestion des services implique :
• L'identification des besoins des utilisateurs.
• La définition et la conception des services IT.
• La mise en place des processus pour assurer la continuité des services.
• Le suivi des performances et l'amélioration des services.
11
3.2 SLA (Service Level Agreement)
Un SLA est un contrat définissant les niveaux de service attendus entre un fournisseur
de services et ses clients. Il fixe des engagements clairs en termes de performance, de
disponibilité et de réactivité.
Les principaux éléments d'un SLA sont :
• Disponibilité des services (exemple : 99,9 % du temps de fonctionnement).
• Temps de réponse aux incidents (exemple : réponse en moins de 30 minutes
pour un incident critique).
• Temps de résolution (exemple : correction d'une panne majeure en moins de 4
heures).
• Pénalités en cas de non-respect des engagements.
Le suivi des SLA se fait via des tableaux de bord et des indicateurs de performance
(KPI), permettant d'assurer le respect des engagements et d'ajuster les ressources en
conséquence.
4. Intégration d'ITIL dans la supervision des réseaux
L'application des principes ITIL à la supervision des réseaux améliore la gestion des
infrastructures et réduit le risque d'incidents critiques.
4.1. Surveillance proactive
• Utilisation d'outils de supervision (Nagios, Zabbix, PRTG) pour détecter les
anomalies avant qu'elles n'impactent les utilisateurs.
• Mise en place de seuils d'alerte basés sur les niveaux de service définis dans
les SLA.
4.2. Gestion des incidents automatisée
• Intégration des outils de supervision avec les systèmes de gestion ITIL
(ServiceNow, BMC Remedy) pour créer automatiquement des tickets en cas
d'incident.
• Automatisation des réponses aux incidents courants pour réduire le temps
de résolution.
12
4.3 Reporting et amélioration continue
• Analyse des données de supervision pour identifier les tendances et proposer
des améliorations.
• Utilisation des rapports de performance pour ajuster les ressources et
optimiser la gestion du réseau.
L'application de la méthode ITIL permet donc une gestion plus efficace et structurée de
la supervision des réseaux, améliorant la réactivité et la satisfaction des utilisateurs.
V. Étude de Cas (SNMP, Nagios, ...)
[Link]ésentation des outils de supervision et de monitoring
Dans le cadre de la supervision et du monitoring des réseaux, plusieurs outils sont
largement utilisés pour assurer une surveillance efficace des infrastructures. Ces outils
13
permettent de collecter des données en temps réel, de générer des alertes en cas
d'incident et d'offrir une analyse approfondie des performances du réseau.
1.1 SNMP (Simple Network Management Protocol)
SNMP est un protocole de gestion des réseaux qui permet d'interroger, de collecter et
de surveiller des informations provenant des équipements réseau (routeurs,
commutateurs, serveurs, etc.). Il repose sur trois composants :
• Agent SNMP : Installé sur l'équipement surveillé, il collecte et stocke des
informations dans une base de données appelée MIB (Management Information
Base).
• Gestionnaire SNMP : Une application qui interroge les agents SNMP et collecte
les données pour les analyser.
• MIB (Management Information Base) : Base de données contenant les
informations sur l'état et la configuration des équipements.
1.2 Nagios
Nagios est une solution open-source très populaire de supervision des infrastructures
réseau. Il permet de surveiller en temps réel l'état des services et des équipements, et
de notifier les administrateurs en cas d'anomalies.
Les principales fonctionnalités de Nagios incluent :
• La surveillance des serveurs, applications et équipements réseau.
• La gestion des alertes et des notifications.
• L'intégration avec d'autres outils de supervision comme Zabbix et Centreon.
• La possibilité d'ajouter des plugins pour surveiller des services spécifiques.
2. Configuration et déploiement de SNMP
Le protocole SNMP doit être correctement configuré pour collecter les informations
pertinentes des équipements réseau. Voici les étapes générales de déploiement :
2.1 Installation d'un agent SNMP
1. Sur un système Linux :
sudo apt update
sudo apt install snmpd
14
2. Sur un système Windows :
a. Installer le service SNMP via les options Windows Features.
b. Configurer les communautés SNMP dans la console de gestion des
services.
2.2 Configuration du fichier [Link]
• Modifier le fichier de configuration (/etc/snmp/[Link] sur Linux) pour
définir les communautés SNMP et les droits d'accès.
• Exemples de directives :
rocommunity public [Link]/24
syslocation "Data Center"
syscontact admin@[Link]
• Redémarrer le service SNMP :
sudo systemctl restart snmpd
2.3 Tests et vérification de la communication SNMP
Utilisation de la commande snmpwalk pour vérifier la récupération des données :
snmpwalk -v 2c -c public [Link]
3 Installation et utilisation de Nagios
Nagios permet de superviser l'ensemble des équipements réseau et de gérer les alertes
en cas d'incident. Voici les étapes d'installation et de configuration de Nagios sous
Linux.
3.1 Installation de Nagios
Sur un serveur Linux (Debian/Ubuntu) :
sudo apt update
sudo apt install nagios4 nagios-plugins
Sur un serveur CentOS/RHEL :
sudo yum install epel-release
sudo yum install nagios nagios-plugins-all
15
3.2 Configuration de Nagios
1. Ajout d'un hôte à surveiller
a. Modifier le fichier de configuration des hôtes
/etc/nagios/objects/[Link].
b. Ajouter une définition d'hôte :
define host {
use linux-server
host_name serveur1
address [Link]
check_command check-host-alive
}
c. Redémarrer Nagios :
sudo systemctl restart nagios
2. Ajout de services à superviser
a. Exemple de définition pour surveiller un service HTTP :
define service {
use generic-service
host_name serveur1
service_description HTTP
check_command check_http
}
3. Accès à l'interface web
a. Accéder à l'interface via [Link]
b. Se connecter avec les identifiants configurés lors de l'installation.
4. Cas pratiques et simulations de scénarios réels
L'utilisation combinée de SNMP et Nagios permet d'assurer une surveillance efficace
des réseaux. Voici quelques scénarios concrets :
4.1 Surveillance d'un réseau d'entreprise
• Mise en place de Nagios pour surveiller les routeurs, commutateurs et serveurs.
16
• Configuration d'agents SNMP sur les équipements pour récupérer les
informations sur la bande passante et l'utilisation des ressources.
• Mise en place d'alertes pour avertir en cas de surcharge du réseau.
4.2 Détection proactive des pannes
• Utilisation de Nagios pour surveiller la disponibilité des services critiques (bases
de données, serveurs web, applications métiers).
• Mise en place de notifications par e-mail et SMS pour informer les
administrateurs des défaillances.
• Intégration avec des outils d'analyse comme Grafana pour visualiser les
tendances de performance.
17