Grafana — visualisation des métriques
Plateforme de visualisation et de dashboards pour des sources de données de métriques et de logs (Prometheus, InfluxDB, Elasticsearch, MySQL...). Ne collecte rien elle-même : elle interroge les sources configurées et affiche des tableaux de bord. Paquet/service grafana-server.
Nagios — monitoring
Système de supervision historique (fin des années 90), toujours largement déployé. Fonctionne par plugins : chaque vérification (état d'un service, seuil CPU, ping...) est un exécutable indépendant qui retourne un code de sortie standardisé (0=OK, 1=WARNING, 2=CRITICAL, 3=UNKNOWN) et un texte. Nagios orchestre ces checks selon une configuration déclarative d'hôtes et de services.
node_exporter — export métriques Linux
Agent officiel de l'écosystème Prometheus qui expose les métriques matérielles et système d'une machine Linux (CPU, mémoire, disque, réseau) sur un endpoint HTTP /metrics, au format texte Prometheus. Ne fait rien d'autre que collecter et exposer — c'est Prometheus qui vient le scraper. Binaire node_exporter.
ntopng — surveillance réseau
Outil d'analyse de trafic réseau en temps réel (successeur de ntop) : capture le trafic sur une ou plusieurs interfaces et présente une interface web avec le détail des flux, hosts, protocoles et volumes. S'appuie sur libpcap/PF_RING pour la capture.
Prometheus — monitoring / métriques
Système de monitoring et de base de données de séries temporelles (TSDB) open source, devenu le standard de facto de l'observabilité cloud-native. Fonctionne en pull : il va lui-même récupérer (scrape) les métriques exposées en HTTP par les cibles, plutôt que d'attendre qu'elles les lui envoient. Binaire prometheus, paquet prometheus.
snmpd — agent SNMP
Agent SNMP (Simple Network Management Protocol, Net-SNMP) qui expose l'état d'une machine (CPU, mémoire, interfaces réseau, process) à des outils de supervision tiers (Zabbix, PRTG, LibreNMS...) via des requêtes SNMP GET/WALK sur des OID standardisés (MIB). Très répandu pour la supervision d'équipements réseau (switches, routeurs) et de serveurs.
snmptrapd — réception de traps SNMP
Démon Net-SNMP qui reçoit les traps SNMP — des notifications poussées spontanément par un équipement (routeur, switch, onduleur...) lors d'un événement (lien down, seuil dépassé) — à la différence de snmpd qui répond à des requêtes de polling. Complète une supervision par polling avec de l'événementiel quasi temps réel.
sysstat — statistiques système
sysstat est une suite d'outils de collecte et d'analyse de statistiques système (CPU, mémoire, disque, réseau) : sar, iostat, mpstat, pidstat, vmstat-like. Un composant (sadc) collecte les métriques périodiquement en arrière-plan via un timer, ce qui permet ensuite de consulter l'historique de charge d'une machine (pas seulement l'instant présent).
Telegraf — collecte de métriques
Agent de collecte de métriques de l'écosystème InfluxDB (le "T" de la stack TICK), à l'architecture pilotée par plugins : plugins d'input (système, Docker, MySQL, MQTT...), de processing, et d'output (InfluxDB, Prometheus, Kafka...). Contrairement à node_exporter (passif, attend le scrape), Telegraf pousse activement les métriques vers ses destinations.
zabbix-agent — agent Zabbix
Agent installé sur chaque machine surveillée par une plateforme Zabbix : il collecte des métriques locales (CPU, mémoire, disque, process, logs) et les transmet au zabbix-server, soit en passif (le serveur interroge l'agent), soit en actif (l'agent envoie lui-même ses données, plus adapté aux gros parcs). Paquet zabbix-agent (ou zabbix-agent2, version moderne réécrite en Go avec support de plugins).
zabbix-server — serveur Zabbix
Serveur central de la plateforme de supervision Zabbix : reçoit les métriques des zabbix-agent déployés sur le parc, les stocke en base (MySQL/PostgreSQL), évalue les déclencheurs (triggers) et génère les alertes. S'accompagne généralement d'un frontend web (zabbix-frontend-php) pour la configuration et les dashboards.