Set-OPS-Public/roles/client_metrique
Daniel Allaire fba0df26c3 metriques : node_exporter mourait a chaque renouvellement de certificat
Le passage d'idempotence a trouve une PANNE, pas une imperfection. 17 taches
changed au second passage contre 924 au rejeu depuis zero — mais 13 d'entre
elles etaient « Activer et demarrer node_exporter », et Ansible ne le
redemarrait pas par maladresse : il le trouvait ARRETE.

Le dump du module : ActiveState inactive, SubState dead, ExecStart code=killed
status=1/HUP.

Cause : le script de synchro du certificat faisait try-reload-or-restart, qui
RECHARGE si l'unite declare un ExecReload — et Debian en declare un
(kill -HUP). node_exporter ne sait pas se recharger : il meurt sur SIGHUP. Le
commentaire du script affirmait le contraire ; c'est l'hypothese qui etait
fausse, pas le code.

Consequence : a chaque renouvellement (24 h), la collecte de metriques
s'arretait sur toute la flotte, en silence. Elle repartait au deploiement
suivant, ce qui rendait la panne invisible a qui deploie souvent.

Mesure sur backup-01 : reload alloy -> active, reload loki -> active, reload
node_exporter -> INACTIVE. Seul lui est concerne.

Corrige en restart. Preuve : synchro declenchee sur les 14, quatorze active.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-08-09 14:14:16 -04:00
..
defaults Zéro-confiance : flux Métriques chiffré (node_exporter TLS + scrape https) 2026-07-04 21:04:40 -04:00
handlers Set-OPS — moteur d'ecosystemes numeriques souverains (Alliance Boreale) 2026-06-24 20:17:46 -04:00
meta intégrations : le rôle déclare sa politique ; le cluster passe à l'hébergeur 2026-08-03 14:09:22 -04:00
tasks Zéro-confiance : flux Métriques chiffré (node_exporter TLS + scrape https) 2026-07-04 21:04:40 -04:00
templates metriques : node_exporter mourait a chaque renouvellement de certificat 2026-08-09 14:14:16 -04:00
README.md Set-OPS — moteur d'ecosystemes numeriques souverains (Alliance Boreale) 2026-06-24 20:17:46 -04:00

client_metrique

Intégration cliente métriques : installe node_exporter sur la VM pour qu'elle soit collectée par serveur_prometheus.

Rôle

  • Installe prometheus-node-exporter (paquet Debian).
  • Configure l'adresse d'écoute (:9100 par défaut).
  • Active et démarre le service.

Boucle complète

  1. On ajoute une VM au groupe client_metrique et on l'active.
  2. Ce rôle y installe node_exporter (:9100).
  3. serveur_prometheus dérive automatiquement la cible depuis l'inventaire (hôtes actifs de client_metrique) et la scrape.

Aucun edit manuel côté Prometheus.

Variables

Variable Défaut Rôle
client_metrique_adresse_ecoute :9100 --web.listen-address

Prérequis

  • Dépendance client_metrique requiert serveur_prometheus actif (déjà dans docs/dependances-groupes.yml).
  • Accès du serveur Prometheus au port 9100 (segmentation réseau / nftables).