Set-OPS-Public/roles/serveur_prometheus
Daniel Allaire 72a5fdbbc4 Portabilité from-zero : 4 correctifs débusqués par la reconstruction
Reconstruction complète prouvée (14 VM + sauvegardes + AC supprimées, puis
`make myDay` rebâtit tout ; `make valider` entièrement vert). Bugs corrigés :

- client_pki : empreinte du root CA dérivée dynamiquement de l'autorité
  (au lieu d'une valeur figée en Vault) — une AC régénérée a une empreinte neuve.
- serveur_keycloak : assignation de rôle tolérante aux utilisateurs absents
  (annuaire vide sur un from-zero).
- serveur_prometheus : ne scrute que les hôtes ACTIFS (client_metrique ∩ hotes_actifs).
- nftables résolu : compatible Docker — remplace la seule table setops_flux (pas de
  flush ruleset, préserve les tables Docker) + forward autorise docker0/established.
  Sans ça, forward policy drop coupait Collabora (conteneur).

Ajoute playbooks/proxmox/supprimer_vm_debian.yml (suppression par VMID, garde-fous).

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2026-07-07 06:45:12 -04:00
..
defaults Zéro-confiance : flux Métriques chiffré (node_exporter TLS + scrape https) 2026-07-04 21:04:40 -04:00
handlers Rendre le dry-run (--check) fiable sur les rôles applicatifs 2026-07-01 21:01:53 -04:00
meta Reconstruction propre : orchestrateur ordonné, registre des flux + pare-feu 2026-07-07 03:08:09 -04:00
tasks Rendre le dry-run (--check) fiable sur les rôles applicatifs 2026-07-01 21:01:53 -04:00
templates Portabilité from-zero : 4 correctifs débusqués par la reconstruction 2026-07-07 06:45:12 -04:00
README.md Set-OPS — moteur d'ecosystemes numeriques souverains (Alliance Boreale) 2026-06-24 20:17:46 -04:00

serveur_prometheus

Collecte de métriques Prometheus (paquet Debian), plateforme d'observabilité.

Rôle

  • Installe prometheus.
  • Déploie /etc/prometheus/prometheus.yml : job prometheus (soi-même) + job node dont les cibles sont dérivées de l'inventaire (hôtes actifs de client_metriquenode_exporter sur :9100).
  • Rétention via /etc/default/prometheus (--storage.tsdb.retention.time).
  • promtool check config avant rechargement (handler Valider et recharger prometheus).

Cibles dérivées de l'inventaire

Comme la zone DNS, la liste de scrape se construit toute seule : ajouter un hôte au groupe client_metrique et l'activer suffit à le faire scraper. Aucun edit manuel.

Variables principales

Variable Défaut Rôle
serveur_prometheus_intervalle 15s scrape_interval
serveur_prometheus_retention 15d Rétention TSDB
serveur_prometheus_groupe_metriques client_metrique Groupe source des cibles
serveur_prometheus_port_node 9100 Port node_exporter
serveur_prometheus_cibles_supplementaires [] Jobs additionnels libres

Intégration

  • Côté VM : node_exporter est installé par le futur rôle client_metrique.
  • serveur_grafana consommera Prometheus comme datasource.

Hors périmètre

  • Alerting (Alertmanager), règles d'alerte, fédération — phases dédiées.