Set-OPS-Public/roles/serveur_prometheus
Daniel Allaire f82630de6c Rendre le dry-run (--check) fiable sur les rôles applicatifs
« Vérifier » échouait faussement sur un hôte frais : les tâches
« démarrer service » et les handlers restart/reload/validate touchent
un paquet que --check n'installe pas vraiment → service/fichier absent
→ faux fatal, qui bloquait le déploiement (le dry-run doit passer pour
débloquer « Déployer »).

Ajout de « when: not ansible_check_mode » sur ces tâches + handlers des
13 rôles serveur_* (29 gardes). Sautées en dry-run, inchangées en réel.
Validé : powerdns dry-run failed=0 ; ansible-lint 0 échec ; 19 playbooks
syntax-OK.

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2026-07-01 21:01:53 -04:00
..
defaults Set-OPS — moteur d'ecosystemes numeriques souverains (Alliance Boreale) 2026-06-24 20:17:46 -04:00
handlers Rendre le dry-run (--check) fiable sur les rôles applicatifs 2026-07-01 21:01:53 -04:00
meta Dimensionner les ressources VM depuis les logiciels hébergés 2026-06-30 10:07:04 -04:00
tasks Rendre le dry-run (--check) fiable sur les rôles applicatifs 2026-07-01 21:01:53 -04:00
templates Set-OPS — moteur d'ecosystemes numeriques souverains (Alliance Boreale) 2026-06-24 20:17:46 -04:00
README.md Set-OPS — moteur d'ecosystemes numeriques souverains (Alliance Boreale) 2026-06-24 20:17:46 -04:00

serveur_prometheus

Collecte de métriques Prometheus (paquet Debian), plateforme d'observabilité.

Rôle

  • Installe prometheus.
  • Déploie /etc/prometheus/prometheus.yml : job prometheus (soi-même) + job node dont les cibles sont dérivées de l'inventaire (hôtes actifs de client_metriquenode_exporter sur :9100).
  • Rétention via /etc/default/prometheus (--storage.tsdb.retention.time).
  • promtool check config avant rechargement (handler Valider et recharger prometheus).

Cibles dérivées de l'inventaire

Comme la zone DNS, la liste de scrape se construit toute seule : ajouter un hôte au groupe client_metrique et l'activer suffit à le faire scraper. Aucun edit manuel.

Variables principales

Variable Défaut Rôle
serveur_prometheus_intervalle 15s scrape_interval
serveur_prometheus_retention 15d Rétention TSDB
serveur_prometheus_groupe_metriques client_metrique Groupe source des cibles
serveur_prometheus_port_node 9100 Port node_exporter
serveur_prometheus_cibles_supplementaires [] Jobs additionnels libres

Intégration

  • Côté VM : node_exporter est installé par le futur rôle client_metrique.
  • serveur_grafana consommera Prometheus comme datasource.

Hors périmètre

  • Alerting (Alertmanager), règles d'alerte, fédération — phases dédiées.