Reconstruction complète prouvée (14 VM + sauvegardes + AC supprimées, puis `make myDay` rebâtit tout ; `make valider` entièrement vert). Bugs corrigés : - client_pki : empreinte du root CA dérivée dynamiquement de l'autorité (au lieu d'une valeur figée en Vault) — une AC régénérée a une empreinte neuve. - serveur_keycloak : assignation de rôle tolérante aux utilisateurs absents (annuaire vide sur un from-zero). - serveur_prometheus : ne scrute que les hôtes ACTIFS (client_metrique ∩ hotes_actifs). - nftables résolu : compatible Docker — remplace la seule table setops_flux (pas de flush ruleset, préserve les tables Docker) + forward autorise docker0/established. Sans ça, forward policy drop coupait Collabora (conteneur). Ajoute playbooks/proxmox/supprimer_vm_debian.yml (suppression par VMID, garde-fous). Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com> |
||
|---|---|---|
| .. | ||
| defaults | ||
| handlers | ||
| meta | ||
| tasks | ||
| templates | ||
| README.md | ||
serveur_prometheus
Collecte de métriques Prometheus (paquet Debian), plateforme d'observabilité.
Rôle
- Installe
prometheus. - Déploie
/etc/prometheus/prometheus.yml: jobprometheus(soi-même) + jobnodedont les cibles sont dérivées de l'inventaire (hôtes actifs declient_metrique→node_exportersur:9100). - Rétention via
/etc/default/prometheus(--storage.tsdb.retention.time). promtool check configavant rechargement (handlerValider et recharger prometheus).
Cibles dérivées de l'inventaire
Comme la zone DNS, la liste de scrape se construit toute seule : ajouter un hôte au
groupe client_metrique et l'activer suffit à le faire scraper. Aucun edit manuel.
Variables principales
| Variable | Défaut | Rôle |
|---|---|---|
serveur_prometheus_intervalle |
15s |
scrape_interval |
serveur_prometheus_retention |
15d |
Rétention TSDB |
serveur_prometheus_groupe_metriques |
client_metrique |
Groupe source des cibles |
serveur_prometheus_port_node |
9100 |
Port node_exporter |
serveur_prometheus_cibles_supplementaires |
[] |
Jobs additionnels libres |
Intégration
- Côté VM :
node_exporterest installé par le futur rôleclient_metrique. serveur_grafanaconsommera Prometheus comme datasource.
Hors périmètre
- Alerting (Alertmanager), règles d'alerte, fédération — phases dédiées.