« Vérifier » échouait faussement sur un hôte frais : les tâches « démarrer service » et les handlers restart/reload/validate touchent un paquet que --check n'installe pas vraiment → service/fichier absent → faux fatal, qui bloquait le déploiement (le dry-run doit passer pour débloquer « Déployer »). Ajout de « when: not ansible_check_mode » sur ces tâches + handlers des 13 rôles serveur_* (29 gardes). Sautées en dry-run, inchangées en réel. Validé : powerdns dry-run failed=0 ; ansible-lint 0 échec ; 19 playbooks syntax-OK. Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com> |
||
|---|---|---|
| .. | ||
| defaults | ||
| handlers | ||
| meta | ||
| tasks | ||
| templates | ||
| README.md | ||
serveur_prometheus
Collecte de métriques Prometheus (paquet Debian), plateforme d'observabilité.
Rôle
- Installe
prometheus. - Déploie
/etc/prometheus/prometheus.yml: jobprometheus(soi-même) + jobnodedont les cibles sont dérivées de l'inventaire (hôtes actifs declient_metrique→node_exportersur:9100). - Rétention via
/etc/default/prometheus(--storage.tsdb.retention.time). promtool check configavant rechargement (handlerValider et recharger prometheus).
Cibles dérivées de l'inventaire
Comme la zone DNS, la liste de scrape se construit toute seule : ajouter un hôte au
groupe client_metrique et l'activer suffit à le faire scraper. Aucun edit manuel.
Variables principales
| Variable | Défaut | Rôle |
|---|---|---|
serveur_prometheus_intervalle |
15s |
scrape_interval |
serveur_prometheus_retention |
15d |
Rétention TSDB |
serveur_prometheus_groupe_metriques |
client_metrique |
Groupe source des cibles |
serveur_prometheus_port_node |
9100 |
Port node_exporter |
serveur_prometheus_cibles_supplementaires |
[] |
Jobs additionnels libres |
Intégration
- Côté VM :
node_exporterest installé par le futur rôleclient_metrique. serveur_grafanaconsommera Prometheus comme datasource.
Hors périmètre
- Alerting (Alertmanager), règles d'alerte, fédération — phases dédiées.