HexaMonitoring intègre Prometheus, Grafana, les exporteurs système et Slurm, l’alerting, la PKI et les contrôles mTLS. Son objectif est de relier chaque état opérationnel à des signaux vérifiables.
Du problème aux preuves.
Transformer les états Linux et HPC en signaux vérifiables, actionnables et protégés de bout en bout.
Éviter les alertes sans décision ni propriétaire.
Observer Slurm sans confondre symptômes, politique et capacité.
Sécuriser la collecte entre composants.
Cibles et règles vérifiées au runtime.
Dashboards reliés à des requêtes reproductibles.
Contrôles mTLS et scénarios négatifs de connexion.
Une alerte doit annoncer un symptôme et une décision attendue.
La preuve runtime doit rester lisible hors du tableau de bord.