HexaCluster Manager rassemble CLI, API, inventaire, préflight, provisioning, intégration Slurm, suivi des jobs, sauvegarde et diagnostic. Le projet avance par capacités qualifiées, avec journalisation des opérations et refus des actions ambiguës.
Du problème aux preuves.
Rendre le déploiement et l’exploitation d’un cluster lisibles, contrôlables et auditables depuis un même plan de contrôle.
Refuser les opérations ambiguës avant qu’elles n’atteignent plusieurs nœuds.
Relier inventaire, état observé et changement demandé.
Conserver une voie de reprise pour chaque opération distribuée.
Préflight explicite et journalisation des opérations.
Déploiement progressif par capacité qualifiée.
Tests de sauvegarde et scénarios de diagnostic avant automatisation globale.
L’automatisation sûre commence par la qualité de l’inventaire.
Un refus explicite vaut mieux qu’une interprétation silencieuse.