Linux & HPC
MCO de clusters CPU/GPU, accès, stockage, services et environnements scientifiques.
Linux · Lmod · Conda · ApptainerAdministrateur systèmes Linux · HPC · IA
Clusters CPU/GPU, Slurm, observabilité et logiciels souverains — de l’exploitation terrain à HexaOS.
00À propos
Je suis Mickaël Angel, administrateur systèmes Linux spécialisé HPC et fondateur d’HexaOS. Mon travail relie l’exploitation de plateformes critiques, l’automatisation, l’observabilité et la transmission technique.
Je poursuis actuellement un Master en Data Science et je développe des projets où chaque promesse doit être reliée à une preuve, une documentation et un état honnête.
01Expertise opérationnelle
Maintenir les plateformes disponibles, rendre les incidents lisibles et transformer les procédures en systèmes reproductibles.
MCO de clusters CPU/GPU, accès, stockage, services et environnements scientifiques.
Linux · Lmod · Conda · ApptainerPartitions, QoS, comptes, cgroups et diagnostic structuré des jobs.
Slurm · Munge · cgroup v2Métriques, tableaux de bord et alertes exploitables pour les systèmes et workloads.
Prometheus · Grafana · TIG · DCGMScripts, runbooks et automatisation pour rendre les changements fiables et reproductibles.
Bash · Python · Git · Ansible02Parcours
Du datacenter au calcul haute performance, chaque étape a ajouté une couche : matériel, réseau, systèmes, ordonnancement et observabilité.
Exploitation d’un cluster Linux CPU/GPU, Slurm, Lmod, Conda, Apptainer et observabilité.
Supervision, alertes, interventions de proximité, rackage, câblage et traçabilité.
Routage, switching, VLAN, services TCP/IP et rétablissement de service.
Systèmes Linux et Windows, matériel, virtualisation et environnements critiques.
03Projets
Produits actifs, composants HexaOS, plateformes historiques et projets à venir disposent de leur propre fiche détaillée.
Système souverain
Un système Linux européen pour le HPC, l’IA locale et les environnements hors ligne.
04Blog
Des articles structurés sur Linux, le HPC, HexaOS, l’observabilité et les méthodes d’exploitation.
Pourquoi un système ne devrait jamais être déclaré prêt sur la seule base d’une compilation réussie.
N/02 · ObservabilitéUn tableau de bord utile relie les signaux système, les jobs et l’action opérationnelle.
N/03 · Ingénierie systèmePayload explicite, échec fermé et démarrages successifs : les détails qui font la différence.
05Livres
Des ouvrages progressifs, des fondations Linux au diagnostic des environnements HPC.
Manuel théorique
524 pages et 20 chapitres pour passer de la ligne de commande aux pratiques d’exploitation Linux/HPC.
Voir sur AmazonManuel pratique
560 pages d’exercices, labs, preuves attendues et corrigés associés aux 20 chapitres de fondations.
Voir sur AmazonManuel théorique
452 pages consacrées à Concepts systemd, types d’unités, cibles de démarrage et journald.
Voir sur Amazon06Formation
38 modules issus de 14 ouvrages : cours, exercices, corrigés, quiz, carnet de preuves et progression synchronisée.
De zéro à une administration Linux structurée, avec un exercice et une preuve pour chaque notion.
12 semaines · 6 h/semaineP/02 · IntermédiaireApprofondir les chapitres 8 à 20 pour relier services, sécurité, automatisation et exploitation de cluster.
10 semaines · 7 h/semaineP/03 · IntermédiaireLire le graphe de démarrage, écrire une unité propre et exploiter journald avec une méthode défendable.
8 semaines · 6 h/semaine07Contact
Une question sur HexaOS, un cluster HPC, un livre ou un projet ? Préparez votre message directement depuis le portfolio.
mickael@hexaos.org