Linux & HPC
MCO de clusters CPU/GPU, accès, stockage, services et environnements scientifiques.
Linux · Lmod · Conda · ApptainerAdministrateur systèmes Linux · HPC · IA
Clusters CPU/GPU, Slurm, observabilité et logiciels souverains — de l’exploitation terrain à HexaOS.
00À propos
Je suis Mickaël Angel, administrateur systèmes Linux spécialisé HPC et fondateur d’HexaOS. Mon travail relie l’exploitation de plateformes critiques, l’automatisation, l’observabilité et la transmission technique.
Je poursuis actuellement un Master en Data Science et je développe des projets où chaque promesse doit être reliée à une preuve, une documentation et un état honnête.
01Expertise opérationnelle
Maintenir les plateformes disponibles, rendre les incidents lisibles et transformer les procédures en systèmes reproductibles.
MCO de clusters CPU/GPU, accès, stockage, services et environnements scientifiques.
Linux · Lmod · Conda · ApptainerPartitions, QoS, comptes, cgroups et diagnostic structuré des jobs.
Slurm · Munge · cgroup v2Métriques, tableaux de bord et alertes exploitables pour les systèmes et workloads.
Prometheus · Grafana · TIG · DCGMScripts, runbooks et automatisation pour rendre les changements fiables et reproductibles.
Bash · Python · Git · Ansible02Parcours
Du datacenter au calcul haute performance, chaque étape a ajouté une couche : matériel, réseau, systèmes, ordonnancement et observabilité.
Exploitation d’un cluster Linux CPU/GPU, Slurm, Lmod, Conda, Apptainer et observabilité.
Supervision, alertes, interventions de proximité, rackage, câblage et traçabilité.
Routage, switching, VLAN, services TCP/IP et rétablissement de service.
Systèmes Linux et Windows, matériel, virtualisation et environnements critiques.
03Projets
Produits actifs, composants HexaOS, plateformes historiques et projets à venir disposent de leur propre fiche détaillée.
Système souverain
Un système Linux européen pour le HPC, l’IA locale et les environnements hors ligne.
04Blog
200 nouveaux articles complets et bilingues sur Linux, le HPC, HexaOS, l’observabilité et les méthodes d’exploitation.
Pourquoi un système ne devrait jamais être déclaré prêt sur la seule base d’une compilation réussie.
N/02 · ObservabilitéUn tableau de bord utile relie les signaux système, les jobs et l’action opérationnelle.
N/03 · Ingénierie systèmePayload explicite, échec fermé et démarrages successifs : les détails qui font la différence.
05Livres
Des ouvrages progressifs, des fondations Linux au diagnostic des environnements HPC.
Manuel théorique
524 pages et 20 chapitres pour passer de la ligne de commande aux pratiques d’exploitation Linux/HPC.
Voir sur AmazonManuel pratique
560 pages d’exercices, labs, preuves attendues et corrigés associés aux 20 chapitres de fondations.
Voir sur AmazonManuel théorique
452 pages consacrées à Concepts systemd, types d’unités, cibles de démarrage et journald.
Voir sur Amazon06Formation
15 parcours, 400 modules bilingues et environ 1 218 heures : cours, laboratoires, exercices, corrigés, quiz, références et progression synchronisée.
Débutants, personnes en reconversion et techniciens souhaitant acquérir un socle Linux fiable. Utiliser le shell avec méthode ; Gérer fichiers, permissions et processus ; Produire un premier diagnostic documenté.
62 h estiméesP/02 · Débutant à intermédiaireTechniciens et administrateurs Linux juniors chargés de serveurs en exploitation. Installer et maintenir un serveur ; Exploiter systemd et le cycle de démarrage ; Diagnostiquer et restaurer un hôte.
84 h estiméesP/03 · IntermédiaireAdministrateurs, DevOps et techniciens souhaitant fiabiliser les tâches répétitives. Écrire des scripts robustes ; Manipuler texte, JSON et API ; Tester et distribuer un outil d'administration.
56 h estimées07Contact
Une question sur HexaOS, un cluster HPC, un livre ou un projet ? Préparez votre message directement depuis le portfolio.
mickael@hexaos.org