Objectif 120 min
MY / ACADEMY 5.2
Piloter sa progression, pas seulement accumuler des cours.
Compétences, objectifs, trajectoire métier, pratique et validation réunis dans un tableau de bord bilingue.modules validés
Validés depuis lundi
Une activité utile suffit — sans pression artificielle.
Scénarios métiers terminés
Distinguer noyau, espace utilisateur et distribution
Le noyau arbitre matériel, mémoire, processus et interfaces système ; la configuration effective doit être distinguée du fichier qui la propose.
Profil apprenant local
Progression conservée sur cet appareil. La connexion est requise uniquement pour un certificat public.
SKILLS / MATRIX
Une carte de compétences reliée aux preuves.
Fondations Linux
Noyau, espace utilisateur, shell, fichiers, processus et permissions.
Administration Linux
Services, démarrage, paquets, identités, incidents et exploitation quotidienne.
Bash & automatisation
Scripts robustes, Python d’exploitation, contrôles, journaux et idempotence.
Réseaux Linux
Adressage, routage, DNS, sockets, pare-feu, MTU et diagnostic.
Stockage & reprise
LVM, RAID, NFS, sauvegardes, intégrité, performance et restauration.
Sécurité Linux
SSH, sudo, moindre privilège, AppArmor, secrets, audit et réponse.
Virtualisation & conteneurs
OCI, Podman, Apptainer, namespaces, cgroup v2 et images reproductibles.
Observabilité & SRE
Prometheus, Grafana, journaux, alertes, SLI/SLO et réponse aux incidents.
Architecture HPC
Nœuds, interconnexions, NUMA, stockage, topologie et modèles de charge.
Administration Slurm
Partitions, QoS, TRES/GRES, accounting, fair-share, backfill et maintenance.
Calcul parallèle
MPI, OpenMP, affinité, vectorisation, profiling et efficacité.
GPU & infrastructure IA
CUDA, VRAM, topologie, multi-GPU, conteneurs IA et observabilité.
Git, CI/CD & IaC
Revue, tests, Ansible, infrastructure as code et déploiement progressif.
Continuité & FinOps
Capacité, sauvegarde, PRA/PCA, coûts, énergie, risques et gouvernance.
Pratique professionnelle
Runbooks, communication, preuves, conduite d’incident, projet et soutenance.
CAREER / ROUTE
Administrateur systèmes HPC
Maintenir un cluster, expliquer la planification, traiter les incidents de nœuds et défendre les changements par des preuves.Linux avancé
Le cluster hérite de toutes les fragilités de l’hôte.
0%Architecture & topologie
NUMA, interconnexion et stockage encadrent ce que le scheduler peut livrer.
0%Slurm en production
Comprendre politique, état et accounting avant toute action globale.
0%MPI, conteneurs & GPU
Les applications relient ordonnanceur, runtime, réseau et accélérateurs.
0%Exploitation intégrée
Observer, documenter et conduire un incident de bout en bout.
0%Projet final
CAP-HPC-CLUSTER
OuvrirSKILLS / BADGES
Des jalons qui correspondent à une preuve.
Première preuve
Valider un premier module complet.
À VALIDERRégularité
Valider dix modules.
À VALIDEROpérateur méthodique
Valider cinquante modules.
À VALIDERCap des cent
Valider cent modules.
À VALIDERLinux Admin
Atteindre 80 % sur Fondations Linux.
À VALIDERSlurm Operator
Atteindre 80 % sur Administration Slurm.
À VALIDERHPC Monitoring
Atteindre 80 % en observabilité.
À VALIDERIncident Responder
Résoudre cinq Incident Labs.
À VALIDERIncident Lead
Résoudre les vingt Incident Labs.
À VALIDERSept jours utiles
Étudier sept jours consécutifs.
À VALIDERPremier examen
Réussir un examen final.
À VALIDERAcadémie complète
Valider les 400 modules.
À VALIDERÉvaluer mon niveau
04Pratiquer dans 40 labs
05Résoudre 20 incidents
08Préparer un examen
Chargement de la progression…