CAPSTONE / 06 / ACADEMY 5.2

Assembler les compétences en projet.

Huit projets complets obligent à relier architecture, réalisation, sécurité, validation, métriques et retour d’expérience.
8projets finaux0terminés18–45heures/projet
CAPSTONE / 06
01 / CAP-LINUX-OPSINTERMEDIATE · 28 H

Plateforme Linux exploitable

Construire et remettre un hôte de service documenté, sécurisé, observable et restaurable.

0%
Ouvrir le dossier projet
SCENARIO

Une équipe de recherche demande un serveur interne pour une API et ses données, avec disponibilité mesurée et restauration testée.

MILESTONES
DELIVERABLES

Dossier d’architecture et inventaire versionné.

Automatisation idempotente avec dry-run.

Runbooks démarrage, incident, changement et restauration.

Rapport de qualification PASS/FAIL/BLOCKED/NOT RUN.

Démonstration de rollback depuis un état propre.

RUBRIC

25%Service rendu et tests fonctionnels

20%Sécurité et moindre privilège

15%Observabilité actionnable

25%Restauration et rollback prouvés

15%Documentation et honnêteté des limites

02 / CAP-HPC-CLUSTEREXPERT · 48 H

Mini-cluster HPC qualifié

Assembler contrôle, calcul, Slurm, stockage partagé et observabilité dans un périmètre reproductible.

0%
Ouvrir le dossier projet
SCENARIO

Un laboratoire doit disposer de quatre nœuds CPU, d’une file de test et d’une politique d’usage compréhensible.

MILESTONES
DELIVERABLES

Diagramme réseau/NUMA/stockage et matrice de versions.

Configuration Slurm revue et catalogue partitions/QoS.

Suite de smoke tests et jobs témoins.

Dashboard d’exploitation et alertes testées.

Dossier d’incident et décision de retour en service.

RUBRIC

20%Architecture et reproductibilité

25%Planification et accounting

20%Runtime MPI et stockage

20%Incident et retour en service

15%Preuves et transmission

03 / CAP-SLURM-OPSADVANCED · 32 H

Politique Slurm défendable

Concevoir partitions, associations, QoS, fair-share et maintenance sans promesse implicite.

0%
Ouvrir le dossier projet
SCENARIO

Trois équipes partagent CPU et GPU avec priorités, quotas et besoins de réservation différents.

MILESTONES
DELIVERABLES

Matrice besoins → règle → effet attendu.

Cas de test `sbatch --test-only` et reason codes.

Tableau de bord utilisation/capacité/équité.

Guide utilisateur sans heure garantie.

Plan de rollback de configuration.

RUBRIC

25%Cohérence politique/capacité

25%Tests des limites

20%Équité et transparence

15%Maintenance et rollback

15%Communication utilisateur

04 / CAP-OBS-SREADVANCED · 30 H

Observabilité et SLO d’un service HPC

Passer des métriques brutes à un service mesuré, des alertes actionnables et un budget d’erreur.

0%
Ouvrir le dossier projet
SCENARIO

Le portail de soumission et le scheduler fonctionnent, mais les utilisateurs perçoivent des lenteurs non objectivées.

MILESTONES
DELIVERABLES

Fiche SLI/SLO et hypothèses.

Règles promtool et fixtures de tests.

Dashboard avec provenance, unité et no-data.

Runbooks reliés aux alertes.

Postmortem d’un scénario pédagogique.

RUBRIC

25%SLI proche du service rendu

20%Qualité des alertes

20%Tests et scénarios négatifs

20%Budget d’erreur et décision

15%Runbooks et postmortem

05 / CAP-STORAGE-DRADVANCED · 34 H

Stockage, sauvegarde et reprise

Concevoir une chaîne de données où la restauration, l’intégrité et la capacité sont démontrées.

0%
Ouvrir le dossier projet
SCENARIO

Un service conserve données de recherche, exports NFS et sauvegarde hors site avec RPO 4 h et RTO 8 h.

MILESTONES
DELIVERABLES

Cartographie données/risques/rétention.

Procédures sauvegarde et restauration.

Manifeste d’intégrité et journal de test.

Rapport RPO/RTO réel.

Capacité et plan de croissance.

RUBRIC

20%Intégrité et chiffrement

30%Restauration fonctionnelle

20%RPO/RTO mesurés

15%Capacité et performance

15%Documentation

06 / CAP-GPU-AIEXPERT · 40 H

Plateforme GPU/IA qualifiée

Qualifier pilote, runtime, conteneurs, allocation, topologie, observabilité et capacité.

0%
Ouvrir le dossier projet
SCENARIO

Une équipe doit entraîner et servir des modèles sur quatre GPU partagés sans mélanger environnements ni résultats.

MILESTONES
DELIVERABLES

Matrice de compatibilité et preuves runtime.

Image par digest et SBOM.

Jobs témoins mono/multi-GPU.

Dashboard utilisation, VRAM, erreurs et files.

Dossier incident GPU et critères RESUME.

RUBRIC

25%Compatibilité prouvée

20%Isolation et reproductibilité

20%Allocation et topologie

20%Observabilité et incidents

15%Limites des performances

07 / CAP-SECURE-RESEARCHADVANCED · 36 H

Plateforme de recherche durcie

Appliquer menace, moindre privilège, PKI, audit et réponse sans casser l’usage scientifique.

0%
Ouvrir le dossier projet
SCENARIO

Des données sensibles transitent par bastion, nœuds de calcul et stockage partagé.

MILESTONES
DELIVERABLES

Modèle de menace et registre de risques.

Matrice droits/justification/revue.

Tests négatifs et preuves d’audit.

Runbooks secrets, PKI et accès de secours.

Postmortem et plan d’amélioration.

RUBRIC

20%Modèle de menace

25%Moindre privilège

20%Tests négatifs

20%Récupération et rotation

15%Audit et communication

08 / CAP-HEXA-QUALIFICATIONEXPERT · 44 H

Campagne de qualification d’une release Linux

Transformer compilation, artefacts, installation, runtime, sécurité et décision en chaîne vérifiable.

0%
Ouvrir le dossier projet
SCENARIO

Une candidate Linux doit être installée hors ligne, démarrer deux fois, conserver ses données et publier un verdict honnête.

MILESTONES
DELIVERABLES

Catalogue immuable et sommes SHA-256.

Matrice de gates et harness versionné.

Preuves runtime et journal des échecs.

Rapport global avec limites et décisions ouvertes.

Bundle installateur et script de rollback testés.

RUBRIC

25%Traçabilité artefact → preuve

20%Qualité des gates

20%Échec fermé et faux positifs

20%Transparence des statuts

15%Portabilité et rollback