CAREERS / 03 / ACADEMY 5.2

Savoir par où commencer.

Quatre trajectoires professionnelles relient parcours, labs, incidents et projet final. Elles restent modifiables à tout moment.
4trajectoires19étapes8capstones
CAREERS / 03
01 / ROADMAP

Administrateur systèmes Linux

Une trajectoire du shell à l’exploitation sécurisée et observable d’un parc Linux.

Administrer des hôtes, diagnostiquer les incidents courants et automatiser des opérations réversibles.
0%
  1. 01

    Socle Linux

    Comprendre les couches avant de modifier l’état.

  2. 02

    Exploitation

    Services, identité, paquets et démarrage forment le quotidien du métier.

  3. 03

    Réseau & données

    Un incident système traverse souvent réseau et stockage.

  4. 04

    Sécuriser & observer

    Le changement fiable associe contrôle, métrique et retour arrière.

02 / ACTIF

Administrateur systèmes HPC

Une progression complète vers Slurm, MPI, stockage HPC, GPU et exploitation de cluster.

Maintenir un cluster, expliquer la planification, traiter les incidents de nœuds et défendre les changements par des preuves.
0%
  1. 01
  2. 02

    Architecture & topologie

    NUMA, interconnexion et stockage encadrent ce que le scheduler peut livrer.

  3. 03

    Slurm en production

    Comprendre politique, état et accounting avant toute action globale.

  4. 04
  5. 05

    Exploitation intégrée

    Observer, documenter et conduire un incident de bout en bout.

03 / ROADMAP

Ingénieur infrastructure IA

Linux, GPU, conteneurs, ordonnancement, observabilité et mise en production de charges IA.

Qualifier une pile GPU, isoler les charges, suivre capacité et performances et traiter les incidents sans masquer les limites.
0%
  1. 01
  2. 02

    Conteneurs reproductibles

    Pilotes, bibliothèques et images doivent être compatibles et épinglés.

  3. 03

    GPU & topologie

    La disponibilité ne prouve ni capacité ni placement efficace.

  4. 04

    Planification & parallélisme

    GRES/TRES, affinité et communication déterminent l’usage réel.

  5. 05
04 / ROADMAP

Ingénieur SRE & observabilité

Une trajectoire centrée sur les signaux utiles, les SLO, l’automatisation et la réponse aux incidents.

Concevoir une observabilité actionnable, réduire le bruit et conduire une amélioration post-incident mesurable.
0%
  1. 01
  2. 02

    Automatiser les contrôles

    La collecte et le changement doivent être bornés et testés.

  3. 03

    Métriques, logs & alertes

    Relier SLI, SLO, symptômes et runbooks.

  4. 04