Publiée 30 juillet 2026
Ingénieur Système HPC / GPU / SLURM F/H
Sorbonne University
Paris, Île-de-France 75005, France
CDI
Description du poste
Versant
Fonction Publique de l'Etat
Catégorie (DGAFP)
B (profession intermédiaire)
Corps
TECH
Domaine / métier
05 - Catégorie B - Technicien (TECH) - E - Informatique Statistiques et Calcul scientifique - Technicien-ne d'exploitation d'assistance et de traitement de l'information
Nature de l'emploi
Emploi ouvert uniquement aux contractuels
Statut du poste
Vacant
Intitulé du poste
Ingénieur Système HPC / GPU / SLURM F/H
Présentation de la structure recruteuse
Dans un contexte national et international marqué par la compétition autour de l'intelligence artificielle, Sorbonne Université a créé le Sorbonne Cluster for Artificial Intelligence (SCAI), qui réunit un ensemble stratégique de disciplines de l'IA moderne. Son ambition est de renforcer l'excellence de la recherche interdisciplinaire en favorisant les échanges entre chercheurs, enseignants, étudiants et partenaires industriels.
Le candidat ou la candidate rejoint une équipe en charge de l'administration, de la maintenance et de l'évolution du cluster PostGenAI@Paris, projet académique majeur porté par Sorbonne Université, lauréat de l'appel « IA-Cluster » (France 2030), doté de 35 M€ sur 5 ans. Ce cluster rassemble un large consortium d'acteurs académiques (CNRS, Inria, Inserm, UTC, MNHN, AP-HP, Cnam, Sciences Po, Onera...) et plus de 60 partenaires industriels, avec pour objectif de devenir un pôle d'excellence international en IA post-générative à l'horizon 2030.
L'infrastructure HPC repose sur des nœuds GPU NVIDIA sous Debian GNU/Linux, avec l'ordonnanceur SLURM pour la gestion des ressources. Elle répond aux besoins de recherche et de formation en IA du consortium.
Stack technique principale : Debian GNU/Linux, GPU NVIDIA (CUDA), SLURM, réseau 25/100G, stockage NFS/Ceph, supervision Prometheus/Grafana, automatisation Ansible/Bash/Python, authentification SSH/LDAP/SSO.
Description du poste
Fonctions : Ingénieur.e Système HPC / GPU / SLURM
Catégorie : B
Corps : TECH
BAP : E
CDD de 12 mois.
Missions principales :
1. Administration système
2. Administration SLURM
3. Support utilisateurs et opérateurs
4. Supervision et performance
Descriptif du profil recherché (connaissances, compétences métier, compétences relationnelles)
Compétences techniques indispensables :
Compétences appréciées :
Qualités personnelles :
Durée du contrat (mois)
12
Quotité
Temps plein
Informations complémentaires
Encadrement
Non
Télétravail possible
Oui
Conditions d'exercice
Unité protégée / ZRR
Non
Critères candidat
Niveau d'études
Niveau 4 - Bac
Niveau d'expérience min. requis
Confirmé
Date limite de candidature
21/09/2026
Langues
Anglais (4 - Niveau avancé (B2))
Localisation du poste
Localisation du poste
Europe, France, Ile-de-France, Paris (75)
Lieu d'affectation (sans géolocalisation)
SCAI, 4 place jussieu
Site
Campus Pierre et Marie Curie - 4 place Jussieu 75005 Paris
Demandeur
Date de vacance de l'emploi
01/10/2026
Versant
Fonction Publique de l'Etat
Catégorie (DGAFP)
B (profession intermédiaire)
Corps
TECH
Domaine / métier
05 - Catégorie B - Technicien (TECH) - E - Informatique Statistiques et Calcul scientifique - Technicien-ne d'exploitation d'assistance et de traitement de l'information
Nature de l'emploi
Emploi ouvert uniquement aux contractuels
Statut du poste
Vacant
Intitulé du poste
Ingénieur Système HPC / GPU / SLURM F/H
Présentation de la structure recruteuse
Dans un contexte national et international marqué par la compétition autour de l'intelligence artificielle, Sorbonne Université a créé le Sorbonne Cluster for Artificial Intelligence (SCAI), qui réunit un ensemble stratégique de disciplines de l'IA moderne. Son ambition est de renforcer l'excellence de la recherche interdisciplinaire en favorisant les échanges entre chercheurs, enseignants, étudiants et partenaires industriels.
Le candidat ou la candidate rejoint une équipe en charge de l'administration, de la maintenance et de l'évolution du cluster PostGenAI@Paris, projet académique majeur porté par Sorbonne Université, lauréat de l'appel « IA-Cluster » (France 2030), doté de 35 M€ sur 5 ans. Ce cluster rassemble un large consortium d'acteurs académiques (CNRS, Inria, Inserm, UTC, MNHN, AP-HP, Cnam, Sciences Po, Onera...) et plus de 60 partenaires industriels, avec pour objectif de devenir un pôle d'excellence international en IA post-générative à l'horizon 2030.
L'infrastructure HPC repose sur des nœuds GPU NVIDIA sous Debian GNU/Linux, avec l'ordonnanceur SLURM pour la gestion des ressources. Elle répond aux besoins de recherche et de formation en IA du consortium.
Stack technique principale : Debian GNU/Linux, GPU NVIDIA (CUDA), SLURM, réseau 25/100G, stockage NFS/Ceph, supervision Prometheus/Grafana, automatisation Ansible/Bash/Python, authentification SSH/LDAP/SSO.
Description du poste
Fonctions : Ingénieur.e Système HPC / GPU / SLURM
Catégorie : B
Corps : TECH
BAP : E
CDD de 12 mois.
Missions principales :
1. Administration système
- Déploiement et maintenance des nœuds de calcul GPU sous Debian
- Déploiement et maintenance de nœuds proxmox, vm et docker
- Gestion des mises à jour système, des pilotes NVIDIA et des librairies CUDA
- Configuration et optimisation du réseau haute performance (bonding, VLAN)
- Mise en œuvre et gestion des systèmes de fichiers distribués (NFS, CEPH, CephFS)
- Automatisation des déploiements via Ansible
2. Administration SLURM
- Installation, configuration et mise à jour de SLURM (slurmctld, slurmd, slurmdbd)
- Définition des partitions, QOS, comptes et limites de ressources
- Intégration des GPU NVIDIA dans les ressources SLURM (GRES)
- Surveillance des jobs, diagnostics et interventions sur les nœuds en défaut
- Rédaction et mise à jour des procédures SLURM à destination des utilisateurs
3. Support utilisateurs et opérateurs
- Support de niveau 2/3 pour les utilisateurs de la plateforme HPC
- Accompagnement des utilisateurs sur l'optimisation de leurs soumissions SLURM
- Participation aux réunions techniques et rédaction des comptes-rendus
- Rédaction de la documentation technique et des runbooks
4. Supervision et performance
- Mise en place et maintenance des outils de supervision (Prometheus, Grafana)
- Analyse des performances GPU (utilisation, mémoire, température, bande passante NVLink)
- Optimisation des politiques d'ordonnancement selon la charge de la plateforme
- Gestion des incidents et participation aux astreintes selon planning
Descriptif du profil recherché (connaissances, compétences métier, compétences relationnelles)
Compétences techniques indispensables :
- Solide maîtrise de Linux/Debian : administration système, packaging, systemd, réseau
- Expérience confirmée sur SLURM : configuration, partitions, GRES GPU, accounting
- Bonne connaissance de l'écosystème NVIDIA : drivers, CUDA, NVML, DCGM
- Maîtrise des outils d'automatisation : Ansible, Bash, Python
- Expérience sur les réseaux : Bonding, Vlan, routage
Compétences appréciées :
- Connaissance de systèmes de fichiers distribués : Ceph, cephfs
- Pratique de la supervision avec Prometheus, Grafana, Alertmanager
- Notions de MPI (OpenMPI, MVAPICH2) et de librairies de calcul (cuBLAS, NCCL)
- Expérience avec des frameworks IA/ML : PyTorch, TensorFlow (usage sur HPC)
- Connaissances en gestion de version : Git, GitLab CI
Qualités personnelles :
- Rigueur, méthode et sens de la documentation
- Autonomie et capacité à gérer les priorités en environnement de production
- Bon relationnel et goût pour le travail en équipe
- Curiosité technique et veille active sur l'écosystème HPC/GPU
Durée du contrat (mois)
12
Quotité
Temps plein
Informations complémentaires
Encadrement
Non
Télétravail possible
Oui
Conditions d'exercice
Unité protégée / ZRR
Non
Critères candidat
Niveau d'études
Niveau 4 - Bac
Niveau d'expérience min. requis
Confirmé
Date limite de candidature
21/09/2026
Langues
Anglais (4 - Niveau avancé (B2))
Localisation du poste
Localisation du poste
Europe, France, Ile-de-France, Paris (75)
Lieu d'affectation (sans géolocalisation)
SCAI, 4 place jussieu
Site
Campus Pierre et Marie Curie - 4 place Jussieu 75005 Paris
Demandeur
Date de vacance de l'emploi
01/10/2026