Ingénieure / Ingénieur DevOps SRE Socle IA
Summary
DevOps/SRE engineer responsible for building and operating AI infrastructure including containerized model services, Kubernetes orchestration, CI/CD pipelines, and observability systems to support AI applications for 90,000 justice ministry agents.
L’intelligence artificielle constitue aujourd’hui un levier majeur de transformation et doit aider la Justice à relever ses nombreux défis : faciliter l’accès au droit, accélérer les délais de traitement des procédures, sécuriser le travail des agents pénitentiaires, améliorer les conditions de travail. Le traitement plus rapide d’importants volumes d’informations, l’aide à la recherche et à la rédaction, la facilitation de certaines tâches perçues comme pénibles ou à faible valeur ajoutée, sont autant de perspectives majeures pour les agents du ministère.
Préconisée par le rapport sur l’intelligence artificielle publié et remis au ministre de la Justice le 23 juin 2025, la direction de programme IA (DPIA) portera cette ambition pour la Justice. Rejoindre cette direction, c’est contribuer à des projets à fort impact sociétal, pour une IA publique, souveraine et responsable au service des 98 000 agents du ministère et de l'ensemble des usagers du service public de la Justice. Nous concevons des solutions IA notamment pour des greffiers, personnels pénitentiaires, éducateurs, magistrats, conseillers d’insertion et de probation, agents de l’administration centrale et des services déconcentrés.
Elle construit et fait évoluer la stratégie IA du ministère, en lien avec les parties prenantes. Elle identifie les cas d’usages de l’IA au ministère, et les bénéfices attendus sur ces cas d’usage. Elle propose aux instances de gouvernance les décisions d’investissement et les projets à lancer. Elle fédère autour de cette stratégie les services et directions du ministère, et s’assure de leur participation à sa réalisation.
Elle s’assure au quotidien que les produits IA, ceux qu’elle porte directement et ceux portés par d’autres équipes du ministère, à qui elle apporte soutien et expertise, sont créés et évoluent dans un souci d’efficience globale, apportent bien la valeur attendue notamment pour les agents du ministère, et respectent les impératifs de performance, de conformité réglementaire, de sécurité et de souveraineté.
Elle définit et conduit une stratégie pour la montée en compétence des agents du ministère sur l’IA, et veille à la bonne adéquation des produits IA aux besoins de ces utilisateurs. La DPIA assure le secrétariat de l’observatoire de l’IA, instance distincte qui sera chargée d’accompagner la mise en œuvre de la stratégie du ministère en la matière.
L’équipe Produit & Tech de la direction de programme opère notamment Mon Assistant Justice, un agent conversationnel fondé sur un grand modèle de langage (LLM), sécurisé et généraliste, mis à disposition des agents du ministère. Elle est organisée en mode produit : une approche centrée sur les besoins des utilisateurs, avec des cycles de livraison courts, une cheffe de produit dédiée et une forte autonomie de l’équipe technique dans les choix de conception et de priorisation. Les développements s’inscrivent dans une démarche open source (public money = public code). Le déploiement de Mon Assistant Justice constitue la première étape d’un plan de transformation plus global, qui couvre l’ensemble des besoins de la Justice en matière d’IA et vise à construire un socle technique d’IA générative mutualisé à destination des agents.
La DPIA est rattachée au secrétariat général du ministère de la Justice, qui assure une mission générale de coordination et de soutien aux services du ministère, et qui exerce les fonctions prévues par le décret n° 2014-834 du 24 juillet 2014 relatif aux secrétaires généraux des ministères.
En rejoignant cette direction, vous aurez un impact significatif sur la justice en France, en contribuant à des projets innovants qui rendent la justice plus équitable et efficace. Ce poste offre l'opportunité de combiner expertise technique et engagement, dans un environnement stimulant où l'innovation sert le bien commun.
Vos activités principales
En tant qu'ingénieur ou ingénieure DevOps / SRE au sein de la DPIA, vous serez en charge de :
- Construire et opérer l'infrastructure du socle IA : hébergement et déploiement des briques d'inférence, de service de modèles et de RAG, en conteneurs sur un orchestrateur (Kubernetes / OpenShift)
- Industrialiser les déploiements : chaînes CI/CD, automatisation des mises en production, gestion des environnements, infrastructure as code
- Assurer le passage à l'échelle et la disponibilité du socle pour des services à destination de 90 000 agents : dimensionnement, auto-scaling, gestion de la charge et des pics d'usage
- Éprouver la tenue à la charge du socle par des campagnes de tests de charge, avant mise en production comme lors des montées en charge successives
- Mettre en place et faire vivre l'observabilité : journalisation, métriques, traces, tableaux de bord et alerting, aussi bien sur l'infrastructure que sur les usages des modèles (latence, débit, consommation, erreurs)
- Sécuriser l'infrastructure : gestion des rôles et des permissions, cloisonnement des flux, networking, gestion des secrets, application des exigences de sécurité du Ministère
- Contribuer à la fiabilité opérationnelle : traitement des incidents, analyse post-mortem, amélioration continue de la robustesse du socle
- Documenter et outiller l'équipe : rendre le socle exploitable et compréhensible par les développeurs qui construisent les solutions métiers au-dessus
- L'équipe ayant vocation à grandir, vous contribuerez également à définir les pratiques d'exploitation et les standards d'industrialisation au fur et à mesure de son renforcement. Une partie de vos missions s’exerceront en lien avec la direction du numérique (DNUM).
Hébergement et déploiement cloud, conteneurisation (Docker ou équivalent) et orchestration (Kubernetes, OpenShift)
Passage à l'échelle : dimensionnement, auto-scaling (horizontal et vertical), optimisation des ressources
Tests de charge : conception de scénarios représentatifs, mesure des limites du service et exploitation des résultats pour dimensionner l'infrastructure (k6, Locust, JMeter ou équivalents)
Chaînes CI/CD : automatisation des builds, tests et déploiements, stratégies de livraison (GitOps, déploiement progressif)
Exploitation de ressources GPU pour l'inférence IA (appréciée, non exigée) : configuration, opération et optimisation de GPU - pilotes et runtime CUDA, serveurs d'inférence (vLLM ou équivalents)
Savoir-faire
Observabilité : journalisation, supervision, métriques, traces et alerting, avec les outils de l'écosystème (Grafana, ELK, Prometheus, OpenTelemetry ou équivalents)
Infrastructure as code : description d'infrastructure sous la forme de code de configuration déclarative (Terraform, Helm ou équivalents)
Sécurisation d'infrastructure : gestion des rôles et permissions (RBAC), politiques réseau et cloisonnement des flux, gestion des secrets
Aisance en scripting et en automatisation (Python ou équivalent)
Hébergement de modèles IA : montée en compétence attendue
Le socle repose sur l'hébergement de modèles de langage et l'exploitation de ressources GPU. Une expérience préalable sur ces sujets n'est pas exigée : nous sommes ouverts à un profil Ops solide qui n'a jamais administré de cluster GPU ni servi de modèles en production.
En revanche, nous attendons une volonté forte et démontrée de monter en compétence sur ces sujets (serveurs d'inférence, gestion de ressources GPU, spécificités opérationnelles des charges IA). Cette capacité sera évaluée en entretien.
Savoir-être
Curiosité technique et envie d'apprendre : l'IA est un domaine en évolution rapide, vous serez amené·e à monter en compétence sur l'inférence, le service de modèles et les architectures RAG
Rigueur et attachement aux bonnes pratiques de l'industrie
Culture du service rendu : vous concevez le socle comme un produit au service des équipes qui l'utilisent
Sens du collectif : l'équipe privilégie la collaboration et les décisions partagées entre PM, design et tech
Autonomie et capacité d'ownership : vous vous sentez responsable de votre périmètre, de la conception à l'exploitation
Regard critique et proactivité - vous challengez vos propres pratiques comme celles de l'équipe pour améliorer en continu la plateforme
Expériences professionnelles antérieures souhaitées
Minimum 5 ans d'expérience en tant qu'Ops, DevOps, SRE ou Ingénieur·e plateforme
Expérience confirmée en conteneurisation et en orchestration : Kubernetes ou OpenShift en production, sur un périmètre dont vous étiez responsable
Expérience d'exploitation d'un service en production avec de forts enjeux de disponibilité ou de volumétrie
Une expérience dans un environnement soumis à de fortes contraintes de sécurité est un plus
Informations complémentaires : Poste nécessitant une enquête administrative de sécurité
Organisation de travail :
télétravail possible 3 jours par semaine
Rémunération attractive –
selon profil, avec prise en compte de la rémunération antérieure. Possibilité d’un contrat à durée indéterminée (CDI)
Restauration :
oui (restaurant administratif)
Accessibilité en transport / Parking : Rosa Parks :
transports en commun (RER E Rosa Parks, T3b, M12 Front populaire, M7 Corentin Cariou puis navette fluviale, bus 35 et 239) / Parking possible sur demande
Processus de recrutement :
Le recrutement se déroule en trois étapes :
Screening - analyse de votre candidature et de votre parcours
Test technique (1h30) - exercice pratique avec et sans préparation, pour évaluer vos compétences d'exploitation (orchestration, CI/CD, observabilité, sécurisation), ainsi que votre capacité à aborder un sujet technique nouveau
Rencontre avec l'équipe et la direction (1h)