Skip to content
← Back to job listings

CLOUD - LEAD SRE - COMPUTE AND ORCHESTRATION

Civils de la Défense - Ministère des Armées et des Anciens combattants · Le Kremlin-Bicêtre, Ile-de-France, France

RemoteImported listingfull-time3 days ago

About The Role

Rejoignez notre équipe en tant que Lead SRE Compute & Orchestration. Vous serez responsable de la conception, du déploiement et de l'exploitation de l'ensemble de la stack compute. Vos missions incluront l'automatisation du provisionnement, la maîtrise de la couche firmware, la production et le déploiement des images OS, l'implémentation de la virtualisation, l'exploitation des clusters Kubernetes, la garantie de la reproductibilité, la mise en œuvre de la sécurité, la rédaction de la documentation technique, le pilotage de l'exploitation et l'encadrement technique des ingénieurs. Vous devez avoir plus de 10 ans d'expérience en production et une expertise dans l'exploitation de plateformes d'hébergement à grande échelle.

  • Concevoir, déployer et opérer l'ensemble de la stack compute, y compris l'automatisation du provisionnement et de l'inventaire.
  • Maîtriser, durcir et automatiser la couche firmware, ainsi que produire et déployer les images OS durcies.
  • Implémenter et exploiter la couche de virtualisation (OpenStack, Incus, KubeVirt ou équivalent) en garantissant isolation et résilience.

**Profil recherché**

Nous cherchons un expert infrastructure compute confirmé (10+ ans d'expérience en production), capable de concevoir et opérer les couches basses d'une plateforme critique, avec une approche SRE et une sensibilité sécurité.

Vous possédez de l'expérience professionnelle

  • Exploitation en production, en mode SRE, de plateforme d'hébergement à grande échelle : gestion d'incidents, astreintes, pilotage par SLO/SLI ;
  • Maîtrise opérationnelle d'au moins une solution d'orchestration de compute en production :
  • Soit virtualisation : OpenStack, Incus ou équivalent avec gestion multi-cluster, isolation et résilience ;
  • Soit Kubernetes : déploiement et exploitation de clusters multi-sites avec leur gestion centralisée (Rancher ou équivalent) ;
  • Provisionnement bare metal à grande échelle ;
  • Culture SRE : automatisation, observabilité, RETEX et amélioration continue.

Vous disposez également des compétences techniques suivantes

  • Expertise pointue attendue sur l'un des deux domaines (VM ou Kubernetes), le second étant couvert par un recrutement complémentaire ;
  • Maîtrise fonctionnement Linux et expérience des OS immutables ou durcis ;
  • Expertise d'un OS déclaratif ou et d'un langage d'infrastructure as code (Terraform, Ansible, Helm) ;
  • Maîtrise d'au moins un langage de programmation (Go ou Python) : être capable d'implémenter des routines d'orchestration (contrôleurs) ;
  • Très bonne connaissance des questions de sécurité et de durcissement (firmware, OS, runtime), capacité à dialoguer avec une chaîne SSI.

Vous êtes

  • Rigoureux : Capacité à concevoir et maintenir des infrastructures critiques avec une attention méticuleuse aux détails, particulièrement dans les aspects de sécurité et de reproductibilité.
  • Innovant : Capacité à proposer des solutions techniques avancées et à implémenter des bonnes pratiques
  • Ancreé dans une culture d'analyse factuelle et d'amélioration continue ;

Atouts appréciés

  • Expérience d'environnements multi-sites / multi-régions ;
  • Expérience avec des environnements air-gapped ;
  • Connaissance de SecNumCloud et IGI 1300 ;
  • Contributions open source.

This is an external listing. JobSpring does not represent or verify the employer. Report this listing