SRE OOS
Notre client est un acteur Cloud, opérateur souverain et durable de l’Expérience en tant que Service qui offre à ses clients des environnements technologiques de confiance.
Nous recrutons un·e SRE afin de renforcer l’équipe OOS.
Vos missions :
• Concevoir et déployer l’infrastructure supportant la gateway S3, en mettant l’accent sur l’automatisation du cycle de vie des clusters K8S
• Développer l’expertise sur l’exploitation de FoundationDB (configuration, tuning, gestion de la résilience et de la durabilité des données)
• Participer au développement d’operators ou controllers Kubernetes et des outils d’observabilité internes, idéalement en Rust ou Go, pour automatiser les opérations complexes.
• Définir les pré-requis matériels optimaux et assurer le déploiement des OS cibles (pour les couches applicatives, pour les couches de données).
• Documenter les procédures d’exploitation et accompagner l’équipe OPS dans la phase de transition vers le RUN (Assistance de niveau 3).
Stack technique :
– Orchestration : Kubernetes
– Data : FoundationDB (Key/Value store)
– Stockage objet (multi-backend)
– Langages : Rust (prioritaire) ou Go
– Système : Rocky Linux, Talos OS, hardware tuning (Compute/Storage/Network)
– Outillage : Infrastructure as Code, Observabilité avancée.
Votre profil :
• De formation type Bac+5 en informatique, vous possédez une expérience professionnelle post-diplôme minimum de 5 ans en tant que SRE ou d’ingénieur Système sur des environnements distribués à large échelle.
• Vous avez une expérience significative sur des bases de données distribuées (NoSQL/KV Store).
• Une connaissance de FoundationDB est un atout majeur ; à défaut, une expertise sur des systèmes similaires (Cassandra, TiDB, Etcd) et leurs problématiques de consensus/réplication est requise.
• Vous maîtrisez le développement logiciel pour l’automatisation.
• Vous êtes capable de gérer des clusters « bare metal » et de développer des contrôleurs/opérateurs personnalisés
• Vous comprenez les interactions entre le logiciel et le matériel (I/O wait, latence réseau, spécificités NVMe) pour conseiller sur les choix d’infrastructure physique.
• Pédagogue, vous savez transmettre des concepts complexes aux équipes de production.
