Senior Site Reliability Engineer

Engit — France · Posted ~1 day ago

Senior Full-time

Skills

SRE Prometheus Grafana Splunk Centreon Automation Monitoring Incident Management

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Summary

Support and improve the reliability of complex production environments by enhancing monitoring, automating operations, and resolving critical incidents.

Highlights

Work on critical production systems, improve observability, automate operations, and drive platform reliability improvements.

Description

Vous aimez fiabiliser des systèmes critiques, améliorer l’observabilité des plateformes et intervenir sur des environnements techniques complexes ? Nous recherchons un(e) Site Reliability Engineer (SRE) Senior pour contribuer à la disponibilité, la performance et la résilience d’un SI à fort enjeu. 🎯 Vos missions : • Garantir le maintien en conditions opérationnelles des services et plateformes de production • Analyser et traiter les incidents complexes, participer aux cellules de crise et réaliser les analyses post-incidents • Améliorer l’observabilité des systèmes (monitoring, logs, métriques, alerting) et réduire le bruit opérationnel • Développer l’automatisation et l’industrialisation des activités d’exploitation • Contribuer aux démarches d’amélioration continue autour de la fiabilité et de la performance 🔎 Profil recherché : • 7 ans minimum d’expérience sur des rôles SRE / Production / DevOps • Maîtrise des outils d’observabilité : Prometheus, Grafana, Splunk, Centreon • Bonne connaissance des environnements conteneurisés : Docker, Kubernetes • Solide compréhension des architectures distribuées, microservices et infrastructures hybrides • Compétences en scripting (Python, Shell) et automatisation • Capacité à diagnostiquer des incidents complexes et à collaborer avec des équipes techniques pluridisciplinaires 🛠️ Environnement technique : Kubernetes, VMware, Linux, Java/SpringBoot, PostgreSQL/MariaDB, Prometheus, Grafana, Splunk, Tempo 💼 CDI ou freelance selon profil 📍 Localisation : Orléans – 2 jours de télétravail/semaine 📅 Démarrage : Septembre 2026