Site Reliability Engineer (SRE) confirmé H/F
Core
Implement SRE practices to improve the reliability, resilience, and performance of the IT system.
Role type
Senior Site Reliability Engineer (SRE)
Builds
Production ML models | product features | infrastructure
Domain
IT Infrastructure & Cloud Services
Deliverable
infrastructure
Required skills
SRE practices, SLI/SLO definition, Error Budget management, Root Cause Analysis (RCA), Observability tools (Dynatrace, Grafana, ELK), ITIL processes, Complex system architecture analysis
Preferred skills
SAFe certification, Vulnerability identification, Cross-functional impact analysis
Technologies
Dynatrace, Grafana, ELK (Elastic Stack)
Responsibilities
Identify structural IT system weaknesses, Analyze reliability and resilience risks, Define and analyze SLI/SLO metrics, Map technical chains supporting business processes, Contribute to SRE practices (TOIL, Error Budget, RCA), Participate in complex cross-functional technical changes
Seniority
Senior, hands-on IC