Senior Manager Site Reliability & Dev Ops engineering - EMEA
Core
Lead Site Reliability and Service Management for a regional squad, driving operational excellence, resilience, and cost-effective on-prem environments for critical financial markets infrastructure.
Role type
Senior Manager, Site Reliability & DevOps
Builds
Secure, reliable, and cost-effective on-prem environments; CI/CD pipelines; observability and resilience strategies.
Domain
Financial markets infrastructure and data
Deliverable
production ML models | infrastructure
Required skills
Site Reliability Engineering (SRE) practices, DevOps practices, CI/CD pipeline design, Infrastructure as Code (IaC), observability implementation, chaos and disaster recovery testing, capacity management, technical leadership, team development, incident management, problem management, service risk management.
Preferred skills
Experience building SRE practices from the ground, deep expertise in GitLab, Terraform, Ansible, ITSM practices.
Technologies
GitLab, Terraform, Ansible
Responsibilities
Lead Site reliability & Service management for regional squad members; Lead a team of DevOps Engineers to build and manage secure, reliable, and cost-effective on prem environments; Drive observability and resilience through chaos and disaster recovery testing; Design, implement and optimize infrastructure operations using DevOps CI/CD practices; Provide follow-the-sun technical escalation response; Drive Technical Recovery and Problem Management response.
Seniority
Senior, hands-on IC with leadership responsibilities