Site Reliability Engineer (Hosted Infra) - Platform
Core
Building and operating multi-cloud infrastructure at scale for Elastic Cloud, focusing on automation, reliability, and observability.
Role type
Senior Site Reliability Engineer (Infrastructure)
Builds
Elastic Cloud platform across 4 cloud providers and 70+ regions
Domain
Cloud Infrastructure / Search AI
Deliverable
production ML models | infrastructure
Required skills
Golang, Linux systems administration, containerized workloads, Infrastructure as Code (IaC), automation, observability, incident response, mentoring
Preferred skills
Terraform, Puppet, Ansible, Argo CD, Argo Workflows, CUE, Docker, Kubernetes, Ubuntu, Elastic Stack, Prometheus, Influx
Technologies
Golang, Linux, Terraform, Puppet, Ansible, Argo CD, Argo Workflows, CUE, Docker, Kubernetes, Ubuntu, Elastic Stack, Prometheus, Influx
Responsibilities
Engineering software to automate large-scale systems, optimizing host reliability and lifecycle, strengthening observability posture, scaling global infrastructure, participating in on-call rotation and incident response, mentoring teammates
Seniority
Senior, hands-on IC