Site Reliability Engineer
Core
Senior SRE responsible for ownership of availability, performance, and scalability of critical shared cloud services.
Role type
Senior IC Site Reliability Engineer
Builds
Cloud-hosted systems on AWS and Azure
Domain
Financial markets infrastructure, multi-cloud (AWS/Azure)
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Scripting (Shell, Python), Infrastructure as Code (Terraform), AWS services, Azure services, Docker, Kubernetes, CI/CD pipelines, Git workflows, Observability tools
Preferred skills
AWS Well-Architected Framework, Azure Architecture Center, Cloud security guidelines, Cloud-native databases, DevOps concepts
Technologies
AWS (EC2, S3, RDS, IAM, VPC, Lambda, CloudWatch, CodePipeline), Azure (AKS, ARM templates, DevOps, Monitor), Terraform, Datadog, Docker, Kubernetes, Git
Responsibilities
Maintain SLOs and measure system health; Design and implement automation for scaling and recovery; Partner with dev teams on reliability and release velocity; Participate in on-call, incident response, and postmortems; Enable cloud migration via architectural reviews and observability setup; Drive continuous learning in multi-cloud technologies
Seniority
Senior, hands-on IC