Senior Site Reliability Engineer
Core
Build, operate, and support highly available cloud-native services on AWS, ensuring reliability, scalability, performance, and security.
Role type
Senior Site Reliability Engineer (SRE)
Builds
Cloud-native services on AWS (ECS, Aurora RDS)
Domain
Cloud Infrastructure / SRE
Deliverable
production ML models | infrastructure
Required skills
AWS, Terraform, GitHub Actions, Datadog, incident management, root cause analysis, automation, distributed architectures
Preferred skills
monitoring, system reliability practices, cross-functional collaboration
Technologies
AWS, ECS, Aurora RDS, Terraform, GitHub Actions, AWS CodePipeline, Datadog, CloudWatch
Responsibilities
Build and manage CI/CD pipelines, implement monitoring and observability, lead incident response and on-call support, drive continuous improvements in system resilience
Seniority
Senior, hands-on IC
Sourced via workday · Listed on CareerPlan, which tracks 70,000+ jobs from 20+ sources.