Site Reliability Engineer
Core
Build, maintain, and improve scalable AWS infrastructure, observability, and CI/CD pipelines to enhance operational resilience and support faster development delivery.
Role type
Senior Site Reliability Engineer (Cloud Infrastructure & Platform)
Builds
Scalable AWS infrastructure, automated CI/CD pipelines, and observability tooling for distributed systems.
Domain
Cloud Infrastructure / DevOps / Platform Engineering
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
AWS production environment experience, AWS CDK (TypeScript), TypeScript, CI/CD tooling (Jenkins, GitLab CI), containerization (Docker, Kubernetes, EKS, ECS), observability (Prometheus, Grafana, AppDynamics, OpenSearch), scripting (Python, TypeScript, Java), cloud security best practices.
Preferred skills
AWS certifications.
Technologies
AWS, CDK, TypeScript, Jenkins, GitLab CI, Docker, Kubernetes, EKS, ECS, Prometheus, Grafana, AppDynamics, OpenSearch, Python, Java.
Responsibilities
Build and maintain scalable AWS infrastructure; Develop and manage Infrastructure as Code using AWS CDK; Support CI/CD pipelines and deployment automation; Improve monitoring, logging, and observability across distributed systems; Support incident management, root cause analysis, and platform reliability improvements; Contribute to cloud best practice, automation, and platform engineering standards.
Seniority
Senior, hands-on IC