Site Reliability Engineer
Core
Guardian of platform reliability and performance for a global hospitality booking system, ensuring seamless transactions across 150 countries.
Role type
Senior Site Reliability Engineer (AWS/Kubernetes)
Builds
Scalable AWS cloud solutions and resilient infrastructure for a unified hotel management platform.
Domain
Hospitality technology / Cloud Infrastructure
Deliverable
infrastructure
Required skills
AWS architecture, Kubernetes (EKS), Helm, Terraform, ArgoCD, GitOps, Observability (Grafana, Prometheus, DataDog, CloudWatch), Incident Management, Root Cause Analysis, Networking (VPC, Security Groups), Databases (MySQL, PostgreSQL, Aurora), Middleware (Redis, Memcached, SQS)
Preferred skills
Database Administration (Aurora, MySQL, PostgreSQL), PCI-compliant environment experience, Kong API Gateway
Technologies
AWS, Kubernetes, EKS, Helm, ArgoCD, Terraform, Grafana, Prometheus, DataDog, CloudWatch, Nginx, MySQL, PostgreSQL, Aurora, Redis, Memcached, SQS, Kong
Responsibilities
Design and implement reliable AWS architecture; Maintain and support highly loaded Kubernetes clusters; Support CI/CD processes; Automate deployments; Develop and improve Observability systems; Respond to incidents and perform RCA; Optimize system performance; Collaborate on security best practices; Provide infrastructure support rotation.
Seniority
Senior, hands-on IC