Associate Staff Engineer(SRE)
Core
Ensure reliability, availability, performance, and scalability of production systems supporting hotel operations, reservation services, and guest-facing applications.
Role type
Senior Site Reliability Engineer (SRE)
Builds
Highly available, business-critical platforms for hospitality (PMS, CRS, booking, loyalty, payment)
Domain
Hospitality Technology / Cloud Infrastructure
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
AWS, Kubernetes, Terraform, CI/CD, Linux, observability, incident management, scripting (Python/Bash/Go/Java), networking, microservices
Preferred skills
Hospitality industry experience, PCI DSS/GDPR compliance, chaos engineering, FinOps, Kafka/Redis
Technologies
AWS, Azure, GCP, Kubernetes (EKS/AKS/GKE/OpenShift), Terraform, CloudFormation, Jenkins, GitHub Actions, GitLab CI, Prometheus, Grafana, Dynatrace, Splunk, Kafka, Redis
Responsibilities
Define and monitor SLIs/SLOs/SLAs; act as senior escalation point for P1/P2 incidents; lead RCA and post-incident reviews; reduce operational toil via automation; operate workloads across multi-cloud environments; maintain IaC and CI/CD pipelines; implement observability solutions; perform capacity planning and disaster recovery testing.
Seniority
Senior, hands-on IC