CareerPlanSign in

Senior Site Reliability Engineer

Hong Kong, Hong Kong, Hong Kong💼 Full-time🗓 2026-09-08 → 2026-09-26

Core

Drive reliability, availability, and scalability of global payment processing systems through end-to-end ownership of observability, incident response, and cloud infrastructure.

Role type

Senior Site Reliability Engineer (IC)

Builds

Mission-critical payment processing systems operating across Europe, Asia, and North America

Domain

Fintech / Payments / Cloud Infrastructure

Deliverable

production ML models | product features | dashboards & analysis | infrastructure

Required skills

Incident management, SLO/SLI design, infrastructure automation, distributed systems architecture, capacity planning, root-cause analysis, PCI-DSS compliance, Kubernetes, AWS, Terraform, PostgreSQL, Redis, Kafka, Linux, networking, observability platforms

Preferred skills

Technical mentorship, resilience-by-design practices, cross-functional leadership

Technologies

AWS, Kubernetes (EKS), Terraform, PostgreSQL, Redis, Kafka, Linux, Datadog, Prometheus, Grafana

Responsibilities

Lead incident management during SEV1/SEV2 events, diagnose and resolve complex production incidents, define and maintain SLOs and error budgets, drive systemic reliability improvements via automation and RCA, strengthen security posture in regulated environments, mentor junior engineers

Seniority

Senior, hands-on IC

Sourced via workable · Listed on CareerPlan, which tracks 70,000+ jobs from 20+ sources.