Senior Site Reliability Engineer
Core
Drive reliability, availability, and scalability of global payment processing systems through end-to-end ownership of observability, incident response, and cloud infrastructure.
Role type
Senior Site Reliability Engineer (IC)
Builds
Mission-critical payment processing systems operating across Europe, Asia, and North America
Domain
Fintech / Payments / Cloud Infrastructure
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Incident management, SLO/SLI design, infrastructure automation, distributed systems architecture, capacity planning, root-cause analysis, PCI-DSS compliance, Kubernetes, AWS, Terraform, PostgreSQL, Redis, Kafka, Linux, networking, observability platforms
Preferred skills
Technical mentorship, resilience-by-design practices, cross-functional leadership
Technologies
AWS, Kubernetes (EKS), Terraform, PostgreSQL, Redis, Kafka, Linux, Datadog, Prometheus, Grafana
Responsibilities
Lead incident management during SEV1/SEV2 events, diagnose and resolve complex production incidents, define and maintain SLOs and error budgets, drive systemic reliability improvements via automation and RCA, strengthen security posture in regulated environments, mentor junior engineers
Seniority
Senior, hands-on IC