Site Reliability Engineering Manager (Data Infra)
Core
Lead and empower a team of Site Reliability Engineers to ensure platform resilience, scalability, and security for stateful/data layer technologies powering global financial crime detection services.
Role type
Senior IC Site Reliability Engineering Manager (Data Infra)
Builds
Stateful and data layer technologies (YugaByte, Kafka, Elasticsearch, Redis, Spark) on multi-cloud Kubernetes infrastructure
Domain
Financial crime compliance / Fintech / Cloud Infrastructure
Deliverable
infrastructure
Required skills
Team leadership and growth, Kubernetes, Terraform, Microservices architecture, Cloud native architectures (AWS/GCP), Technical documentation
Preferred skills
Observability platform management, Pipeline tool management, Start-up/scale-up environment experience
Technologies
YugaByte, Kafka, Strimzi, Elasticsearch, ECK, Redis, Spark, GCP, AWS, Kubernetes, Terraform, Helm, GitOps, ArgoCD, Istio, Grafana Cloud, Mimir, Open Telemetry
Responsibilities
Manage team growth, development, hiring, and onboarding; Set technical direction and accountability for tech decisions; Collaborate with stakeholders to meet internal customer needs; Ensure team implementation meets industry standards
Seniority
Senior, hands-on IC with management responsibilities