Senior Site Reliability Engineer
Core
Ensuring high availability and operational excellence for mission-critical financial services software in a multi-cloud environment.
Role type
Senior Site Reliability Engineer
Builds
Production Cloud services for Lending, Payments, and Universal Banking
Domain
Financial Services / Cloud Infrastructure
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Java Enterprise (Jboss, WebLogic), Linux (RHEL), Microsoft Azure, Infrastructure as Code (Terraform, Ansible), Java/Python/Go/.Net, Kubernetes, Monitoring (Prometheus, Grafana, Loki), RDBMS (Oracle, PostgreSQL), CI/CD (Azure DevOps, Jenkins), Git, Kafka, IBM MQ
Preferred skills
None explicitly stated as preferred
Technologies
Azure, Kubernetes, Terraform, Ansible, Kafka, IBM MQ, Oracle, PostgreSQL, Jboss, WebLogic, Red Hat Enterprise Linux, Prometheus, Grafana, Loki, Azure DevOps, Jenkins, Git, Gradle, Maven
Responsibilities
Drive operational excellence for Payments Cloud services to ensure 'always on' availability; Rollout infrastructure, OS, and application updates with zero consumer impact; Implement end-to-end monitoring and alerting; Manage desired state configuration of Java applications; Lead root cause analysis through blameless post-mortems; Prepare run books and training materials; Convert operational issues into development stories.
Seniority
Senior, hands-on IC