Technology Engineer - SRC (Run the Bank/SRE)
Core
Support mission-critical applications in a 24x7 enterprise environment, focusing on production stability, incident remediation, and continuous reliability improvement across distributed platforms.
Role type
Senior Site Reliability Engineer (SRE)
Builds
High-availability distributed platforms and enterprise banking systems
Domain
Banking / Financial Services / Distributed Systems
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Incident management, root cause analysis, change management, monitoring & alerting, troubleshooting, automation, capacity planning, disaster recovery
Preferred skills
Machine Learning (ML), Enterprise Architecture Framework, emerging technologies
Technologies
Enterprise observability tools, ETL systems, distributed platforms
Responsibilities
Lead P1/P2 incident response and triage, conduct root cause analysis for recurring incidents, execute production changes and releases, develop monitoring dashboards and alerting strategies, perform capacity planning and system tuning, automate manual operational processes
Seniority
Senior, hands-on IC