Site Reliability Engineer - Azure (4-8yrs)
Core
Manage, scale, and ensure high availability of core infrastructure for a high-volume digital payments platform.
Role type
Senior Site Reliability Engineer (Azure)
Builds
High-availability cloud infrastructure, automation pipelines, and observability solutions for a mission-critical payments network.
Domain
Fintech / Cloud Infrastructure
Deliverable
production ML models | infrastructure
Required skills
Microsoft Azure (VMs, Networking, Storage, CosmosDB), Linux (Ubuntu), Python/Go/Java, Terraform, Saltstack/Ansible, Bash, Prometheus, Victoria Metrics, Riemann, Loki, Grafana, MySQL, Aerospike, Nginx, HA Proxy, Docker, RabbitMQ
Preferred skills
BGP routing, Elastic Search, InfluxDB, SLO/SLA management, cost optimization, mentorship
Technologies
Azure, Terraform, Saltstack, Ansible, Prometheus, Victoria Metrics, Riemann, Loki, Grafana, MySQL, Aerospike, Nginx, HA Proxy, Docker, RabbitMQ
Responsibilities
Configure and maintain Azure networking components (Firewall, Route Tables, Express Route); Drive automation for BAU tasks using Terraform and configuration management tools; Set up and manage high-availability databases (MySQL, Aerospike) and implement replication; Implement monitoring and centralized logging solutions; Participate in on-call rotation and lead incident response and Root Cause Analysis.
Seniority
Senior, hands-on IC