Sr Site Reliability Engineer (Cloud Operations)
Core
Ensure 24x7 availability and business continuity for customer-facing healthcare software applications and platforms hosted on Microsoft Azure.
Role type
Senior Site Reliability Engineer (Cloud Operations)
Builds
Customer-facing digital health software applications and platforms on Azure
Domain
Healthcare / Cloud Infrastructure
Required skills
Azure administration, disaster recovery planning, business continuity planning, SLA definition, infrastructure monitoring, scripting and automation, systems administration (Windows/Linux), security and compliance protocols
Preferred skills
Azure certifications, enterprise engineering experience in regulated environments
Technologies
Microsoft Azure, Windows, Linux
Responsibilities
Drive strategies for 24x7 service availability and business continuity; Manage and administer Azure resources (VMs, databases, networking); Define and document operating procedures for security and compliance; Manage Disaster Recovery and Business Continuity Planning; Establish and refine Operations SLAs; Create infrastructure and application monitoring dashboards; Standardize site metrics and report on benchmarks; Collaborate with DevOps Engineers on automation.
Seniority
Senior, hands-on IC

