Enterprise Infrastructure Resiliency Engineer
Core
Designing, testing, and executing disaster recovery and business continuity plans for large-scale global enterprise infrastructure.
Role type
Senior IC Disaster Recovery and Infrastructure Resiliency Engineer
Builds
Production DR runbooks, recovery simulations, and resilient server/cloud environments
Domain
Enterprise IT Infrastructure, Disaster Recovery, Business Continuity
Deliverable
production ML models | product features | dashboards & analysis | research | client delivery | infrastructure | physical/clinical work
Required skills
Disaster recovery planning, high availability architecture, Windows/Linux administration, virtualization (VMware/Hyper-V/Nutanix), backup and replication technologies, cloud platforms (AWS/Azure/GCP), infrastructure monitoring, root cause analysis
Preferred skills
Automation scripting (PowerShell/Python/Ansible), ITIL practices, data center operations, storage platforms, networking fundamentals, cybersecurity best practices
Technologies
VMware vSphere, Hyper-V, Nutanix, AWS, Azure, Google Cloud, PowerShell, Python, Ansible
Responsibilities
Develop and maintain enterprise disaster recovery plans and runbooks; Coordinate and lead DR testing activities including tabletop exercises and failover simulations; Validate backup integrity, RPO, and RTO; Perform administration and engineering support for enterprise server, virtualization, storage, and cloud environments; Troubleshoot infrastructure performance, replication, backup, and connectivity issues; Participate in incident response and major outage coordination efforts.
Seniority
Senior, hands-on IC