Sr. Infrastructure Reliability Engineer, Infrastructure Reliability & Quality
Core
Proactively drive reliability risk identification, assessment, and mitigation for datacenter infrastructure equipment (UPS, transformers, breakers, power electronics, BESS) and perform root cause analysis of critical failures.
Role type
Senior Infrastructure Reliability Engineer (Datacenter Hardware)
Builds
Datacenter infrastructure reliability models, risk analysis plans, and continuous improvement programs for AWS global infrastructure.
Domain
Datacenter infrastructure, Power systems, Reliability Engineering
Deliverable
production ML models | product features | dashboards & analysis | research | client delivery | infrastructure | physical/clinical work
Required skills
Physics-of-Failure approach, lifecycle environmental and operational stress analysis, statistical modeling, vendor qualification, root cause analysis, system reliability modeling, data analytics
Preferred skills
Construction drawing interpretation, Power electronics design, Solid State transformer experience, Master's in Reliability/Physics/Electrical/Mechanical/Materials Engineering
Technologies
Reliability block diagram, statistical modeling tools, data analytics platforms
Responsibilities
Drive risk identification and assessment for datacenter equipment from design to deployment; Analyze field data and drive corrective/preventive actions for critical failures; Manage vendor auditing and qualification processes; Develop system-level reliability models for configuration optimization.
Seniority
Senior, hands-on IC with program management