Site Reliability Engineer II
Core
Design and implement automation solutions to improve service reliability, availability, and performance for enterprise customers; analyze operational data to provide insights for product design.
Role type
Senior IC Site Reliability Engineer
Builds
Tooling and automation solutions for faster issue resolution and proactive alerting (via careerplan.io/jobs/1970393556918639-site-reliability-engineer-ii-at-microsoft)
Domain
Cloud infrastructure and distributed systems
Deliverable
production ML models | infrastructure
Required skills
Service reliability engineering, large-scale cloud operations, root cause analysis, incident mitigation, observability patterns, automation design, data analysis, Jupyter Notebooks, Logic Apps
Preferred skills
None stated
Technologies
Logic Apps, Jupyter Notebooks
Responsibilities
Collaborate with engineering teams to build automation for SLO improvement; interface with enterprise customers for service escalations; design telemetry changes for automation consumption; analyze data to provide operational insights to product teams; influence product architecture for supportability.
Seniority
Senior, hands-on IC
