Senior Manager, Data & Storage Reliability Engineering
Core
Lead a team of engineers to drive engineering excellence in prevention, reliability, observability, and risk reduction for large-scale SaaS database and storage platforms.
Role type
Senior Manager, Data & Storage Reliability Engineering
Builds
Durable engineering improvements, automation, and resilient platform services for ServiceNow's large-scale SaaS environment.
Domain
SaaS, Database Engineering, Distributed Systems, Reliability Engineering
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Team leadership, strategic planning, root cause analysis, automation design, capacity planning, observability strategy, incident management, stakeholder management, performance tuning, scalability engineering
Preferred skills
AI integration in workflows, growing technical teams, enterprise database platform operations
Technologies
Linux, distributed systems, cloud-native architectures, observability platforms, database technologies
Responsibilities
Define and execute team-level strategy for reliability and prevention; lead initiatives to convert incident learnings into engineering improvements; drive observability and automation initiatives; identify and resolve recurring failure patterns; build and develop a world-class engineering team; manage recruitment, career development, and performance reviews; partner with cross-functional teams to improve platform architecture and reliability.
Seniority
Senior, hands-on IC with leadership

