Sr. Specialist, SRE – Compute Platforms
Core
Enterprise technical owner for compute platforms (IBM Mainframe, AIX, IBM iSeries) ensuring reliability, governance, and lifecycle strategy.
Role type
Senior Site Reliability Engineering (SRE) Specialist
Builds
Enterprise compute environment reliability and governance
Domain
Mainframe infrastructure and enterprise IT operations
Deliverable
production ML models | product features | dashboards & analysis | research | client delivery | infrastructure | physical/clinical work
Required skills
Mainframe platform governance, z/OS lifecycle planning, vendor management, observability strategy, disaster recovery governance, service reliability principles, incident management, change management, risk management, capacity planning
Preferred skills
AIX, IBM iSeries, enterprise middleware, storage and backup services, MSP-governed environments
Technologies
IBM Mainframe (z/OS), AIX, IBM iSeries, New Relic, HCL/Harmony
Responsibilities
Provide governance and oversight of Mainframe services and lifecycle planning; Establish governance standards for monitoring, alerting, and observability; Lead vendor performance reviews and validate contractual obligations; Drive continuous improvement for service reliability and operational excellence; Act as primary technical escalation authority for platform risks and incidents; Define strategic direction for platform modernization and technology currency.
Seniority
Senior, hands-on IC with strategic leadership