CareerPlanSign in

Sr. Specialist, SRE – Compute Platforms

Toronto, ON💼 Full-time🗓 2026-08-25 → 2026-09-26

Core

Enterprise technical owner for compute platforms (IBM Mainframe, AIX, IBM iSeries) ensuring reliability, governance, and lifecycle strategy.

Role type

Senior Site Reliability Engineering (SRE) Specialist

Builds

Enterprise compute environment reliability and governance

Domain

Mainframe infrastructure and enterprise IT operations

Deliverable

production ML models | product features | dashboards & analysis | research | client delivery | infrastructure | physical/clinical work

Required skills

Mainframe platform governance, z/OS lifecycle planning, vendor management, observability strategy, disaster recovery governance, service reliability principles, incident management, change management, risk management, capacity planning

Preferred skills

AIX, IBM iSeries, enterprise middleware, storage and backup services, MSP-governed environments

Technologies

IBM Mainframe (z/OS), AIX, IBM iSeries, New Relic, HCL/Harmony

Responsibilities

Provide governance and oversight of Mainframe services and lifecycle planning; Establish governance standards for monitoring, alerting, and observability; Lead vendor performance reviews and validate contractual obligations; Drive continuous improvement for service reliability and operational excellence; Act as primary technical escalation authority for platform risks and incidents; Define strategic direction for platform modernization and technology currency.

Seniority

Senior, hands-on IC with strategic leadership

Sourced via workday · Listed on CareerPlan, which tracks 70,000+ jobs from 20+ sources.