Director, Intelligent Platforms
Core
Lead enterprise-scale reliability, observability, and operational transformation initiatives to improve service availability and operational efficiency.
Role type
Director, Site Reliability Engineering & Operational Intelligence
Builds
Enterprise observability platforms, infrastructure automation, AI-enabled operations, and service reliability practices.
Domain
Healthcare technology / Site Reliability Engineering / Observability
Deliverable
production ML models | infrastructure
Required skills
Site Reliability Engineering (SRE) leadership, Observability platform management, Infrastructure as Code (Terraform), Configuration Management (Ansible), Enterprise operational transformation, Budget and roadmap management, Cross-functional executive partnership
Preferred skills
AIOps and MLOps platforms, Generative AI and LLMs, Distributed tracing technologies, RAG architectures, Vector database technologies, Self-healing infrastructure, Cloud platform expertise (Azure, AWS, GCP)
Technologies
Dynatrace, Datadog, LogicMonitor, Prometheus, Terraform, Ansible, Azure, AWS, Google Cloud Platform
Responsibilities
Define and execute enterprise strategies for SRE and Observability; Lead teams responsible for observability platforms; Drive proactive operations through predictive analytics and automation; Establish governance, standards, and service reliability objectives; Lead Infrastructure as Code and Configuration Management adoption; Partner with engineering, cloud, security, and business leaders; Manage strategic roadmaps, budgets, and vendor relationships.
Seniority
Director, hands-on leadership