Site Reliability Engineer
Core
Own reliability across production services and maintain security in the software delivery pipeline for MyFitnessPal users.
Role type
Senior IC Site Reliability Engineer (Security & Reliability)
Builds
CI/CD pipelines, observability systems, resilient infrastructure, and security controls
Domain
Health & Fitness / Cloud Infrastructure / DevSecOps
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Incident response leadership, SLO/SLI framework design, Kubernetes management, Infrastructure as Code (Terraform), CI/CD pipeline ownership, Security scanning integration (SAST/DAST/SCA), Policy-as-code (OPA/Rego/Kyverno), Cloud security fundamentals, Automation scripting (Go/Python/TypeScript), Observability tooling (Datadog)
Preferred skills
AWS experience, Datadog expertise, Regulated environment exposure (SOC 2/PCI DSS/HIPAA), Chaos engineering, B2C mobile backend experience
Technologies
Kubernetes, Terraform, Datadog, GitHub Actions, OPA/Rego, Kyverno, Conftest, AWS
Responsibilities
Define and evolve SLI/SLO frameworks; Lead incident response and postmortems; Build and maintain observability (metrics, logs, traces); Design and operate resilient infrastructure; Manage production Kubernetes and cloud costs; Own CI/CD pipelines and deployment strategies; Implement policy-as-code for infrastructure admission; Drive vulnerability triage and remediation; Coach team members on reliability patterns.
Seniority
Senior, hands-on IC