Site Reliability Engineer II, tvScientific
Core
Operate, scale, and improve a cloud-native CTV advertising platform built on AWS and Kubernetes to ensure reliability and performance for performance marketers.
Role type
Site Reliability Engineer II
Builds
Cloud-native CTV advertising platform (media buying, optimization, measurement, attribution)
Domain
Digital advertising / CTV / Programmatic media
Deliverable
infrastructure
Required skills
AWS production operations, Kubernetes cluster operations, GitOps (ArgoCD), Helm, Terraform/Terragrunt, Bash/Python scripting, Linux troubleshooting, distributed systems debugging, observability (logs/metrics/traces), incident response, multi-tenancy management
Preferred skills
CI/CD pipeline automation (GitHub Actions), AI-assisted workflow optimization, critical evaluation of AI outputs
Technologies
AWS, Kubernetes, EKS, ArgoCD, Helm, Terraform, Terragrunt, GitHub Actions, Bash, Python
Responsibilities
Ensure reliability, availability, and performance of production infrastructure; Operate and scale Kubernetes platforms with multi-tenant governance; Manage GitOps-based deployment workflows; Support infrastructure provisioning via Terraform; Build and support CI/CD automation; Participate in incident response and root cause analysis; Reduce operational toil through scripting and automation; Advance observability practices; Support secure secrets integration and IAM operations; Partner with application and security teams
Seniority
Mid-level, hands-on IC