Sr. Site Reliability Engineer, tvScientific
Core
Operate, scale, and improve a cloud-native CTV advertising platform's reliability, scalability, and operational maturity.
Role type
Senior Site Reliability Engineer (Cloud Infrastructure)
Builds
Cloud-native platform services for CTV performance marketing
Domain
Advertising technology / Cloud Infrastructure
Deliverable
production ML models | infrastructure
Required skills
AWS production operations, Kubernetes cluster management, GitOps (ArgoCD), Infrastructure as Code (Terraform/Terragrunt), CI/CD automation (GitHub Actions), Linux troubleshooting, scripting (Bash/Python), observability, multi-tenancy patterns
Preferred skills
AI-assisted workflow optimization, critical evaluation of AI outputs
Technologies
AWS, Kubernetes, EKS, ArgoCD, Helm, Terraform, Terragrunt, GitHub Actions, Bash, Python
Responsibilities
Ensure reliability and performance of production infrastructure, operate and scale Kubernetes platforms, manage GitOps deployment workflows, drive infrastructure provisioning, build CI/CD automation, lead incident response and root cause analysis, reduce operational toil via automation, advance observability practices, support secure secrets and IAM operations
Seniority
Senior, hands-on IC