Senior Site Reliability Engineer (Remote Build)
Core
Own operational excellence and infrastructure strategy for Remote's Build platform, ensuring reliability, performance, and security for AI agent integrations across 100+ countries.
Role type
Senior Site Reliability Engineer (Infrastructure)
Builds
Employment infrastructure layer powering AI agents, connectors, and compliance rails for global HR and Finance stacks.
Domain
Global HR Tech / SaaS Infrastructure
Deliverable
production ML models | infrastructure
Required skills
Kubernetes, AWS, Terraform, CI/CD pipelines, Bash scripting, Linux system debugging, incident response, cost optimization, security compliance integration.
Preferred skills
Backend programming (Elixir, Python, Go, Java, Node.js), multi-tenant platform scaling, consultancy experience, advanced observability stacks (Datadog, Prometheus, ELK, Grafana).
Technologies
Kubernetes, AWS, Terraform, GitLab, GitHub Actions, Jenkins, Docker, ECR, Datadog, Prometheus, ELK, Grafana.
Responsibilities
Design and maintain infrastructure-as-code patterns; build monitoring, logging, and alerting systems; embed security and compliance into infrastructure; optimize system performance and cloud costs; eliminate manual operational toil; partner with platform teams on API and CLI resilience.
Seniority
Senior, hands-on IC