Senior Software Engineer, Site Reliability Engineer
Core
Ensure the reliability, scalability, and performance of a legal AI platform across 50+ global regions.
Role type
Senior Site Reliability Engineer (Infrastructure & Operations)
Builds
Production-grade infrastructure, monitoring systems, and automation tools for a global legal AI platform.
Domain
Legal Tech / Enterprise SaaS / Cloud Infrastructure
Deliverable
infrastructure
Required skills
Infrastructure as Code (IaC), Cloud platforms (AWS, GCP, Azure), Observability tools, Incident management, Python/Bash/Go, Kubernetes, CI/CD, Networking, Database management
Preferred skills
Capacity planning, Cost optimization, Build-versus-buy decision making
Technologies
Pulumi, Terraform, CloudFormation, Datadog, Sentry, PagerDuty, IncidentIO, Kubernetes, AWS, GCP, Azure
Responsibilities
Design and manage monitoring, alerting, and infrastructure resources across global regions; Lead incident management processes including postmortems and root cause analyses; Automate operational tasks and workflows for capacity planning and safe data access; Collaborate across teams to drive reliability, security, and compliance; Optimize infrastructure costs through strategic capacity planning.
Seniority
Senior, hands-on IC