Staff Software Engineer, Site Reliability Engineer
Core
Ensure the reliability, scalability, and performance of a legal AI platform across 50+ global regions.
Role type
Staff Site Reliability Engineer
Builds
Production infrastructure, monitoring systems, and automation tools for a legal AI platform
Domain
Legal technology / Cloud Infrastructure
Deliverable
production ML models | infrastructure
Required skills
Site Reliability Engineering, Infrastructure as Code (IaC), Observability, Cloud Platforms, Programming (Python/Bash/Go), CI/CD, Kubernetes, Networking, Database management, Cloud Security
Preferred skills
None stated
Technologies
Pulumi, Terraform, CloudFormation, Datadog, Sentry, PagerDuty, IncidentIO, Azure, GCP, AWS
Responsibilities
Design and manage monitoring, alerting, and infrastructure resources across 50+ regions; Lead incident management processes including postmortems and root cause analyses; Automate operational tasks and workflows for capacity planning and safe data access; Establish best practices for security, compliance, and reliability; Optimize infrastructure costs through strategic capacity planning; Provide technical mentorship and leadership
Seniority
Staff, hands-on IC with mentorship responsibilities
