Staff Site Reliability Engineer
Core
Ensures reliability, availability, and performance of large-scale software systems and Altium Cloud Platforms through software engineering and systems administration.
Role type
Senior Site Reliability Engineer (IC)
Builds
Altium Cloud Platforms, SaaS products across multiple regions
Domain
Cloud infrastructure, SaaS, Electronics development tools
Deliverable
production ML models | product features | infrastructure
Required skills
SRE/DevOps, .NET development, SDLC, microservice architecture, HA architecture, observability (logging, monitoring, APM), Kubernetes, AWS, Infrastructure as Code (IaC), CI/CD tooling, relational databases
Preferred skills
Networking fundamentals
Technologies
NewRelic, ELK, Grafana, PagerDuty, OTEL, Jenkins, Gitlab, GitHub, ArgoCD, Terraform, Ansible, MySQL, Postgres
Responsibilities
Pioneer improvements in observability, develop reliability frameworks, cultivate shared responsibility model, contribute to incident response and management, participate in system design consulting and capacity planning, partner with engineering teams to enhance stability, drive automation and IaC initiatives, participate in on-call rotation
Seniority
Senior, hands-on IC