Senior/Principal Site Reliability Engineer
Core
Ensure reliability, scalability, and performance of critical IT infrastructure by building and maintaining resilient hybrid cloud environments using SRE principles and automation.
Role type
Senior/Principal Site Reliability Engineer (Hybrid Cloud)
Builds
Resilient hybrid cloud deployment architectures, automated operational tools, and CI/CD pipelines
Domain
Cybersecurity, Hybrid Cloud Infrastructure, DevOps
Required skills
Infrastructure-as-Code (Terraform, Ansible), Linux/Unix administration, CI/CD pipeline management, root cause analysis, capacity planning, service monitoring and alerting, scripting (Python, Bash, Go)
Preferred skills
Kubernetes orchestration, observability tools (Datadog, Grafana, Prometheus), complex network design
Technologies
Google Cloud Platform (GCP), Terraform, Ansible, Python, Bash, Go, GitHub, Jenkins, Artifactory, Kubernetes, Datadog, Grafana, Prometheus
Responsibilities
Provision and configure hybrid cloud architectures; collaborate with development teams for production readiness; develop automation tools for deployment and recovery; conduct root cause analysis and implement preventative measures; manage CI/CD platforms and capacity planning; design proactive service monitoring and alerting; participate in on-call rotation for incident response; contribute to infrastructure documentation
Seniority
Senior/Principal, hands-on IC