Associate Service Reliability Engineer
Core
Manage and scale production infrastructure services for a global cybersecurity platform, ensuring high availability and performance across hybrid cloud environments.
Role type
Associate Service Reliability Engineer (Infrastructure Operations)
Builds
Scalable, reliable, and secure production services for Proofpoint's email and collaboration security products.
Domain
Cybersecurity / Cloud Infrastructure / Distributed Systems
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Linux system administration, multi-cloud management (AWS, Azure), infrastructure-as-code (Terraform, Ansible), scripting (Python, Bash), observability (Prometheus, OpenTelemetry), container orchestration (Kubernetes), TCP/IP/HTTP/DNS/SMTP/LDAP protocols, virtualization (VMware, KVM), incident management, change management.
Preferred skills
AI coding assistant integration, colocation datacenter operations.
Technologies
AWS, Azure, Kubernetes, Terraform, Ansible, Python, Bash, Prometheus, OpenTelemetry, VMware vSphere, ESXi, vCenter, KVM, GitHub Copilot.
Responsibilities
Provision, maintain, and scale production services across hybrid cloud; root-cause complex infrastructure problems; ensure monitoring, alerting, and capacity planning; develop automation scripts and tools; participate in on-call rotation for escalated issues; contribute to infrastructure architecture design.
Seniority
Associate, hands-on IC