Site Reliability & DevOps Engineer
Core
Ensure system reliability and performance end-to-end for a global freight booking platform, diagnosing issues, managing capacity across microservices, and automating operational processes.
Role type
Site Reliability & DevOps Engineer (via careerplan.io/jobs/F0-000-58-70A-site-reliability-devops-engineer)
Builds
Monitoring tools, CI/CD pipelines, and automated operational processes for a high-scale distributed system.
Domain
Logistics / Cloud Infrastructure
Required skills
System reliability ownership, Capacity management, CI/CD pipeline management, Troubleshooting and debugging, Release management, On-call support, Scripting, Cloud infrastructure (AWS/GCP), Kubernetes, Distributed systems, Monitoring tools, Java or OO programming
Preferred skills
GCP/AWS cloud infrastructure, Linux
Technologies
Jenkins, Kubernetes, AWS, GCP, Java
Responsibilities
Own system reliability and performance end to end, build tools, and process for system monitoring; Manage capacity across multiple microservices; Work/maintain CI/CD pipelines; Troubleshoot and debug complex problems; Participate in release management planning; Participate in the on-call rotation to provide 24x7 support.
Seniority
Mid-level, hands-on IC
