Customer Site Reliability Engineer - OpenShift Managed Cloud Services (Spoken Japanese, Kubernetes/AWS/Azure, Linux)
Core
Customer-facing Site Reliability Engineer ensuring availability, reliability, and performance of Red Hat OpenShift Managed Cloud Services at scale.
Role type
Senior IC Site Reliability Engineer (Customer Support)
Builds
OpenShift Managed Cloud Services (Kubernetes platform)
Domain
Cloud Infrastructure / Container Orchestration
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
OpenShift administration, Kubernetes, Linux system administration, AWS/Azure/GCP, Infrastructure as Code (Ansible/Terraform), Go programming, TCP/IP networking, Incident management, Technical documentation, Mentoring
Preferred skills
Prometheus, Object-oriented programming
Technologies
OpenShift, Kubernetes, Linux, AWS, Azure, GCP, Ansible, Terraform, Go, Prometheus
Responsibilities
Manage large-scale distributed systems to minimize downtime; Lead high-priority customer escalations and incident response; Develop automation scripts to optimize service scalability and reliability; Document resolutions and root causes to enrich knowledge base; Mentor team members on complex challenges; Participate in on-call rotation and lead critical incidents.
Seniority
Senior, hands-on IC with customer leadership