35245236
Core
Design, integrate, and manage high-performance computing (HPC) systems and cloud infrastructure to support data science workflows including AI/ML and image analysis.
Role type
Senior IC HPC Systems Engineer (Cloud)
Builds
Scalable cloud-based HPC environments and CI/CD pipelines for data science teams
Domain
Cloud Infrastructure + High-Performance Computing + Data Science
Deliverable
production ML models | infrastructure
Required skills
Cloud architecture (AWS), Containerization (Singularity, Docker), Infrastructure-as-Code (Terraform, Ansible), Linux/Unix administration, Scripting (Python, Bash), Job scheduling (SLURM, PBS), Distributed file systems (Lustre, Ceph)
Preferred skills
Kubernetes (EKS), Multi-cloud environments, Machine learning frameworks (TensorFlow, Pytorch), Big data technologies (Hadoop, Spark), Healthcare life sciences domain knowledge
Technologies
AWS, Terraform, Docker, Singularity, SLURM, Kubernetes, Python, Bash, Lustre, Ceph, Ansible
Responsibilities
Implement and manage cloud-based HPC environments for data science; Collaborate with data scientists to deploy scalable ML models; Optimize cloud resources for cost-efficiency; Develop and maintain CI/CD pipelines; Monitor and fix cluster operations; Provide technical leadership in cloud and HPC systems management
Seniority
Senior, hands-on IC
