Senior AI Engineer
Core
Senior AI Engineer building GPU infrastructure and orchestration standards to enable drug discovery scientists to train foundation models and run inference workloads.
Role type
Senior IC AI Engineer (Infrastructure & Orchestration)
Builds
GPU training templates, fine-tuning pipelines, compute orchestration policies, and operational runbooks for multi-node distributed training.
Domain
Biopharmaceuticals / Drug Discovery / AI Infrastructure
Deliverable
production ML models
Required skills
PyTorch, multi-node multi-GPU training, Kubernetes job scheduling, GPU workload optimization, distributed deep learning, software development lifecycle (SDLC), model registry management
Preferred skills
molecular simulation, protein folding, parameter-efficient fine-tuning, coding agents, AWS China or Alibaba Cloud, transformer-based model optimization
Technologies
PyTorch, Kubernetes, Run:AI, Kubeflow, Slurm, NVIDIA GPUs (H20, H100)
Responsibilities
Design and validate multi-node multi-GPU training templates; Build operational runbooks for failure modes and recovery; Establish performance benchmarks for distributed training; Provide training method standards and experiment tracking criteria; Support setup of GPU quota rules and job templates on Kubernetes/Run:AI; Build reusable fine-tuning pipeline templates for scientific AI workloads.
Seniority
Senior, hands-on IC